상세 보기
초록
이 연구에서는 말뭉치 구성의 경험적 근거를 모색하기 위한 방안으로 명사류의 사용 양상을 텍스트 유형에 따라 계량적으로 살펴보았다. 이를 위해 실험말뭉치를 규모별로 구축하고 이 말뭉치들로부터 명사류의 사용 양상을 타입과 토큰, 그리고 단발어 빈도를 산출하여 텍스트 유형별 명사류의 사용 양상을 밝히고자 하였다. 그 결과 일반명사는 말뭉치의 규모가 증가함에 따라 텍스트 유형별로 큰 차이 없이 꾸준히 증가하는 양상을 보였는데 특히 <신문>, <잡지>가 <책>에 비해 다양한 일반명사가 쓰임이 확인되었다. 이러한 양상은 단발어 통계에서도 유사하게 발견되었다. 대명사는 텍스트 유형에 따른 사용 양상의 차이를 분명하게 보여주었는데, 특히 <책_상상>에서 가장 많은 타입이 사용되었다. 단발어 통계에서는 매우 불규칙적인 분포 양상을 보였는데 이는 대명사의 제한된 어휘 목록과 관련이 있는 것으로 해석하였다. 의존명사는 텍스트 타입에 따른 사용 양상의 차이가 가장 적은 어휘 항목임이 확인되었다. 이는 타입과 토큰 모두에서 동일하게 관찰되었다. 고유명사는 <신문>, <잡지>에서 압도적으로 많은 타입이 사용되었는데, 이는 토큰에서는 동일한 양상이 유지되지 않았다. 이와 같이 명사류의 사용 양상을 말뭉치의 규모가 확대되는 양상에 따라 검토함으로써 말뭉치의 설계를 위한 경험적 근거를 제공할 수 있음을 보였다.
키워드
실험말뭉치; 텍스트 타입; 타입; 토큰; 단발어; 균형성; 명사류; pilot corpus; text type; type; token; hapax legomenon; balance; noun class; pilot corpus; text type; type; token; hapax legomenon; balance; noun class
- 제목
- 말뭉치 규모와 텍스트 유형에 따른 명사류의 사용 양상
- 제목 (타언어)
- Corpus-based Study on Usages of Noun Classes in Modern Korean
- 저자
- 김일환
- 발행일
- 2008
- 저널명
- 동양학
- 호
- 43
- 페이지
- 97 ~ 113