Analysis of Derived Nouns and Compound Nouns by Examining Full Text

전문(全文) 분석을 통한 파생명사 및 합성명사의 분석

  • 박봉래 (고려대학교 컴퓨터학과 자연어처리연구실) ;
  • 황영숙 (고려대학교 컴퓨터학과 자연어처리연구실) ;
  • 임해창 (고려대학교 컴퓨터학과 자연어처리연구실)
  • Published : 1997.10.10

Abstract

대부분의 한국어 형태소 분석기는 파생명사나 합성명사가 포함된 어절을 오분석 또는 과분석하는 경향이 있다. 이는 하나의 어절에서 오분석이나 과분석을 방지하기 위하여 획득할 수 있는 정보가 제한적이기 때문이다. 이에 본 논문은 파생명사나 합성명사 후보가 포함된 어절뿐만 아니라 주변 및 전문에서 분석에 필요한 정보를 수집하여 이용하는 방법을 제시한다. 제안한 방법은 오분석된 파생명사나 합성명사에만 나타나는 저빈도 단어를 제거하고, 파생명사나 합성명사 후보의 주변 어휘들을 실마리로 이용하며, 문서 전역에서 동일한 파생명사나 합성명사 후보가 포함된 둘 이상의 어절을 비교분석하여 파생명사 및 합성명사 후보가 포함된 어절을 처리한다. 실험 결과 제안한 방법은 99.8%의 정확도와 95.3%의 재현율로 파생명사나 합성명사 후보가 포함된 어절을 올바르게 분석할 수 있었다.

Keywords