Annual Conference on Human and Language Technology (한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리))
- 1996.10a
- /
- Pages.68-72
- /
- 1996
- /
- 2005-3053(pISSN)
Improving Indexing Performance by using Occurrence Pattern Information of Proper Nouns
고유 명사 출현 패턴을 이용한 색인의 성능 향상에 관한 연구
- Jung, Rae-Jung (Department of Computer Engineering, Dongguk University) ;
- Kim, Jun-Tae (Department of Computer Engineering, Dongguk University)
- Published : 1996.10.11
Abstract
본 논문에서는 고유 명사 출현 패턴 정보와 부가 정보를 이용한 미등록 고유 명사의 색인 방법을 제안한다. 정보 검색 시스템에서 고유 명사의 처리는 정확하고 의미 있는 색인을 위해 매우 중요하다. 본 논문은 형태소 분석 결과에 고유 명사 출현 패턴과 패턴 부가 정보를 사용하여 인명, 기관명, 회사명 등의 고유 명사 추출의 정확도를 높이는 방법을 제시한다. 총 827개의 인명과 기관 및 회사명을 포함하고 있는 조선일보 경제면 기사 100개 7416 어절에 대하여 본 시스템으로 실험한 결과, 인명의 경우 89%의 정확률을 보였다. 본 논문에서 제시한 출현 패턴과 고유 명사의 부가 정보를 적용했을 때 단순한 형태소 분석 결과에 비하여 고유 명사 추출 오류가 크게 개선되었다.
Keywords