Proceedings of the Korean Information Science Society Conference (한국정보과학회:학술대회논문집)
- 2000.10b
- /
- Pages.170-172
- /
- 2000
- /
- 1598-5164(pISSN)
Extraction and Classification of Proper Nouns by Rule-based Machine Learning
규칙 기반의 기계학습을 통한 고유명사의 추출과 분류
Abstract
고유명사를 추출하고 그 범주를 파악할 수 있다면, 이는 정보 추출이나 정보 검색, 문서 요약과 같은 분야에 도움을 줄 수 있다. 본 논문에서는 고유명사를 추출하고 그 범주를 찾는 방법을 제시한다. 고유명사가 태깅된 코퍼스로부터, 고유명사의 내부와 주변에 반복적으로 나타나는 실마리들을 규칙 기반으로 학습한다. 이를 통하여 고유명사를 찾고 그 범주를 정한다. 구현한 시스템은 경제기사 코퍼스에서 4가지 범주로 고유명사를 추출하고 분류함에 있어 79.8%의 재현율과 92.9%의 정확률, 그리고 F 평가치에서 85.8의 성능을 보인다.
Keywords