• Title/Summary/Keyword: 주제어 사전

Search Result 32, Processing Time 0.02 seconds

A Sentence Theme Allocation Scheme based on Head Driven Patterns in Encyclopedia Domain (백과사전 영역에서 중심어주도패턴에 기반한 문장주제 할당 기법)

  • Kang Bo-Young;Myaeng Sung-Hyon
    • Journal of KIISE:Software and Applications
    • /
    • v.32 no.5
    • /
    • pp.396-405
    • /
    • 2005
  • Since sentences are the basic propositional units of text, their themes would be helpful for various tasks that require knowledge about the semantic content of text. Despite the importance of determining the theme of a sentence, however, few studies have investigated the problem of automatically assigning the theme to a sentence. Therefore, we propose a sentence theme allocation scheme based on the head-driven patterns of sentences in encyclopedia. In a serious of experiments using Dusan Dong-A encyclopedia, the proposed method outperformed the baseline of the theme allocation performance. The head-driven pattern 4, which is reconfigured based on the predicate, showed superior performance in the theme allocation with the average F-score of $98.96\%$ for the training data, and $88.57\%$ for the test data.

A Study on Service Integration of Research Information and Dictionary in Portal Site (포털사이트의 사전과 학술정보 연계 검색 방안 연구)

  • Yang, Chang-Jin
    • Journal of the Korean Society for information Management
    • /
    • v.28 no.1
    • /
    • pp.7-22
    • /
    • 2011
  • Internet portals have been revolutionized not only as simple search engines but also as a new space for the Internet users. They have developed to give satisfying search results for academic information users. academic fields. However, their attention was given to the quantity rather than the quality of the results. This tendency is now changing. This study addresses the problems in the search process using the current portal sites and presents an integrated scholarly information service where users can access more organized and trustworthy information linked with online technical keyword dictionary. When a user enter a keyword on a portal site, he/she can access to high quality scholarly information resources linked with keyword. This could assure the user to get an expanded knowledge with confirmation.

A Keyword analysis on the 'user' related research papers : In Library and Information Science (이용자 관련 연구논문에 대한 주제어 분석)

  • Park, Seonmi;Oh, Kyung-mook
    • Proceedings of the Korean Society for Information Management Conference
    • /
    • 2013.08a
    • /
    • pp.43-46
    • /
    • 2013
  • 본 연구에서는 국내 문헌정보학 분야의 연구 논문 중 이용자 관련 연구 논문 125편을 대상으로 논문에 부여된 주제어간의 연결 관계를 분석 하였다. 사전 작업을 통하여 정리된 226개의 주제어에 대한 연결 관계를 네트워크 분석을 통하여 분석하고 시각화 하였다. 그래프를 통하여 주제어간 연결 강도를 확인하였고, 다른 주제어와 연결성이 높은 상위 20개의 주제어를 제시하였다. 주제어간 근접성이 높은 주제어를 군집화한 결과 14개의 군집으로 정리되었다. 다른 주제어와 연결이 없이 고립된 군집이 8개, 연결된 군집이 6개였다.

  • PDF

Improving the performance of natural language information retrieval system by using non-keyword search methods. (자연어 질의 정보 검색 시스템의 비주제어 탐색 방법을 통한 성능 개선)

  • Lee, Seung-Ryul;Kang, Hyun-Kyu;Park, Se-Young;Lee, Sang-Jo
    • Annual Conference on Human and Language Technology
    • /
    • 1994.11a
    • /
    • pp.374-377
    • /
    • 1994
  • 본 논문에서는 한글 문서 검색 시스템에서 자연어 질의어로 검색할경우, 질의어를 주제어와 참조어로 나누어 재구성하여 검색하는 방법을 제시하였다. 먼저 주제어로 전문검색을 하여 후보 카드들을 추출한 후 비주제어로 다시 본문 탐색을 하여 추출된 카드의 가중치를 재조정함으로써 카드추출의 정확성을 높였다. 이 논문에 제시된 방법의 실험은 한국전자통신연구소 언어정보연구실에서 개발한 멀티미디어 전자 백과 사전의 자연어 검색모듈에서 행하여 졌다. 이 방법으로 별다른 검색속도의 저하나, 저장공간의 추가가 없이 기존의 검색 방법에서보다 약 58%정도의 검색의 정확성이 올라갔다. 본 논문에서 제시한 검색의 방법은 여러가지 응용의 자연어 인터페이스에서 데이타를 검색하는 정보검색의 분야에 적용되어 정확성을 높일 수 있을 것이다.

  • PDF

Dynamic Expansion of Semantic Dictionary for Topic Extraction in Automatic Summarization (자동요약의 주제어 추출을 위한 의미사전의 동적 확장)

  • Choo, Kyo-Nam;Woo, Yo-Seob
    • Journal of IKEEE
    • /
    • v.13 no.2
    • /
    • pp.241-247
    • /
    • 2009
  • This paper suggests the expansion methods of semantic dictionary, taking Korean semantic features account. These methods will be used to extract a practical topic word in the automatic summarization. The first is the method which is constructed the synonym dictionary for improving the performance of semantic-marker analysis. The second is the method which is extracted the probabilistic information from the subcategorization dictionary for resolving the syntactic and semantic ambiguity. The third is the method which is predicted the subcategorization patterns of the unregistered predicate, for the resolution of an affix-derived predicate.

  • PDF

Study on Improvement of Research Information Search in Portal Site (포털 사이트의 학술정보 검색 개선 방안 연구 - 사전 서비스와의 연계를 중심으로 -)

  • Yang, Chang-Jin
    • Proceedings of the Korean Society for Information Management Conference
    • /
    • 2010.08a
    • /
    • pp.33-40
    • /
    • 2010
  • 인터넷 포털 사이트는 단순한 검색엔진을 넘어 네티즌들이 항해하는 사이버스페이스 그 자체를 의미할 정도로 영역과 개념이 확대되었다. 일반인들뿐만 아니라 전문 연구자도 필요로 하는 학술정보를 포털 사이트에서 서비스하기 때문에 포털 사이트를 많이 이용한다. 그 동안 포털의 검색은 얼마나 많은 정보를 검색 결과로 제시해 줄 것인가 하는 양적인 면에 관심을 두었다. 그러나 최근에는 검색의 질적인 측면에 보다 많은 관심이 주어지고 있다. 이 논문은 포털에서 제공하는 전문 학술정보 검색의 문제점을 제시하고, 주제어 사전 서비스와 연계하여 보다 신뢰성 높은 학술정보를 검색할 수 있게 하기 위한 시범적인 시도이다. 즉, 검증되고 압축적으로 정리된 사전의 표제어와, 해당 표제어를 키워드로 하는 권위있는 연구 성과를 같이 연계시킴으로써, 사전을 검색할 때 연구 성과까지 검색할 수 있게 하여, 검색의 효율성과 정보의 신뢰성을 높일 수 있는 방안을 제시하고자 하였다.

  • PDF

The Design of Index System for Encyclopedia Database (백과사전 데이타베이스를 위한 색인시스템 설계)

  • 추윤미;최석두
    • Proceedings of the Korean Society for Information Management Conference
    • /
    • 1994.12a
    • /
    • pp.37-40
    • /
    • 1994
  • 백과사전 데이타베이스의 효과적인 검색을 위한 색인시스템을 설계하였다. 여기에서는 항목에 대한 각종 속성정보와 본문정보를 모두 포함한 색인표제어파일을 작성하고, 각 항목에 대한 참조항목을 별도로 두지 않고 시소러스파일의 BT, NT, RT, UF를 사용하여 그 항목과 연관된 항목을 참조하도록 한다. 시소러스파일은 각 색인표제어에 부여한 주제분류기호(DDC, 또는 KDC)의 계층구조를 이용하여 자동생성한 후 색인자의 수작업을 거쳐 작성된다. 이 색인시스템을 통해 백과사전에 포함되어 있는 모든 정보를 이용한 다양한 접근이 가능하며 시소러스를 사용하여 관련항목을 브라우징을 할 수 있어 포괄적인 검색이 가능하다.

  • PDF

Topic Continuity in Naturalistic Speech Data by Korean High-Functioning Autistic Children (한국 고기능 자폐 아동의 자연발화에 나타난 주제 지속성)

  • Jee, Min-Jung;Hong, Eun-Mi;Song, Young-Wan;Park, Sun-Eon;Cho, Sook-Whan
    • Proceedings of the Korean Society for Cognitive Science Conference
    • /
    • 2005.05a
    • /
    • pp.261-266
    • /
    • 2005
  • 본 논문은 고기능 자폐 아동들이 담화 주제어 연속성(topic continuity)을 어떻게 습득하는지에 대해 검토하였다. 연구의 목적을 위하여 세 고기능 자폐 아동(9;11-12:2)의 자연 발화를 관찰 분석하였다. 사전 연구에 의하면, 자폐아동들은 의사소통의 기본적인 규칙을 잘 이해하지 못할 뿐만 아니라 타인의 사고와 기대 등에 민감하지 못하여 담화 주제를 적절히 유지하거나 전환하는(topic shift) 일에 많은 어려움을 겪는다. 본 연구는 한국 자폐아동들이 주제어의 유지와 전환 등, 담화 화용적(discourse-pragmatic) 기능의 발달 양상을 규명하는 것을 주요 목표로 한다. 본 연구의 자료는 세 자폐 아동의 자연 발화 내용으로서 1주-2주에 한번씩 매번 방문 시 120분 동안 녹음하였다. 분석 결과 다음의 몇 가지 습득 양상을 발견하였다. 첫째, 세 자폐 아동들에게서 발견된 주제 유지 빈도는 정상 아동들에 비해 낮았다. 한편. 이 아이들은 가끔 화제를 자신의 담화 주제로 돌려 자신의 주제 중심으로 대화를 지속했다. 이 아동들은 대화 상대자의 주제에 대해서는 민감하지 않지만 자신의 주제를 유지하려는 경향을 보이기도 한다. 둘째, 개별 아동을 검토한 결과, 담화 주제의 지속성이 높은 발화를 하는 아동은 현재 담화 주제에 더 민감하고 반향어를 산출할 때에도 자기 자신의 말 반복과 담화 상대자의 말을 반복하는 빈도가 별로 차이가 나지 않았다. 반면, 담화 주제의 지속성이 낮은 발화를 하는 아동은 이전 담화 주제에 더 민감하고, 반향어는 담화 상대자의 말 보다는 자기 자신의 말을 반복하는 비율이 더 높았다. 본 연구의 결과는 자폐 아동들이 담화 주제를 지속하는 능력이 많이 부족하지만, 담화 주제의 연속성은 다른 발화 유형과 상호 작용을 하면서 발달될 수 있다는 가능성을 보여 주었다. 따라서 본 연구 결과는 앞으로 자폐 아동의 연구가 집단 간의 연구뿐만 아니라 개별 아동의 발화에 쓰인 유형 간의 상호 관계를 주목함으로써 자폐 아동의 개별적 언어 치료에 새로운 시각을 심어 줄 가능성을 시사한다.

  • PDF

An Implementation of Web-Based Korean Language Information Retrieval System (웹기반 한글정보검색시스템의 구현)

  • Hong, G.C.;Chung, H.S.
    • Electronics and Telecommunications Trends
    • /
    • v.14 no.6 s.60
    • /
    • pp.9-21
    • /
    • 1999
  • 최근 인터넷상에는 매일 방대한 양의 정보가 창출되어 유포되고 있으며, 수많은 정보 제공 사이트들이 늘고 있다. 이용자들은 필요한 정보를 찾고 활용하기 위해 야후(Yahoo), 알타비스타(AltaVista) 등 국외 검색엔진(search engine)들과 심마니, 미스 다찾니 등 국내 검색엔진 등 인터넷상에 운용되고 있는 이들 시스템들을 이용하고 있지만, 대부분의 시스템들은 자체 정보 제공보다는 로봇 에이전트를 이용하여 인터넷 사이트에 등록되어 있는 다양한 분야의 홈페이지 정보들을 수집/분석하여 관련 사이트를 연결해주는 방식의 메타 검색엔진들로서 불필요한 정보들까지 제공함에 따라 이용자들이 필요로 하는 정보를 찾기에는 너무 많은 노력과 시간을 소모하게 되는 문제점을 안고 있다. 이에 본 고에서는 형태소 분석 및 시소러스 사전을 이용하여 검색의 정확성 및 재현율 향상을 고려하고, 주제어 중심의 불리언 검색뿐만 아니라 하이퍼텍스트 기반의 주제어 카탈로그 검색, 각기 다른 사이트의 검색엔진들로부터 질의한 결과를 통합하여 제공하는 지능형 통합검색, 이용자 프로파일에 근거하여 최신 업데이트된 정보를 주기적으로 제공해주는 맞춤정보서비스(Selective Dissemination of Information Service: SDI) 등을 통합한 인터넷 기반의 한글 정보검색시스템의 구현에 대한 내용을 기술하고자 한다.

Finding Meaningful Chronological Pattern of Key Words in Computer Science Bibliography (K-평균 군집화 기법을 활용한 DBLP 논문 서지정보의 연대별 출현 패턴 연구)

  • Heo, Joo-Seong;Im, Hyeon-Gyo;Kim, Gyeong-Han;Han, Youn-Hee
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • 2016.10a
    • /
    • pp.542-545
    • /
    • 2016
  • 컴퓨터공학 분야의 논문 정보를 다루고 있는 대표적인 사이트인 DBLP의 연구 동향을 알아보기 위해 본 논문에서는 약 300만개 이상의 논문 서지정보 가져와 분석했다. IT용어 사전을 만들고 각 논문의 제목과 초록에 포함된 주제어를 추출해 분석을 위한 고차원의 행렬을 만들고, k-평균 군집화 기법을 활용하여 1960년도부터 2010년도까지 총 60여 년간의 연대별 주제어 출현 패턴을 분석함으로써 흥미로운 결과를 도출해 냈다.