• 제목/요약/키워드: Retrieval Model

검색결과 815건 처리시간 0.028초

의학문서 질의응답을 위한 정답 스닛핏 검색 (Answer Snippet Retrieval for Question Answering of Medical Documents)

  • 이현구;김민경;김학수
    • 정보과학회 논문지
    • /
    • 제43권8호
    • /
    • pp.927-932
    • /
    • 2016
  • 온라인 의학 문서의 폭발적 증가와 함께 질의응답 시스템에 대한 필요성이 늘어나고 있다. 최근에는 기계학습에 기반 한 질의응답 모델들이 다양한 영역에서 좋은 결과를 보여 왔다. 그러나 의학 영역에서 질의응답 모델들은 학습 데이터의 부족으로 인해 여전히 정보 검색 기술에 기반을 두고 있다. 본 논문에서는 다양한 정보검색 기술에 기반 한 의학문서 질의응답용 정답 스닛핏 검색 모델을 제안한다. 제안 모델은 먼저 클러스터 기반 검색 기술을 이용하여 의학 문서로부터 많은 정답 후보 문장을 검색한다. 그리고 다양한 문장 검색 기술들에 기반 한 정답 후보 문장 재순위화 모델을 사용하여 신뢰성 있는 정답 스닛핏을 생성한다. BioASQ 4b 데이터를 이용한 실험에서 제안 모델은 기존 모델보다 좋은 성능(MAP 0.0604)을 보였다.

알파 다이버전스를 이용한 무게중심 모델 기반 음악 유사도 (Centroid-model based music similarity with alpha divergence)

  • 서진수;김정현;박지현
    • 한국음향학회지
    • /
    • 제35권2호
    • /
    • pp.83-91
    • /
    • 2016
  • 음악 유사도 계산은 음악 검색 및 분류 등의 정보 처리 시스템 구현에 있어서 가장 중요한 부분이다. 본 논문은 최근 제안된 무게중심 모델을 이용한 음악 검색 방법에 대해서 살펴보고, 무게중심 모델의 확률 분포 유사도를 이용하여 음악 검색을 수행하고 성능을 평가하였다. 확률 분포간의 거리는 주어진 두 개의 확률 분포가 특정 기준에서 얼마나 가까운 지를 계산하는 것으로 다이버전스라고 불리기도 한다. 본 논문에서는 무게중심 모델에서 확률 분포 간의 거리 비교 시에 알파 다이버전스를 활용하였다. 알파 다이버전스는 알파 값에 따라 다양한 형태를 가지며, 널리 사용되고 있는 KLD(Kullback-Leibler)와 BD(Bhattacharyya Distance)를 포함한다. 음악 장르와 가수 데이터셋에서 검색 실험을 수행했고, 확률 분포 거리 기반 유사도와 벡터 거리 기반 유사도의 음악 검색 성능을 비교하였다. 알파 다이버전스를 통해서 무게중심 모델 기반 음악 검색 성능을 개선시킬 수 있음을 보였다.

인터액티브 정보검색 모형 (Interactive Information Retrieval (IR) Models: Tradition and Development)

  • 김양우
    • 정보관리학회지
    • /
    • 제24권2호
    • /
    • pp.45-69
    • /
    • 2007
  • 본 논문은 다음과 같은 두 부분으로 구성된다. 논문의 전반부는 네 개의 정보검색 모형을 다루고 있는데 이는 전통적 정보검색 모형과 보다 최근에 나온 세 연구자의 이용자 중심 인터액티브 모형을 포함한다. 인터액티브 정보검색 모형은 Belkin, Ingwersen, 그리고 Saracevic에 의하여 제시된 것인데, 전통적 정보검색 모형을 포함한 각 모형의 장점과 한계점이 기술된다. 논문의 후반부에서 저자는 이상과 같은 모형들에 관한 분석을 토대로 그 자신의 인터액티브 모형, 즉 빙산모형(Iceberg Model)을 제시하고 있다. 빙산모형의 타당성으로 다음과 같은 세 가지 사항을 강조하고 있는데, 즉, 보다 구체화된 시스템 특성의 포함, 보다 명확한 인터액티브 정보검색 요소간의 상호작용, 그리고 정보매개자의 증가된 역할 등이 그것이다. 요약하면, 빙산모형은 변화하는 정보추구환경에서 진화할 수 있는 틀을 제시하고 있다.

PVDHMM을 이용한 음소열 기반의 SDR 응용 (Spoken Document Retrieval Based on Phone Sequence Strings Decoded by PVDHMM)

  • 최대림;김봉완;김종교;이용주
    • 대한음성학회지:말소리
    • /
    • 제62호
    • /
    • pp.133-147
    • /
    • 2007
  • In this paper, we introduce a phone vector discrete HMM(PVDHMM) that decodes a phone sequence string, and demonstrates the applicability to spoken document retrieval. The PVDHMM treats a phone recognizer or large vocabulary continuous speech recognizer (LVCSR) as a vector quantizer whose codebook size is equal to the size of its phone set. We apply the PVDHMM to decode the phone sequence strings and compare the outputs with those of a continuous speech recognizer(CSR). Also we carry out spoken document retrieval experiment through PVDHMM word spotter on the phone sequence strings which are generated by phone recognizer or LVCSR and compare its results with those of retrieval through the phone-based vector space model.

  • PDF

Conceptual Retrieval of Chinese Frequently Asked Healthcare Questions

  • Liu, Rey-Long;Lin, Shu-Ling
    • International Journal of Knowledge Content Development & Technology
    • /
    • 제5권1호
    • /
    • pp.49-68
    • /
    • 2015
  • Given a query (a health question), retrieval of relevant frequently asked questions (FAQs) is essential as the FAQs provide both reliable and readable information to healthcare consumers. The retrieval requires the estimation of the semantic similarity between the query and each FAQ. The similarity estimation is challenging as semantic structures of Chinese healthcare FAQs are quite different from those of the FAQs in other domains. In this paper, we propose a conceptual model for Chinese healthcare FAQs, and based on the conceptual model, present a technique ECA that estimates conceptual similarities between FAQs. Empirical evaluation shows that ECA can help various kinds of retrievers to rank relevant FAQs significantly higher. We also make ECA online to provide services for FAQ retrievers.

인간심리를 이용한 감성 모델과 영상검색에의 적용 (Emotional Model via Human Psychological Test and Its Application to Image Retrieval)

  • 유헌우;장동식
    • 대한산업공학회지
    • /
    • 제31권1호
    • /
    • pp.68-78
    • /
    • 2005
  • A new emotion-based image retrieval method is proposed in this paper. The research was motivated by Soen's evaluation of human emotion on color patterns. Thirteen pairs of adjective words expressing emotion pairs such as like-dislike, beautiful-ugly, natural-unnatural, dynamic-static, warm-cold, gay-sober, cheerful-dismal, unstablestable, light-dark, strong-weak, gaudy-plain, hard-soft, heavy-light are modeled by 19-dimensional color array and $4{\times}3$ gray matrix in off-line. Once the query is presented in text format, emotion model-based query formulation produces the associated color array and gray matrix. Then, images related to the query are retrieved from the database based on the multiplication of color array and gray matrix, each of which is extracted from query and database image. Experiments over 450 images showed an average retrieval rate of 0.61 for the use of color array alone and an average retrieval rate of 0.47 for the use of gray matrix alone.

객체 지향 멀티미디어 데이터베이스 모델하에서의 다중 키워드 검색 기법에 관한 연구 (A Study on the Multiple Keyword Retrieval Method under the Object-Oriented Multimedia Database Model)

  • 석상기;김경창;김기용
    • 한국통신학회논문지
    • /
    • 제18권8호
    • /
    • pp.1176-1189
    • /
    • 1993
  • 본 논문에서는 객체 지향 멀티미디어 데이타베이스 모델 하에서 다중 키워드를 이용한 검색 기법을 제안하였다. 멀티미디어 데이타 검색에서의 부분 매칭 문제점을 가급적 줄이기 위한 다중 키워드 등록 띤 검색알고리즘을 개발하였으며, 이를 위해 적절한 탐색 테이블의 저장 구조를 설계하였다. 또한 미디어 데이타 화일을 B+ 트리로 구성하여 검색 시간이 일정하도록 하였다.

  • PDF

유사도 알고리즘을 활용한 시맨틱 프로세스 검색방안 (Semantic Process Retrieval with Similarity Algorithms)

  • 이홍주
    • 한국경영과학회:학술대회논문집
    • /
    • 한국경영과학회 2007년도 추계학술대회 및 정기총회
    • /
    • pp.267-272
    • /
    • 2007
  • One of the roles of the Semantic Web services is to execute dynamic intra-organizational services including the integration and interoperation of business processes. Since different organizations design their processes differently, the retrieval of similar semantic business processes is necessary in order to support inter-organizational collaborations. Most approaches for finding services that have certain features and support certain business processes have relied on some type of logical reasoning and exact matching. This paper presents our approach of using imprecise matching fur expanding results from an exact matching engine to query the OWL MIT Process Handbook. In order to use the MIT Process Handbook for process retrieval experiments, we had to export it into an OWL-based format. We model the Process Handbook meta-model in OWL and export the processes in the Handbook as instances of the meta-model. Next, we need to find a sizable number of queries and their corresponding correct answers in the Process Handbook. We devise diverse similarity algorithms based on values of process attributes and structures of business processes. We perform retrieval experiments to compare the performance of the devised similarity algorithms.

  • PDF

NFC 태그 정보를 이용한 검색 정보의 군집 시스템 모델 (Clustering System Model of Intormation Retrieval using NFC Tag Information)

  • 박선;김형균;심수정
    • 스마트미디어저널
    • /
    • 제2권3호
    • /
    • pp.17-22
    • /
    • 2013
  • NFC 스마트폰의 보급 증가는 앱과 연계하여 다양한 서비스를 제공하고 있으며, 단순한 인터넷 서비스를 개인화 서비스로 변화 시킬 것으로 예상되고 있다. 본 논문은 정보 접근을 위한 NFC 태그의 정보를 이용하여 유사정보를 활용할 수 있도록 검색 정보를 군집하는 시스템 모델을 제안한다. 제안된 모델을 NFC 태그에서 제공하는 정보를 이용하여 유사 정보를 검색할 수 있다. 또한 검색된 유사정보를 사용자가 활용할 수 있도록 주제별 군집할 수 있다.

  • PDF

2-포아송 모형의 전문검색시스템 응용에 관한 연구 (Application of the 2-Poisson Model to Full-Text Information Retrieval System)

  • 문성빈
    • 정보관리학회지
    • /
    • 제16권3호
    • /
    • pp.49-63
    • /
    • 1999
  • 본 연구는 질문용어의 분포가 초록/표제 및 전문으로 표현된 문헌 내에서 2-포아송 분포를 따르고 있는지를 조사하였으며 질문용어의 2-포아송 분포여부가 확률이론에 기반을 둔 이진독립모형과 2-포아송 독립모형에서 초록/표제 및 전문의 검색효율성에 미치는 영향을 비교 분석하였다.

  • PDF