• 제목/요약/키워드: 재현율

검색결과 1,208건 처리시간 0.03초

컴포넌트 검색을 지원하는 시소러스에 의한 질의평가 (Query Evaluation by Thesaurus to Support Component Retrieval)

  • 김귀정
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2003년도 추계학술발표논문집 (하)
    • /
    • pp.1617-1620
    • /
    • 2003
  • 본 논문은 사용자 질의가 가지는 특정 클래스로부터 개념적으로 서로 연관있는 컴포넌트를 검색하기 위하여 퍼지 시소러스를 통한 질의 평가 방법을 이용하였다. 시소러스에 의한 사용자 질의 확장과정은 용어 불일치 문제를 해결함으로써 검색에 대한 일정한 정확도를 보장하면서 재현율을 향상시킬 수 있게 한다. 필의 확장과정의 효율성을 평가하기 위하여 시뮬레이션을 통한 최적의 검색 효율을 나타내는 임계치를 설정하고 재현율과 정확도를 비교하였다.

  • PDF

LSTM 시계열 매개변수 적용을 통한 효율적 데이터 관리 (A Study on data management by applying LSTM time series parameters)

  • 민연아
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2022년도 제66차 하계학술대회논문집 30권2호
    • /
    • pp.537-538
    • /
    • 2022
  • LSTM은 딥러닝 RNN의 한 종류이며 RNN의 단점인 장기 데이터손실에 대한 문제를 해결하기 위해 제시된다. 본 논문에서는 LSTM의 하이퍼파라미터 적용 시 이전 state의 중요도와 이후 state에 대한 중요도 예측에 대한 신경망 처리를 위하여 유의미성 측정가능한 매개변수를 적용하여 처리하고 데이터에 대한 정밀도와 재현율을 높이는 것을 목적으로 한다. 동일한 데이터셋에 대하여 전통적인 LSTM 방식과 본 연구를 비교한 결과 정밀도와 재현율이 5%이상 증가함을 확인하였다.

  • PDF

메타데이타와 텍스트 정보의 통합검색 모델 (A Hybrid Information Retrieval Model Using Metadata and Text)

  • 유정목;맹성현;김성수;이만호
    • 한국정보과학회논문지:데이타베이스
    • /
    • 제34권3호
    • /
    • pp.232-243
    • /
    • 2007
  • 메타데이타를 위한 검색모델은 질의에 사용자의 정보요구를 정확하게 반영하기 때문에 정확율(precision)은 높지만 질의 조건에 만족하지 않는 정보를 배제하므로 재현율(recall)은 낮다. 반면 전문(full-text) 텍스트 검색 모델은 사용자 질의에 대하여 모든 문서를 검색대상으로 하므로 정확율은 낮고 재현율은 높다. 메타데이타 검색모델의 높은 정확율은 사용자가 메타데이타의 구조적 특성에 맞게 질의를 구성할 경우 가능하지만 일반적으로 사용자가 메타데이타의 구조 정보를 반영한 사용자 질의를 구성할 수 있다고 기대하기는 어렵다. 또한 메타데이타에 포함된 정보의 양은 전문 텍스트가 가진 정보의 양보다 적기 때문에 텍스트를 검색한 결과보다 재현율이 떨어진다. 본 논문에서는 이러한 특성을 반영하여 메타데이타 검색 시, 사용자의 다양한 질의를 메타데이타의 특성에 맞게 재구성하고 메타데이타뿐 아니라 텍스트에 대해서도 검색을 수행하여 두 모델의 장점을 함께 고려한 통합 검색 모델을 제안한다.

FRBR 모형 기반 서지검색시스템의 검색 효율성 평가 연구 (An Experimental Study on the Retrieval Efficiency of the FRBR Based Bibliographic Retrieval System)

  • 김현희
    • 한국도서관정보학회지
    • /
    • 제38권3호
    • /
    • pp.223-246
    • /
    • 2007
  • 본 연구에서는 FRBR 모형 기반 서지검색시스템의 검색 효율성을 평가하기 위해서 두 개의 실험 시스템을 구축하였다. 즉, FRBR화 알고리즘을 적용한 FRBR 기반 시스템과 일반 OPAC 기반 시스템을 387건의 KORMARC 기반 음악 자료를 데이터베이스로 활용하여 구성하였다. 그런 다음, 6개의 연구 가설을 세우고 28명의 피조사자와 표현형 질문 6개와 구현형질문 6개로 구성된 총 12개의 검색 질문을 이용하여 이 두 시스템을 재현율, 정확률 및 검색 시간을 측정 기준으로 하여 비교, 분석하였다. 중다변량분석과 t-검증을 이용하여 실험 결과를 분석한 결과, FRBR 시스템이 질문의 유형을 가리지 않고 평균 재현율이 OPAC 시스템 보다 단연 앞서는 것으로 나타났고, 구현형 질문의 경우 OPAC 기반 시스템이 FRBR 기반 실험시스템보다 평균 정확률이 조금 높았고 평균 검색 시간이 더 짧게 나타났다. 현 검색 환경에 FRBR 기반 시스템을 적용시키기 위해서는 우선 서지적 연관성이 높은 분야에 활용될 수 있으며 이러한 분야에 적용될 때 OPAC 시스템을 대체하기보다는 이를 보완하면서 FRBR 시스템의 특성을 살려 질의 유형이 표현형인 경우 또는 높은 재현율을 요하는 경우 특히 효율적으로 적용될 수 있음을 제안하였다.

  • PDF

시선추적-뇌파 기반의 비디오 요약 생성 방안 연구 (Video Summarization Using Eye Tracking and Electroencephalogram (EEG) Data)

  • 김현희;김용호
    • 한국문헌정보학회지
    • /
    • 제56권1호
    • /
    • pp.95-117
    • /
    • 2022
  • 본 연구는 시선 및 뇌파 정보를 이용하여 오디오-비주얼(audio-visual, AV) 시맨틱스 기반의 동영상 요약 방법들을 개발하고 평가해 보았다. 이를 위해서 27명의 대학생들을 대상으로 시선추적과 뇌파 실험을 수행하였다. 평가 결과, 뇌파와 동공크기 데이터를 함께 사용한 방법의 평균 재현율(0.73)이 뇌파 또는 동공크기 데이터만을 사용한 방법의 평균 재현율(뇌파: 0.50, 동공크기: 0.68)보다 높게 나타났다. 또한 AV 시맨틱스 기반의 개인화된 동영상 요약의 평균 재현율(0.57)이 AV 시맨틱스 기반의 일반적인 동영상 요약의 평균 재현율(0.69)보다 낮게 나타난 원인들을 분석하였다. 끝으로, AV 시맨틱스 기반 동영상 요약 방법과 텍스트 시맨틱스 기반 동영상 요약 방법 간의 차이 및 특성도 비교분석해 보았다.

탐색목적이 탐색형태에 미치는 영향에 관한 연구 (The Effect of the Search Goal Requirements on Online Searching Behavior)

  • 유재옥
    • 정보관리학회지
    • /
    • 제13권1호
    • /
    • pp.65-82
    • /
    • 1996
  • 본 연구는 탐색자들이 탐색을 수행하는 과정에서 탐색질문에 내재하고 있는 탐색목적을 탐색과정에 반영하려고 노력하는지를 파악하고자 하였다. 54명 탐색자들을 선정하여 탐색질문을 제시하되 탐색목적을 정확률을 높이는 탐색과 재현율을 높이는 탐색으로 구분하여 두번 탐색하도록 요청하였다. 비록 동일한 탐색질문이라 할지라도 탐색목적이 다른 경우, 탐색자들은 탐색목적을 충족시키기 위해 노력하는지를 탐색자들이 투입하는 탐색노력 변수와 탐색결과 변수로 살펴보았다. DIALOG 정보 검색 시스템을 통해 ERIC ONTAP화일을 탐색한 결과 탐색자들은 정확률을 높이는 탐색과 재현율을 높이는 탐색에서 의미있게 재현율과 정확률로 측정했을 때 탐색자들은 두 종류의 탐색성취 요구수준을 의미있게 달성한 것으로 나타났다.

  • PDF

질의 응답 시스템을 위한 가변 길이 단락 검색 (Variable Length Passage Retrieval for Q&A System)

  • 이영신;황영숙;임해창
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2002년도 제14회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.259-266
    • /
    • 2002
  • 질의 응답 시스템에서 보다 정확하게 정답을 판별하기 위해서는 구문분석 혹은 의미분석 등과 같은 복잡도가 높은 분석작업이 요구되며, 이러한 질의 응답 시스템 성능의 상한을 결정하는 검색 시스템은 가급적 적은 양의 검색 결과를 내주어서 질의 응답 시스템이 처리해야 할 작업량에 대한 부담을 덜어주어야 한다. 본 논문에서는 이러한 요구를 만족시키는 검색 시스템으로 가변 길이 단락 검색 시스템(variable length passage retrieval system)을 제안한다. 제안하는 검색 시스템은 질의에 대한 정답을 포함하고 있을 가능성이 있는 텍스트 영역은 질의에 따라 그 크기가 다를 것이라는 가정으로부터 출발한다. 그러므로 문서 전체를 검색하거나 고정 길이 단락으로 나누어져 색인되어 있는 부분 문서들을 검색하는 기존의 검색 방법과 달리, 제안된 시스템은 문서에서 임의의 길이로 이루어진 단락을 대상으로 동적인 단락 검객을 수행한다. TREC QA track의 질의집합 중 1번부터 100번까지의 질의에 대해 실험을 수행한 견과, 문서 검색 시스템이나 고정 길이 단락 검색 시스템은 상위 1000개의 문장까지 검색을 하였을 때 각각 96%, 98%의 재현율을 보인 반면, 가변 길이 단락 검색 시스템은 800개의 문장만으로도 98%의 재현율을 보이고, 900개의 문장을 검색하였을 경우 100%의 재현율을 보였다.

  • PDF

The Ecology of the Scientific Literature and Information Retrieval (I)

  • Jeong, Jun-Min
    • 정보관리학회지
    • /
    • 제2권2호
    • /
    • pp.3-37
    • /
    • 1985
  • 본 논문은 좀 더 효율적이고 효과적인 정보 시스팀을 개발하고자 다음 두가지 가설을 제시하였다. 1) 인용 문헌 분석을 통하여 인용빈도가 높고 시간의 흐름에 따른 인용율이 증가하는 문헌은 그 문헌적 가치가 상대적으로 높다(Quality Filtering). 2) 정보 검색에 있어서 확률이론을 통한 문헌간의 상관관계를 규명짓는 클러스터링 기법이 재현율과 정확율을 모두 증가시킬 수 있다(Clustering Technique). 실제로 고프만(Goffman)의 전염성 이론의 미시적 응용(Micro-epidemic process) 데이터 베이스 내에서의 문헌의 질적 여과(Quality Filtering)를 위한 한 기법으로서 좋은 결과를 얻어냈으며 많은 정보를 이런 식으로 여과시킴으로써 정보 검색 시스팀의 효율성 또한 높일 수 있었다. 한편, 질적 여과를 거친 소규모 데이터 베이스 내에서 클러스터링 기법에 의한 정보 검색 효율은 수학의 커널 기법(Kernel Technique)의 활용으로 높은 재현율과 정확율을 나타냈을 뿐만 아니라 검색의 폭에 있어서도 많은 융통성을 제시하여 주었다.

  • PDF

The Ecology of the Scientific Literature and Information Retrieval (II)

  • Jeong, Jun-Min
    • 정보관리학회지
    • /
    • 제3권1호
    • /
    • pp.3-16
    • /
    • 1986
  • 본 논문은 좀 더 효율적이고 효과적인 정보 시스팀을 개발하고자 다음 두가지 가설을 제시하였다. 1) 인용 문헌 분석을 통하여 인용빈도가 높고 시간의 흐름에 따른 인용율이 증가하는 문헌은 그 문헌적 가치가 상대적으로 높다(Quality Filtering). 2) 정보 검색에 있어서 확률이론을 통한 문헌간의 상관관계를 규명짓는 클러스터링 기법이 재현율과 정확율을 모두 증가시킬 수 있다(Clustering Technique). 실제로 고프만(Goffman)의 전염성 이론의 미시적 웅용(Micro-epidemic process)은 데이타 베이스 내에서의 문헌의 질적 여과(Quality Filtering)을 위한 한 기법으로서 좋은 경과를 얻어냈으며 많은 정보를 이런 식으로 여과시킴으로써 정보 검색 시스팀의 효율성 또한 높일 수 있었다. 한편, 질적 여과를 거친 소규모 데이터 베이스 내에서 클러스터링 기법에 의한 정보 검색 효율은 수학의 커널 기법(Kernel Technique)의 활용으로 높은 재현율과 정확율을 나타냈을 뿐만 아니라 검색의 폭에 있어서도 많은 융통성을 제시하여 주었다.

  • PDF

하이퍼링크를 이용한 그래프 기반의 웹 문서 클러스터링 (Web Document Clustering based on Graph using Hyperlinks)

  • 이준;강진범;최중민
    • 한국HCI학회:학술대회논문집
    • /
    • 한국HCI학회 2009년도 학술대회
    • /
    • pp.590-595
    • /
    • 2009
  • 인터넷 상의 웹 문서의 수가 기하급수적으로 늘어남에 따라서, 정보검색에서의 웹 문서 클러스터링은 성능과 속도가 매우 중요하게 되었다. 웹 문서 클러스터링은 의미적으로 관계가 있는 웹 문서들을 같은 클러스터로 군집함으로써 정보 검색을 보다 빠르고, 정보를 정확하게 제공할 수 있다. 그물망 그래프 형태의 클러스터링은 모든 문서간의 유사도를 측정함으로써 재현율을 높일 수 있지만, 높은 계산 비용을 갖는다. 본 논문에서는 그물망 형태의 클러스터링의 재현율과 정확율을 유지하며 계산 비용을 줄이기 위하여, 웹 문서의 구조적 특징인 하이퍼링크(Hyperlinks)를 이용한 클러스터링 방법을 제안한다.

  • PDF