• 제목/요약/키워드: 검색 성능 평가

검색결과 777건 처리시간 0.028초

한국어 정보검색연구를 위한 시험용 데이터 모음 (KTSET) 개발 (Development of the Data Collection (KTSET) for Korean Information Retrieval Studies)

  • 김재군;김영환;김성혁
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1994년도 제6회 한글 및 한국어정보처리 학술대회
    • /
    • pp.378-385
    • /
    • 1994
  • 정보검색분야의 여러 기술들을 연구하고 이 결과들을 실험 평가하기 위해서는 모든 연구자들이 공동으로 사용할 수 있는 시험용 데이터 모음(Test Data Collection)이 필요하다. 외국에서는 이미 오래전부터 각 분야별 시험용 데이터 모음들을 준비하여 검색시스팀의 개발 및 객관적인 성능평가에 이용하여 왔는데 국내에서는 아직까지 이러한 시험용 데이터 모음이 개발되지 못한 실정이다. 본 연구는 한국어 정보검색 기술연구 활성화에 기여하기 위하여 한국어정보검색 기술 연구결과의 성능평가에 공동으로 활용할 수 있는 국내 최초의 시험용 데이터 모음인 KTSET을 개발하였다. KTSET은 정보과학회와 정보관리학회지의 논문지 및 학술대회 논문집으로부터 추출된 1,053개의 논문과 이를 검색대상으로 한 50개의 자연어질의어로 구성되었으며 대상문서들과 질의어 각각에 대한 색인결과와 질의어와 대상문서들간의 적합도 정보를 제공한다.

  • PDF

질의 재구성 알고리즘의 검색성능을 측정하기 위한 새로운 평가 방법의 개발 (Development of New Retieval Performance Measures for Query Reformulation Algorithms)

  • 김남호
    • 한국정보처리학회논문지
    • /
    • 제4권4호
    • /
    • pp.963-972
    • /
    • 1997
  • 정보 검색에서 대부분의 질의 재구성 알고리즘들은 초기 입력 문서나 피드백 문을 이용 하여 질의를 재구성하므로, 질의 재구성 알고리즘의 검색 성능은 입력되는 문서들의 질 에 따라 달라진다. 본 연구에서는 질의 재구성 알고리즘의 입력 문서에 대한 성능 감도를 새로운 검색성능 평가방법을 개발하여 분석하였다. 또한 CIRA라고 불리는 새로운 평가기준을 개발하여 질의 재구성 사이의 성능 변화추이를 분석하였다. 세가지의 질의 재구성 알고리즘(질의나무 (query tree), DNF 방법, Dillon 방법)의 감도와 성능변화를 테시트 세트인 CACM, CISI, Medlars 상에서 분석하였다. 세 실험에서 질의나무가 가장 작은 CIRA를 취득했으며, 감도 분석에서는 비록 다른 알고리즘과 차이는 적으나 가장 높은감도를 나타냈다.

  • PDF

신뢰도 자질을 이용한 지식검색 문서의 품질 평가 (Quality Prediction of Knowledge Search Documents Using Text-Confidence Features)

  • 이정태;송영인;임해창
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2007년도 제19회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.62-67
    • /
    • 2007
  • 불특정 사용자의 참여에 의해 정보가 생성되는 지식검색 서비스에서는 문서의 품질이 검색 만족도에 중요한 요소 중 하나이다. 지식검색 문서의 품질 평가에 관한 기존 연구는 조회 수나 추천 수 등의 비텍스트 정보를 이용하여 문서의 품질을 평가하고, 이를 검색 모형에 반영하여 검색 성능을 높이는데 집중하였다. 이러한 비텍스트 정보는 그 유용성이 실험을 통해 증명되었지만, 새로 작성된 문서와 같은 경우 심각한 자료 부족 문제가 발생할 수 있다는 단점이 있다. 본 논문에서는 이러한 비텍스트 정보의 자료 부족 문제를 완화할 수 있는 새로운 문서 품질 평가 자질로서 문서 내용의 신뢰성을 반영하는 신뢰도 자질을 제안한다. 제안하는 자질은 문서의 내용으로부터 직접 추출되며, 따라서 추천 수나 조회 수 등 서비스 사용자의 참여나 이용을 필요로 하는 비텍스트 자질보다 자료 부족 문제에 견고하다는 장점이 있다. 또한 제안하는 신뢰도 자질은 문서 품질 평가에 유용하다고 알려진 비텍스트 자질과 유사하거나 향상된 성능을 실험에서 보였으며, 추후 자질 추출 방법을 개선한다면 효과적인 품질 평가 자질로서 기능을 할 수 있을 것으로 기대된다.

  • PDF

용어 가중치 재 산정을 이용한 검색 시스템 (Retrieval System Using Term Reweighting)

  • 황선욱;김혜정;손기준;이상조
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2003년도 가을 학술발표논문집 Vol.30 No.2 (1)
    • /
    • pp.160-162
    • /
    • 2003
  • 색인 파일은 정보 검색 시스템에서 중요한 구성 요소 중에 하나이다. 스테밍을 하여 색인 파일을 구성하게 되면 파일의 크기를 줄일 수 있고 재현율을 높이는데 효과적이다. 하지만, 과도한 스테밍으로 구성이론. 색인 파일은 원형에 대한 데이터 손실을 가지고 오기 때문에 너무 많은 문서가 검색되어 사용자가 문서를 찾는데 많은 시간이 소요되고 정확률도 떨어진다. 본 논문에서는 정보 검색 시스템에서 검색의 효율성을 높이기 위해 사용하는 색인 파일을 스테밍 한 것과 스테밍 하지 않은 파일로 구성하였다. 스테밍 한 색인 파일은 질의어와 문서 사이의 유사도를 계산하기 위하여 이용되며, 스테밍 하지 않은 파일은 스테밍 했을 때 검색된 문서들 중에서 데이터 손실로 인한 잘 못된 문서 순서를 재조정해 주기 위하여 이용된다. 본 논문에서는 높은 검색 효과를 제공하는 기존의 벡터 공간 모델을 검색 성능 평가 척도 중의 하나인 R-정확률을 이용하여 비교 평가하였다. 본 논문에서 제안하는 시스템이 문서 상위 100위까지에 대하여 일반 벡터 모델 보다 최고 21%의 좋은 성능을 보였다.

  • PDF

임의의 영역 안에 텍스처 표현을 위한 Wavelet및 Gabor 텍스처 기술자와 성능평가 (Gabor and Wavelet Texture Descriptors in Representing Textures in Arbitrary Shaped Regions)

  • 심동규
    • 한국멀티미디어학회논문지
    • /
    • 제9권3호
    • /
    • pp.287-295
    • /
    • 2006
  • 본 논문은 임의의 영역 안에 존재하는 텍스처를 검색하기 위한 wavelet과 Gabor기반 텍스처 표현 기법을 제안하고 이들의 검색성능을 평가한다. 지금까지 Gator 평면에서의 평균과 표준편차 특징 기술자가 직사각형안의 텍스처를 표현하기에 가장 적합한 것으로 알려져 있다. 하지만 임의의 영역 안의 물체를 표현하는 기술이 실제 검색이나 여러 다른 텍스처 표현 응용 예에 더욱 필요한 실정이다. 본 연구에서는 wavelet과 Gabor 필터에 기반한 특징 추출법을 제안하고 이들을 실제 텍스처 데이터 베이스에 적용해 본 결과, wavelet기반 특징 기술자가 Gator기반 기술자에 비하여 더욱 효과적임을 발견하였다. 특히 wavelet평면에서 표준편차와 엔트로피 특징을 사용함으로써 가장 좋은 검색 성능을 냄을 알 수 있었다. 또한, 본 논문에서는 다양한 실제 텍스처 영상을 가지고 wavelet과 Gator에 기반한 다양한 특징벡터에 따른 검객 성능을 평가하였다.

  • PDF

단순 조회 기능 서버 기반 P2P 시스템의 검색 성능 향상을 위한 Ptops 인덱스 서버 설계 (Design of Ptops Index Server to Advance Search­Performance of P2P with a simple discovery server System)

  • 김분희;김영찬
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2003년도 가을 학술발표논문집 Vol.30 No.2 (3)
    • /
    • pp.70-72
    • /
    • 2003
  • 기존 P2P 시스템의 성능 향상에 대한 연구가 다양한 주제로 그 해결책을 모색하고 있는 가운데, 본 논문에서는 정보에 의미성을 부여하여 검색 성능 향상을 이루는 P2P 인덱스 서버 프레임워크를 제안한다. 본 논문의 제안 기법은 검색 성능의 속도면에서 시스템 초기화 과정의 소요 시간을 감안한 비교 결과 기존 시스템에 준하는 성능을 보였으며, 해당 피어의 요구사항에 대해 신뢰성 있는 결과 데이터 리스팅의 관점에서 타 시스템과의 의미 있는 평가치를 나타내고 있다.

  • PDF

질의확장에 의한 단락검색의 성능 향상에 관한 연구 (A Study on the Improvement of Retrieval Performance Query Expansion in Passage-based Retrieval)

  • 박지연;정영미
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 2001년도 제8회 학술대회 논문집
    • /
    • pp.143-148
    • /
    • 2001
  • 본 연구에서는 공기기반 질의-용어간 유사도를 이용한 질의확장을 통해 단락검색의 성능을 향상시키는 방안을 제시하고자 하였다 실험을 통해 전체 문헌집단에 출현한 용어들의 공기정보에 기반한 전역적 질의확장과 이용자의 피드백 없이 초기검색 결과 중 상위 10개 문헌에 출현한 용어들의 공기정보에 기반한 지역적 질의확장의 성능을 비교하고 각각의 성능을 향상시키는 방법을 모색하였다. 마지막으로 문헌집단의 전역 정보와 지역 정보를 함께 이용하는 방안을 제시하고 그 성능을 평가하였다.

  • PDF

효율적인 로컬 모바일 RFID 시스템을 위한 ODS 검색 서비스 성능개선 (Object Directory Service)

  • 최성민;오정진;최한석
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2008년도 추계학술발표대회
    • /
    • pp.1031-1034
    • /
    • 2008
  • 현재 ODS(Object Directory Service) 검색 서비스는 글로벌한 모바일 RFID 환경에 적합하지만, 지역적인 로컬 네트워크 및 정보보안이 필요한 사설 네트워크에서는 불필요한 검색시간이 요구되고 효율성이 떨어지는 서비스 시스템이다. 따라서 본 논문에서는 기존의 ODS 검색 서비스 알고리즘을 개선하여 새롭게 로컬 환경에 적합한 ODS 검색 서비스 알고리즘을 제안하고, 개선된 ODS 검색 서비스 시스템의 성능평가 결과를 제시한다..

웹2.0에서 의견정보의 실시간 모니터링을 위한 웹 콘텐츠 마이닝 시스템 (Web Contents Mining System for Real-Time Monitoring of Opinion Information based on Web 2.0)

  • 김영춘;주해종;최혜길;조문택;김영백;이상용
    • 한국지능시스템학회논문지
    • /
    • 제21권1호
    • /
    • pp.68-79
    • /
    • 2011
  • 본 연구에서 제안하는 시스템은 인터넷 상에 존재하는 여러 웹사이트들에 흩어져 있는 웹 콘텐츠에서 사용자 의견 정보들을 자동 추출 및 분석함으로써, 긍정/부정 의견별로 검색 및 통계를 확인할 수 있는 의견 검색 서비스를 제공한다. 그 결과 의견 검색 사용자들은 특정 키워드에 대하여 다른 사용자들의 의견을 손쉽게 한눈에 검색 및 모니터링하는 시스템을 용이하게 사용할 수 있으며, 웹 콘텐츠에서의 의견 추출 및 분석하는 기능을 제공받는다. 제안한 기법들은 다른 기법들과의 비교 실험을 수행하여 실제 성능이 우수함을 증명하였다. 성능 평가는 긍정/부정 의견 정보를 추출하는 기능의 성능 평가, 다국어 정보 검색을 위한 동적 윈도우 기법과 토크나이저 기법을 적용한 성능 평가, 그리고 정확한 다국어 음차표기를 추출 기법에 성능 평가를 실시하였다. 그 적용 사례로 대표적인 영화 리뷰 문장과 위키디피아 실험 데이터를 대상으로 실험하고 그 결과를 분석하였다.

가중치 칼라 히스토그램을 통한 이미지 검색의 성능평가 (An Evaluation of Image Retrieval used Weighted Color Histogram)

  • 이용환;이유경;이준환;이상범;김영섭
    • 대한전자공학회:학술대회논문집
    • /
    • 대한전자공학회 2006년도 하계종합학술대회
    • /
    • pp.397-398
    • /
    • 2006
  • 본 논문에서는 이미지 검색을 위해 가장 기본적인 요소인 이미지 색상에 따른 칼라 분포정보를 이용하고 다양한 요소에 따라 가중치를 부여한 칼라기반의 검색 기술자를 제안하였고 실험적 평가를 통하여 제안 기술자의 성능을 평가하였다. 칼라 히스토그램을 통한 이미지 검색 기술자를 설계하는데 있어 칼라모델은 HSV, 웨이블릿 변환 필터는 D9/7, 웨이블릿 분해는 2 레벨을 적용하였을 때 가장 좋은 검색효율성을 보였다.

  • PDF