• 제목/요약/키워드: 검색 순위화

검색결과 123건 처리시간 0.028초

구조와 내용 유사도에 기반한 XML 웹 문서 검색시스템 구축 (An Implementation of XML document searching system based on Structure and Semantics Similarity)

  • 박우창;서여진
    • 인터넷정보학회논문지
    • /
    • 제6권2호
    • /
    • pp.99-115
    • /
    • 2005
  • XML은 인터넷상에서 데이터 표현과 변환을 위한 표준이며, 이러한 XML 문서에서 필요한 정보를 찾아내기 위해 XML 문서 검색 시스템이 필요하다. 본 연구는 이러한 필요성에 기반을 두어 XML 구조를 최대한 활용하여, 주어진 XML 문서에 대해 구조와 내용이 가장 가까운 문서들을 찾아내는 검색 시스템을 개발하였다. 검색 메트릭은 XML 문서들 중 각 태그의 이름에 대한 유사도, 각 태그가 포함하는 값의 유사도와 태그 간 구조에 대한 유사도를 모두 고려하며, 검색 후 유사도의 결과 값에 따라 검색 결과를 순위화 하여 보여준다. 검색 방법은 전통적인 키워드 검색 방식, 태그와 값을 입력하여 검색할 수 있는 방식, XML 문서를 입력하여 검색하는 세 가지 질의 방식을 제공함으로서 사용자들의 기호에 따라 원하는 방식을 골라 검색할 수 있도록 구성하여 시스템의 유용성을 높였다. 개발된 XML 문서 검색 시스템은 INEX에서 제공된 XML 문서들을 대상으로 하여 테스트하였다.

  • PDF

개인화된 비디오 요약 서비스를 위한 비디오 스플리터 (Video Splitter for Personalized Video Summary Services)

  • 김원철;황인준
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 가을 학술발표논문집 Vol.29 No.2 (3)
    • /
    • pp.541-543
    • /
    • 2002
  • 멀티미디어 관련 기술이 발전하고 인터넷 사용이 보편화되면서 모바일 단말기 상에서 비디오 데이터를 검색하려는 요구가 증가하고 있다. 그러나 모바일 단말기의 경우 낮은CPU 처리율이나 대역폭, 배터리 용량 등의 제약으로 인해 비디오를 그대로 검색하기에는 어려움이 많다. 최근 들어 비디오 데이터의 요약을 통해 모바일 환경의 제약점을 극복하고 효율적으로 비디오를 검색하기 위한 연구가 활발히 진행되고 있다. 본 논문에서는 기존의 단편적인 비디오 데이터 요약 기술에서 벗어나 요약된 비디오 데이터에 특징이나 중요도를 MPEG-7을 이용해서 주석 처리하여 사용자에게 보다 효과적인 검색 환경을 제공하고자 한다. 이러한 요약 방법은 모바일 환경에서 사용자의 우선 순위나 요구하는 특징에 적합한 동영상을 볼 수 있고 비디오의 전송시 모바일 장비의 성능에 따라 차별적으로 요약 정보를 제공함으로써 모바일 환경의 제약을 상당히 완화시킨다.

  • PDF

개념 네트워크 기반 사용자 인지형 웹 검색 시스템 (Concept Network-based Personalized Web Search Systems)

  • 윤홍준;노준호;김한준;이병정;강수용;장재영
    • 인터넷정보학회논문지
    • /
    • 제12권2호
    • /
    • pp.63-73
    • /
    • 2011
  • 일반적으로 기존 검색엔진은 다수 사용자의 동일한 질의에 대하여 일률적으로 같은 검색 결과를 제공하는데, 이는 사용자 개인의 특성을 고려하지 않는 단점을 가진다. 이를 극복하기 위해서 사용자가 가지고 있는 검색 의도를 파악하여 그에 부합하는 결과를 제공하는 개인화 검색이 필요하다. 본 논문에서는 사용자 프로파일 기반 개인화 검색을 위한 시스템을 제안한다. 본 시스템에서는 개인화 검색을 이루기 위해 개념 네트워크 형태의 사용자 프로파일을 구성하며, 이는 사용자가 과거에 질의했던 질의어와 탐색했던 웹문서를 분석하여 자동 생성된다. 그리고 사용자가 웹문서에 대해 태그를 지정한 폭소노미 데이터를 이용하여, 개념 네트워크를 확장함으로써 개념 네트워크의 정확성을 더욱 높일 수 있다. 이 개념 네트워크를 이용하여 사용자가 부여한 질의어를 확장시킬 수 있을 뿐만 아니라, 검색결과의 중첩도를 고려하여 사용자별 검색 결과의 순위를 재산정 함으로써 개인의 특성을 반영한 검색 결과를 제공할 수 있다.

단어 의미 표현과 질병 중심 의학 문서 클러스터 기반 의학 문서 검색 기법 (Method of Document Retrieval Using Word Embeddings and Disease-Centered Document Clusters)

  • 조승현;이경순
    • 한국어정보학회:학술대회논문집
    • /
    • 한국어정보학회 2016년도 제28회 한글및한국어정보처리학술대회
    • /
    • pp.51-55
    • /
    • 2016
  • 본 논문에서는 임상 의사 결정 지원을 위한 UMLS와 위키피디아를 이용하여 지식 정보를 추출하고 질병중심 문서 클러스터와 단어 의미 표현을 이용하여 질의 확장 및 문서를 재순위화하는 방법을 제안한다. 질의로는 해당 환자가 겪고 있는 증상들이 주어진다. UMLS와 위키피디아를 사용하여 병명과 병과 관련된 증상, 검사 방법, 치료 방법 정보를 추출하고 의학 인과 관계를 구축한다. 또한, 위키피디아에 나타나는 의학 용어들에 대하여 단어의 효율적인 의미 추정 기법을 이용하여 질병 어휘의 의미 표현 벡터를 구축하고 임상 인과 관계를 이용하여 질병 중심 문서 클러스터를 구축한다. 추출한 의학 정보를 이용하여 질의와 관련된 병명을 추출한다. 이후 질의와 관련된 병명과 단어 의미 표현을 이용하여 확장 질의를 선택한다. 또한, 질병 중심 문서 클러스터를 이용하여 문서 재순위화를 진행한다. 제안 방법의 유효성을 검증하기 위해 TREC Clinical Decision Support(CDS) 2014, 2015 테스트 컬렉션에 대해 비교 평가한다.

  • PDF

계층적 검색 의도와 웹 자원을 활용한 2계층 구조의 서브토픽 마이닝 (Subtopic Mining of Two-level Hierarchy Based on Hierarchical Search Intentions and Web Resources)

  • 김세종;이종혁
    • 정보과학회 컴퓨팅의 실제 논문지
    • /
    • 제22권2호
    • /
    • pp.83-88
    • /
    • 2016
  • 서브토픽 마이닝은 입력 질의에서 나타날 수 있는 검색 의도들의 중의성 해소 및 보다 명확한 의도 전달을 위해 관련 서브토픽들을 연관성, 선호도, 다양성을 고려하여 추출 및 순위화하는 것을 말한다. 본 논문은 웹 자원의 활용에 대한 기존 연구의 한계점을 명시하고, 이를 극복하기 위해 계층적 검색 의도와 웹 자원을 기반으로 한 2계층 구조의 서브토픽 마이닝 방법론을 제안한다. 우리는 서브토픽 마이닝 평가 대회에서 제공한 웹 문서 및 각 자원의 특성을 고려하여 제 2계층 서브토픽들을 추출, 확장 및 재순위화하고, 넓은 검색 의도를 가진 서브토픽 내의 단어들은 제 1계층 서브토픽들을 구성하는데 활용하였다. 본 방법론은 관련 평가 대회에서 최고 성능을 보인 기존 연구들의 결과들과 비교했을 때, 대부분의 평가 척도에서 높은 성능을 보였다.

실시간 검색어 연관 분석을 통한 핵심 이슈 선정 (Selecting a key issue through association analysis of realtime search words)

  • 정민영
    • 디지털융복합연구
    • /
    • 제13권12호
    • /
    • pp.161-169
    • /
    • 2015
  • 포털 사이트의 실시간 검색어는 현재 관심이 급상승하고 있는 이슈를 보여주기 위해 주로 검색횟수가 많은 순서에 따라 몇 초 간격으로 제공되고 있다. 그렇지만 너무 짧은 시간 내에 순위가 바뀌는 실시간 검색어의 특성 때문에 하루의 핵심 이슈를 비켜가는 문제가 발생한다. 본 논문에서 이러한 문제를 보완하기 위해 검색어들 사이의 연관 분석을 통하여 검색어들이 관련된 핵심 이슈를 도출하는 방법을 제안하고자 한다. 이를 위해 먼저 실시간 검색어를 순위와 상대적 관심도를 기반으로 점수화하여 집단별 기술통계를 통해 최상위 10개의 검색어를 도출한다. 그 다음으로 지지도와 신뢰도를 기반으로 연관 규칙을 추출하고 이를 가시화하는 그래프 결과를 바탕으로 핵심 이슈를 선정한다. 실험 결과는 단일 최상위 실시간 검색어보다 연관분석을 통해 높은 점수로 선정된 핵심 이슈가 더 큰 의미를 갖는다는 것을 보여준다.

질의기반 사용자 프로파일을 이용하는 개인화 웹 검색 (Personalized Web Search using Query based User Profile)

  • 윤성희
    • 한국산학기술학회논문지
    • /
    • 제17권2호
    • /
    • pp.690-696
    • /
    • 2016
  • 사용자 입력 질의와 웹 문서에 포함된 단어들의 형태적 일치를 검사하여 관련 문서를 검색하는 검색엔진은 사용자의 개인별 관심 분야를 반영하는 검색 결과를 생성하기 어렵다. 본 논문에서는 개인별 관심사를 파악하여 질의 의도에 적합한 내용의 문서를 검색하는 개인화된 웹 검색 방법을 제안한다. 개인화 검색의 성능은 사용자의 개인적 관심사를 정확하게 표현하는 우수한 사용자 프로파일을 생성하는 전략에 좌우된다. 본 연구에서 개인 프로파일은 사용자가 최근 입력한 질의어들과 검색에서 클릭했던 문서들에 나타나는 주제어들이 출현 빈도를 반영한 가중치와 함께 등록된 데이터베이스이다. 특히 중의적 질의어의 정확한 의미를 결정하기 위해 워드넷을 기반으로 프로파일에 등록된 단어들과 의미 유사도를 계산한다. 기존 웹 검색 시스템의 사용자 측에 질의확장 모듈과 순위재계산 모듈을 추가하는 확장모듈을 구축하여 비교 실험하였으며, 본 연구의 방법을 적용한 개인화 웹 검색의 결과는 특히 10위 이내 상위의 결과 문서들에 대해 92%의 정확률과 82%의 재현율을 보여 향상된 성능을 검증하였다.

한국어-영어/일본어-영어 교차언어정보검색에서 클러스터 분석을 통한 성능 향상 (Performance Improvement by Cluster Analysis in Korean-English and Japanese-English Cross-Language Information Retrieval)

  • 이경순
    • 정보처리학회논문지B
    • /
    • 제11B권2호
    • /
    • pp.233-240
    • /
    • 2004
  • 본 논문에서는 교차언어정보검색에서 점진적 클러스터링을 통해서 모호성을 묵시적으로 해소하는 방법을 제안한다. 연구 목적은 질의 번역에서 모호성이 크게 증가된 상태에서 문서 클러스터가 문서 문맥 역할과 모호성 해소 역할을 하는지를 보고자 하는 것이다. 제안하는 방법은 한국어/일본어 질의를 사전을 이용하여 영어로 번역을 하고, 번역된 영어 질의에 대해서 벡터공간검색모델이나 확률검색모델에 의해서 문서를 검색한다 검색된 문서의 순위대로 점진적 클러스터를 동적으로 생성하고, 이 클러스터 정보를 질의에 반영해서 문서의 순위를 다시 결정하는 것이다. TREC 테스트컬렉션을 이용한 실험에서 모호성 해소를 하지 않은 질의에 대해서, 제안한 방법은 한국어-영어 교차언어정보검색에서는 벡터공간검색모델에서 39.41%의 성능향상, 확률검색모델에서 36.79%의 성능향상을 보였다. 일-영 교차언어정보검색에서는 각각 17.59%와 30.46%의 성능향상을 보였다. 적합성 피드백 방법과의 비교에서는 모호성 해소를 하지 않은 경우 확률검색모델에서 12.30%의 성능향상을 보였다. 이를 통해, 클러스터 분석은 질의 모호성 해소에 도움을 주어서 검색성능 향상에 기여하였음을 알 수 있다.

퍼지관계곱 기반 퍼지정보검색시스템 구현 (Implementation of Fuzzy Information Retrieval System Based on Fuzzy Relational Products)

  • 김창민;김용기
    • 정보처리학회논문지B
    • /
    • 제8B권2호
    • /
    • pp.115-122
    • /
    • 2001
  • 퍼지관계 개념에 기반한 BK-FIRM(Bandler-Kohout 퍼지정보검색기법)은 형태론에 입각한 기존의 정보검색기법과는 달리 문서와 용어의 상대적 의미에 근거한 퍼지정보검색기법이다. BK-FIRM은 시소러스 자동 구축 기능, 검색 결과의 퍼지화된 우선 순위 제공과 같은 장점을 가지고 있다. 그러나, BK-퍼지정보검색기법은 높은 시간복잡도(time complexity)의 검색 연산을 내재하고 있어 다양한 분야 적용이 불가능하다. 본 논문에서는 축소용어집합을 이용하여 BK-FIRM의 시간복잡도를 낮춘 A-FIRM(개선된 Bandler-Kohout 퍼지정보검색모델)을 소개하고 이를 정보검색시스템으로 설계 및 구현한 A-FIRS(개선된 Bandler-Kohout 퍼지정보검색시스템)를 구현한다. A-FIRS는 크게 문서베이스와 시소러스를 구축하는 전처리부(preprocess unit)와 사용자의 검색요구를 처리하여 문서를 검색하는 실시간처리부(real-time process unit)로 나누어지며, 각 처리부는 기능적 특성에 따라 4개의 처리단계로 구성된다. A-FIRS는 WWW 기반 환경과 연동하도록 설계되었으며, WWW 환경의 사용자로부터 주어진 검색요구를 처리하여 검색결과를 제공한다.

  • PDF

도메인 온톨로지를 이용한 개인화된 개념기반 검색 기법 (A Personalized Concept-based Retrieval Technique Using Domain Ontology)

  • 문현정;이수진;김영지;우용태
    • 한국전자거래학회지
    • /
    • 제12권3호
    • /
    • pp.269-282
    • /
    • 2007
  • 본 논문에서는 도메인 온톨로지를 사용하여 개인화 된 개념 기반의 검색 기법을 제안하였다. 제안 모델은 도메인 온톨로지를 이용한 컨텐츠의 대표 개념 추출, 컨텐츠 가중치와 개념 가중치를 이용한사용자 프로파일 구성 그리고 개인화 된 개념 기반 검색 과정으로 구성된다. 컨텐츠의 대표 개념은 TScore 기법을 이용하여 추출하였고, 사용자 프로파일은 개인 정보 수집 모듈을 통해 개념 가중치가 높은 개념을 대상으로 구성하였다. 개념 기반 검색을 위해 사용자 프로파일의 개념 집합과 컨텐츠의 대표 개념 집합간에 유사도를 비교하여 개인이 선호하는 개념의 우선순위에 의해 컨텐츠를 검색하였다. 본 논문에서 제안한 기법의 효율성을 검증하기 위하여 인터넷 사이트에서 컨텐츠를수집하고사용자프로파일을구성하여 실험하였다. 실험 결과, 제안한 검색기법이 기존의 기반의 검색 기법에 비해 우수함을 보였다. 제안된 기법은 개인화 된 추천 시스템이나 전자 도서관 등과 같은 분야에서 효율적으로 적용할 수 있으리라 기대된다.

  • PDF