통합 검색 | Korea Science

질의어 확장에 기반을 둔 클러스터링 및 필터링 문서의 검색효율 제고에 관한 연구 (A Study on the Improvement of Retrieval Effectiveness to Clustered and Filtered Document through Query Expansion)

노동조
- 한국비블리아학회지
- /
- 제14권1호
- /
- pp.219-230
- /
- 2003
인터넷을 비롯한 대다수의 정보검색에서 사용자가 느끼는 공통된 어려움중의 하나는 검색결과가 너무 많다는 것이다. 본 연구는 검색결과를 줄이는 방법의 하나로써 검색 문헌에 대한 정제 방법에 대하여 논의한 것이다. 궁극적으로 종전의 검색시스템에서 제대로 고려하지 않은 개념망을 통한 질의어 확장과 확장 질의어와 전처리된 문서와의 유사도 측정을 통한 문서의 선택, 백과사전 정보에 의한 의미 확장과 클러스터링, 필터링 기법 등이 정보검색의 효율을 향상시키는데 효과적인 방안임을 제안한다.
PDF

구글 검색연산자 활용성 향상을 위한 기능성 Web/App 프로그램 개발 (Development of Functional Web/App Program for Improving Google Search Operator Utilization)

윤경섭;최진혁
- 한국컴퓨터정보학회:학술대회논문집
- /
- 한국컴퓨터정보학회 2020년도 제61차 동계학술대회논문집 28권1호
- /
- pp.181-184
- /
- 2020
사용자들은 필요한 자료 검색을 위해서 다양한 포털 사이트를 활용하고 있으며, 현재 구글을 이용한 활용이 증가하고 있다. 그러나 일반적으로 필터링을 위하여 사용자들은 구글에서 제공 되는 검색 연산자의 활용에 어려움을 격고 있다. 검색 연산자를 활용하여 검색의 효율성을 극대화 시켜 불필요한 검색 결과를 필터링하고 원하는 검색 결과를 획득 할 수 있는 효율적인 검색연산자의 사용 방법의 필요성이 제기 된다. 본 논문에서는 이러한 문제를 해결하고자 크롬의 확장 프로그램기능을 이용해서 일반인들이 크롬 환경에서 편히 검색 연산자들을 통해서 검색 결과를 필터링 할 수 있는 크롬 확장 프로그램을 Web/App으로 개발 하였다.
PDF

문서필터링을 위한 질의어 확장과 가중치 부여 기법 (Query Expansion and Term Weighting Method for Document Filtering)

신승은;강유환;오효정;장명길;박상규;이재성;서영훈
- 정보처리학회논문지B
- /
- 제10B권7호
- /
- pp.743-750
- /
- 2003
본 논문에서는 문서 필터링을 위한 질의어 확장과 가중치 부여 기법을 제안한다. 문서 필터링은 웹 검색 엔진들에 대한 검색 결과의 정확률 향상을 목적으로 한다. 문서 필터링을 위한 질의어 확장은 개념망, 백과사전, 유사도 상위 10% 문서를 이용하며, 각각의 확장 질의어에 가중치를 부쳐하여 질의어와 문서들간의 유사도를 계산한다. 첫 번째 단계에서 개념망과 백과사전을 이용하여 초기 질의어에 대한 1차 확장 질의어를 생성하고, 1차 확장 질의엉 가중치를 부여하여 질의어와 문서들간의 유사도를 계산한다. 다음 단계에서는 높은 유사도를 갖는 상위 10% 문서들을 이용하여 2타 확장 질의어를 생성하고, 2차 확장 질의어에 가중치를 부쳐하여 질의어와 문서들간의 유사도를 계산한다. 다음으로 1차 유사도와 2차 유사도를 결합하여 문서들을 재순위화하고, 임계치보다 낮은 유사도를 갖는 문서들을 필터링함으로써 웹 검색 엔진들의 검색 결과 정확률을 향상시킨다. 실험에서 이러한 문서 필터링을 위한 질의어 확장과 가중치 부여 기법은 정확률-재현율과 F-measure를 이용하여 성능 평가를 할 때 정보 검색 효율성에서 주목할 만한 성능 향상을 보였다.
https://doi.org/10.3745/KIPSTB.2003.10B.7.743 인용 PDF KSCI

중첩 클러스터를 이용한 피드백 문서의 재샘플링 기법 (Resampling Feedback Documents Using Overlapping Clusters)

이경순
- 정보처리학회논문지B
- /
- 제16B권3호
- /
- pp.247-256
- /
- 2009
대부분의 잠정적 적합피드백기법들은 질의에 대해 검색된 상위검색문서들이 적합하다고 가정하고, 그 문서들을 질의 확장을 위한 피드백 문서로 이용하고 있다. 그러나 초기검색결과에는 상당한 양의 부적합 문서를 포함하고 있는 것이 현실이다. 이 논문에서는 보다 좋은 피드백 문서를 선택하기 위해서 중첩클러스터를 이용한 피드백문서의 재샘플링 기법을 제안한다. 주요 아이디어는 질의 중심적인 초기검색문서집합에 대해서 중첩이 허용된 문서클러스터를 이용하여 문서들 사이의 관계를 반영하여 질의에 핵심역할을 하는 지배적 문서를 찾고, 이 문서들을 반복적으로 피드백 하여 질의가 내포하는 핵심 주제를 강조하는 것이다. 대규모 실험집합인 TREC GOV2와 WT10g에 대한 실험비교에서, 최근 잠정적 적합피드백 기법들 중에서 가장 좋은 성능을 보이고 있는 적합모델보다 재샘플링기법이 우수한 성능향상을 보였다. 제안기법에 대한 검증을 위해서 피드백문서에 포함된 적합문서의 정도를 나타내는 적합밀도를 측정하였다. 재샘플링 기법이 TREC 실험집합에 대해서 적합모델에 비해 높은 적합밀도를 보였고, 이 결과 적합피드백에서 검색성능을 향상시키게 되었다. 이는 제안 기법이 잠정적 적합피드백에서 유효한 방법임을 알 수 있다.
https://doi.org/10.3745/KIPSTB.2009.16-B.3.247 인용 PDF KSCI

메타데이터 기반 시맨틱 검색 (Semantic Search based on Metadata)

최정화;박영택
- 한국정보과학회:학술대회논문집
- /
- 한국정보과학회 2005년도 가을 학술발표논문집 Vol.32 No.2 (2)
- /
- pp.694-696
- /
- 2005
본 논문은 `시맨틱 검색`을 위해서 시맨틱 웹 기술을 사용하여 사용자가 원하는 콘텐츠 제공을 위한 시맨틱 검색 방법을 제안한다. 본 연구는 현재 웹의 단점인 사람 위주의 웹 구성, 단순 텍스트 매칭 기반의 검색, 사람의 필터링이 필요한 대량의 결과, 특정 지식 검색이 불가능한 구조의 웹을 시맨틱 검색이 가능하도록 하기 위해서 다음과 같은 단계로 연구한다. 첫째, 도메인에 따른 정확한 정보의 제공을 위해서 OWL 온톨로지를 이용하여 컨텍스트 모델링한다. 둘째, 도메인 관련 웹 문서를 수집하고 도메인 온톨로지를 기반으로 키워드의 의미를 분석하고 주석 처리(annotation)한다. 셋째, 사용자의 자연어 질의에 의미있는 컨텍스트를 추가하여 질의를 확장한다. 넷째, 확장된 질의를 규칙기반 추론엔진을 이용하여 결과를 추론한다. 마지막으로, 사용자 프로파일 분석을 이용하여 선호하는 문서를 우선으로 추천하는 방법을 연구한다. 따라서 본 연구는 질의어에 해당하는 결과문서가 존재하지 않더라도 사용자가 선호하는 문서의 추론이 가능하고, 특정 도메인의 전문가 지식을 추가한 메타 데이터 추론을 통해서 검색 패러다임을 변화시킨다.
PDF

전자상거래를 위한 확장된 디지털 카탈로그 및 질의 모델 제안 (Extended Electronic Catalog for dynamic and flexible Electronic Commerce)

정지혜;이상구;우치수
- 한국정보과학회:학술대회논문집
- /
- 한국정보과학회 1999년도 가을 학술발표논문집 Vol.26 No.2 (1)
- /
- pp.120-122
- /
- 1999
World Wide Web은 하이퍼미디어라는 뛰어난 사용자 인터페이스 기능을 제공함으로써 인터넷을 대중화 시켰고, 전자상거래라는 인터넷의 상업화도 가능하게 되었다. 이와 같은 전자상거래에서 필수적인 기술 중의 하나는 사용자가 원하는 상품의 카탈로그를 쉽고 빠르게 찾는 것이다. 본 논문의 목적은 전자 카탈로그를 정의하고 질의하는 모델을 제안하여 전자 카탈로그 시스템을 보다 쉽게 구축하고 유지하며 사용자의 요구사항을 만족하는 상품에 대한 카탈로그를 보다 쉽게 검색할 수 있는 방법을 제공하는 것이다. 본 모델의 주된 아이디어는 상품에 대한 정보를 표현하는 기존의 카탈로그와 계층적 검색을 위해 존재하는 분류체계를 통합하여 하나의 객체로 정의하고 그 객체에 대한 질의 언어를 정의함으로써 기존의 카탈로그에 대한 개념을 확장하여 전자 카탈로그 시스템 전반에 관한 검색을 용이하도록 하는 것이다. 확장된 카탈로그는 하나의 객체로 정의되기 때문에 질의에 의해 전체를 필터링해서 일부분만을 보여주거나, 사용자가 원하는 형태로 재구성하는 것이 가능하게 된다. 이를 위해 본 모델에서는 상품에 대한 정보를 그래프 형태로 정의하고 그들을 계층적으로 분류하는 분류 체계에 대해서 설명한다. 그리고 확장된 카탈로그를 각 상품과 카테고리를 노드로 한 그래프 형태로 정의하고 그에 대한 질의어를 제안한다.
PDF

Answer set 자동 구축을 위한 문서 필터링 (Document filtering for automatic construct ion of Answer Set)

정용교;신승은;오효정;장명길;서영훈
- 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
- /
- 한국정보과학회언어공학연구회 2002년도 제14회 한글 및 한국어 정보처리 학술대회
- /
- pp.253-258
- /
- 2002
본 논문은 의미기반 정보검색 소프트웨어 기술에서 정답 문서 자동 구축을 위한 문서 필터링기법을 제안한다. 문서 필터링은 1차 질의어와 문서간의 유사도와 2차 질의어와 문서간의 유사도를 이용하여 이루어지며, 1차 질의어와 문서간의 유사도를 구하기 위하여 개념 망과 백과사전 정보를 이용한 1차 질의어 확장 과정을 수행하고, 화장된 질의어와 문서와의 유사도를 계산한다. 1차 확장 질의어를 이용해 얻어진 결과 중 유사도가 상위 10%에 속하는 문서를 이용하여 2차 질의어 확장을 한다. 2차 질의어 확장은 상위 10% 문서에 출현하는 명사중 문서 출현 빈도가 임계치 이상인 명사를 선택하여 이루어지고, 그것을 이용하여 문서의 유사도를 계산한다. 이렇게 얻어진 두 가지의 유사도를 결합하여 문서들을 순위화하고 Accept Point를 이용하여 문서를 필터링한다.
PDF

지식모니터링시스템에서 감성기준을 고려한 EFASIT 모델 (An EFASIT model considering the emotion criteria in Knowledge Monitoring System)

류경현;피수영
- 인터넷정보학회논문지
- /
- 제12권4호
- /
- pp.107-117
- /
- 2011
웹의 등장은 전통적인 정보검색을 비롯하여 지식관리와 일반 상거래 등 사회 전 분야의 급격한 변혁을 초래하였다. 그러나 검색엔진은 일반적으로 관련된 계산함수에 의해 순서화된 URL의 방대한 목록을 제공하지만, 관련 없는 정보의 필터링이나 사용자가 필요로 하는 정보의 검색에 많은 시간이 소요된다. 본 논문에서는 웹상의 효율적인 문서검색을 위해서 영역 코퍼스 정보를 바탕으로 확장된 퍼지 계층화 의사결정법(Extended Fuzzy AHP Method : EFAM)과 유사도 기법(SImilarity Technology : SIT)을 결합하고, 감성기준을 고려한 EFASIT(Extended Fuzzy AHP and SImilarity Technology)모델을 제안한다. 제안한 감성기준을 고려한 EFASIT 모델은 다양한 의사결정자들의 퍼지지식의 통합으로 좀 더 명확한 규칙을 생성할 수 있고 의사결정을 하는데 도움을 준다는 것을 실험을 통하여 확인한다.
PDF KSCI

효율적인 자원 탐색을 위한 울트라 피어 기반 DHT 기법 (Ultrapeer-based DHT Scheme for Efficient Resources Search)

이지선;노선식;이동은
- 한국정보통신학회:학술대회논문집
- /
- 한국해양정보통신학회 2007년도 추계종합학술대회
- /
- pp.497-500
- /
- 2007
본 논문에서는 p2p 환경에서 울트라피어 기반의 DHT 링을 구성하고 울트라피어에서는 리프피어들이 검색했던 문서들의 메타데이터를 관리함으로써 효율적인 자원검색기법을 제안한다. 울트라피어 기반의 DHT링은 피어들의 참가와 탈퇴가 빈번하게 이루어져서 발생하는 확장성의 문제를 극복하고 울트라 피어가 관리하는 이 메타데이터를 이용하여 자원을 보다 효과적으로 검색할 수 있다.
PDF

온톨로지 기반 DTD 필터링 및 정합에 의한 XML 질의 시스템 (Ontology based XML Query System by DTD Filtering and Matching)

김명숙;노영주;공용해
- 한국정보처리학회:학술대회논문집
- /
- 한국정보처리학회 2005년도 춘계학술발표대회
- /
- pp.557-560
- /
- 2005
XML 문서의 논리적인 구조와 의미적 태그의 사용은 구조와 내용에 기반 한 검색을 가능하게 하는 반면, 동일한 정보라 하더라도 구조와 형식이 매우 다양하게 표현되므로 정보검색에 어려움을 초래한다. 효율적인 XML 정보검색을 위해, 본 논문은 온톨로지를 기반으로 검색에 적합한 문서만을 선별하는 문서여과 방법, 대상문서에 적합한 최소한의 질의생성을 위한 온톨로지 정합 방법 그리고 문서에 내재된 의미적 정보의 검색을 위한 정합된 온톨로지 기반의 질의확장 방법을 각각 제안하였다. 제안한 방법의 효과 및 효율은 예제 XML 및 DTD 문서를 대상으로 실험되었다.
PDF

검색결과 50건 처리시간 0.028초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)