• 제목/요약/키워드: Web-based Retrieval

검색결과 457건 처리시간 0.028초

AN EFFICIENT DENSITY BASED ANT COLONY APPROACH ON WEB DOCUMENT CLUSTERING

  • M. REKA
    • Journal of applied mathematics & informatics
    • /
    • 제41권6호
    • /
    • pp.1327-1339
    • /
    • 2023
  • World Wide Web (WWW) use has been increasing recently due to users needing more information. Lately, there has been a growing trend in the document information available to end users through the internet. The web's document search process is essential to find relevant documents for user queries.As the number of general web pages increases, it becomes increasingly challenging for users to find records that are appropriate to their interests. However, using existing Document Information Retrieval (DIR) approaches is time-consuming for large document collections. To alleviate the problem, this novel presents Spatial Clustering Ranking Pattern (SCRP) based Density Ant Colony Information Retrieval (DACIR) for user queries based DIR. The proposed first stage is the Term Frequency Weight (TFW) technique to identify the query weightage-based frequency. Based on the weight score, they are grouped and ranked using the proposed Spatial Clustering Ranking Pattern (SCRP) technique. Finally, based on ranking, select the most relevant information retrieves the document using DACIR algorithm.The proposed method outperforms traditional information retrieval methods regarding the quality of returned objects while performing significantly better in run time.

시맨틱 웹 서비스를 위한 동영상 온톨로지 설계 (Design of video ontology for semantic web service)

  • 이영석;윤성대
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국해양정보통신학회 2009년도 춘계학술대회
    • /
    • pp.195-198
    • /
    • 2009
  • 최근에는 정보와 지식의 교환을 위한 시맨틱 웹 구축의 연구가 활발해 지고 있다. 동영상 콘텐츠를 시맨틱 웹상에서 지식으로 활용하기 위해서는 의미적 검색이 선행 되어야 하는데 현재는 동영상 콘텐츠의 메타데이터와 키워드의 일치성 판단에 의한 검색이 주를 이루고 있다. 본 논문에서는 집단 지성을 사용하여 동영상 콘텐츠의 의미적 검색 및 활용이 용이하도록 사용자 참여 정보를 확대하고, 의미적 요소인 유용성 수치와 히스토리 데이터를 추가한 온톨로지 구축 방법을 제안한다. 제안한 온톨로지 스키마를 활용하면, 시맨틱 웹상에서 동영상 콘텐츠의 의미적 검색 시 기존 검색 방법 보다 재현율이 높으며, 각종 동영상 콘텐츠를 지식으로 활용 가능하게 한다.

  • PDF

자동화된 통합 프레임워크를 위한 시맨틱 웹 기반의 정보 검색 시스템 (Semantic Web based Information Retrieval System for the automatic integration framework)

  • 최옥경;한상용
    • 정보처리학회논문지C
    • /
    • 제13C권1호
    • /
    • pp.129-136
    • /
    • 2006
  • 정보 검색 시스템은 사용자가 찾고자 하는 지식 정보를 보다 정확하고 빠르게 전달하는 데 그 목적이 있다. 그러나 현재의 검색 시스템은 단순 구문 분석 방식으로 사용자가 원하는 정확한 정보를 제공하지 못한다. 따라서 본 논문에서는 온톨로지 서버를 이용한 SW-IRS(Semantic Web based Information Retrieval System)를 제안한다. 제안한 시스템은 에이전트 기반의 자동 분류 기술과 시맨틱 점 기반의 정보 검색 기법들을 이용하여 반구조(semi-structured) 문서뿐만 아니라 비구조(unstructured) 문서의 처리를 극대화시키고자 한다. 또한 상호 운용성 및 데이터 통합을 위해 RDF(Resource Description Framework) 방식의 문서 저장 서버를 지원하며 웹 페이지들간에 검색 순위를 두어 보다 신속하고 정확한 정보 검색이 가능하도록 하고자 한다. 마지막으로 새로운 순위 측정 알고리즘을 제안하고 이를 이용한 성능 평가를 실시하여 그 효율성과 정확성을 검증해 보이고자 한다.

PC 클러스터를 이용한 실시간 분산 웹 영상 내용기반 검색 시스템에 관한 연구 (A Study on the Real-time Distributed Content-based Web Image Retrieval System using PC Cluster)

  • 이은애;하석운
    • 한국멀티미디어학회논문지
    • /
    • 제4권6호
    • /
    • pp.534-542
    • /
    • 2001
  • 최근의 내용기반 영상 검객 시스템은 한정된 수의 영상을 저장해 놓은 단일의 서버를 이용하고 있다. 이로 인해 웹 상의 다양한 영상을 원하는 웹 사용자의 요구를 만족시키지 못하고 있다. 수많은 웹 영상을 대상으로 하는 내용기반 영상 검색 시스템은 무엇보다도 실시간에 기반을 두어야 한다. 이를 구현하기 위해서는 영상 수집과 특징 추출에 걸리는 많은 소모 시간 문제가 해결되어야 한다. 최근, 고속의 데이터 처리를 목적으로 부하분산 PC클러스터가 개발되고 있다. 본 논문에서는 많은 시간을 요하는 영상 수집과 특징 추출 작업을 부하분산 PC클러스터의 종속 컴퓨터들에 분배함으로써 전체 검색 시간을 감소시켰으며, 이를 통해 실시간 웹 영상 검색의 가능성을 발견할 수 있었다.

  • PDF

Web 소프트웨어 컴포넌트 재사용을 위한 라이브러리 관리와 서비스 (Library Management and Services for Software Component Reuse on the Web)

  • 이성구
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제29권1_2호
    • /
    • pp.10-19
    • /
    • 2002
  • 사용자들은 웹브라우저를 통해 웹에 존재하는 소프트웨어 컴포넌트 라이브러리를 탐색한다. 그러나, 웹 라이브러리에 포함된 컴포넌트들의 수가 빠르게 증가하는 상황에서 우리는 이러한 라이브러리들을 효과적으로 구성하고 관리하기 위한 방법을 필요로 한다. 전통적인 웹 라이브러리 검색 시스템들은 컴포넌트들을 저장하고 검색하기 위해 다양한 분류방법을 이용한 검색 서비스를 제공한다. 이러한 전통적인 시스템들은 사용자들이 검색 초기 단계에서 라이브러리의 전체적인 내용의 이해를 바탕으로 한 다양한 검색 서비스를 준비하지 못한다. 본 논문은 전통적인 시스템들의 단순한 컴포넌트 저장과 검색이상의 다양한 서비스와 객체지향 컴포넌트들의 효율적인 관리를 제공하는 웹 라이브러리 시스템에 대해 토론한다. 이러한 서비스들은 역공학 프로세스를 통한 컴포넌트 이해서비스, 라이브러리 요약내용 자동생성서비스, 이해기반 검색서비스이다. 또한, 본 논문에서 적용된 자동화된 클러스터 기반 분류체계 방법의 성능은 전통적인 분류방법을 이용하는 2개의 다른 시스템들의 성능과 비교, 평가된다.

Combining Multiple Sources of Evidence to Enhance Web Search Performance

  • Yang, Kiduk
    • 한국도서관정보학회지
    • /
    • 제45권3호
    • /
    • pp.5-36
    • /
    • 2014
  • 웹은 하이퍼링크 및 야후와 같이 수동으로 분류된 웹 디렉토리 처럼 문서의 콘텐츠를 넘어선 다양한 정보의 소스가 풍부하다. 이 연구는 웹문서 내용을 활용한 텍스트기반의 검색 방식, 하이퍼 링크를 활용한 링크 기반의 검색 방식, 그리고 야후의 카테고리를 활용한 분류 기반의 검색 방식을 융합하므로서 여러 정보소스를 결합하면 검색 성능을 향상시킬 수 있다는 기존 융합검색연구들을 확장시켰다. 텍스트, 링크, 분류 기반 검색 결과를 여러가지 선형조합식으로 생성한 융합결과를 기존의 검색 평가 지표를 사용하여 각각의 검색 결과와 비교 한 후, 검색결과 오버랩의 중요성 또한 조사 하였다. 본 연구는 텍스트, 링크, 분류 기반 검색의 솔루션 스패이스들의 다양성이 융합검색의 적합성을 제시한다는 결론과 더불어 시스템 파라미터의 영향, 그리고 오버랩, 문서순위, 관련성들의 상호 관계 같은 융합 환경의 중요한 특성들을 분석하였다.

시맨틱 웹 기반 사용자 중심 검색시스템에 관한 연구 (A Study on Semantic Web based User Oriented Retrieval System)

  • 김창수;이종원;정회경
    • 한국정보통신학회논문지
    • /
    • 제19권4호
    • /
    • pp.871-876
    • /
    • 2015
  • 현재의 웹은 점점 늘어가는 데이터로 인해 효율적인 검색과 관리가 어려워지고 있다. 이를 개선하기 위한 방법으로 시맨틱 웹 기술이 개발되고 있다. 그러나 현재 사용되는 검색시스템들은 시맨틱 웹 기술을 도입하지 않음에도 압도적인 국내 사용률을 독점하고 있다. 이로 인해 시맨틱 웹에 대한 개발은 활성화 되지 않고 있으며, 검색시스템을 사용하는 사용자들 역시 시맨틱 웹의 사용률이 저조한 실정이다. 이에 본 논문에서는 현재 사용되고 있는 검색시스템을 분석하고, 제안하는 시스템의 온톨로지 구현 시 사용자가 사용한 데이터의 종류와 웹 서버의 게시판 사용 시 사용한 파일의 종류를 RDF 표현 규칙에 추가 설정하여 사용자 중심의 검색시스템을 설계 및 구현하였다.

지식베이스에 기반한 다언어 문서 검색 (Cross-Lingual Text Retrieval Based on a Knowledge Base)

  • 최명복;조준
    • 한국인터넷방송통신학회논문지
    • /
    • 제10권1호
    • /
    • pp.21-32
    • /
    • 2010
  • 웹과 같은 일반 영역을 대상으로 문서를 검색할 때 사용자의 질의 구성은 정보검색 효과에 큰 영향을 준다. 본 논문에서는 일반 사용자들이 웹에서 다언어 문서 검색을 효과적으로 수행할 수 있도록 다언어 지식베이스 기반의 지능형 정보검색 방법을 제안한다. 지식베이스로부터 추론된 지식은 사용자의 연상 작용을 도와 질의를 용이하고 정확하게 구성하여 효과적인 다언어 정보검색을 수행할 수 있도록 한다. 본 논문에서는 이러한 지식베이스 기반의 질의 변경 알고리즘을 개발하고 이를 한국어와 영어 웹 문서를 대상으로 실험하였다. 실험 결과 제안된 질의 변경 알고리즘은 다언어 문서 검색에서 지식베이스를 사용하지 않은 경우에 비해 매우 효과적임을 알 수 있었다.

XML 웹 서비스 검색 엔진의 개발 (Development of a XML Web Services Retrieval Engine)

  • 손승범;오일진;황윤영;이경하;이규철
    • Journal of Information Technology Applications and Management
    • /
    • 제13권4호
    • /
    • pp.121-140
    • /
    • 2006
  • UDDI (Universal Discovery Description and Integration) Registry is used for Web Services registration and search. UDDI offers the search result to the keyword-based query. UDDI supports WSDL registration but it does not supports WSDL search. So it is required that contents based search and ranking using name and description in UDDI registration information and WSDL. This paper proposes a retrieval engine considering contents of services registered in the UDDI and WSDL. It uses Vector Space Model for similarity comparison between contents of those. UDDI registry information hierarchy and WSDL hierarchy are considered during searching process. This engine suppports two discovery methods. One is Keyword-based search and the other is template-based search supporting ranking for user's query. Template-based search offers how service interfaces correspond to the query for WSDL documents. Proposed retrieval engine can offer search result more accurately than one which UDDI offers and it can retrieve WSDL which is registered in UDDI in detail.

  • PDF

A Study on Effective Internet Data Extraction through Layout Detection

  • Sun Bok-Keun;Han Kwang-Rok
    • International Journal of Contents
    • /
    • 제1권2호
    • /
    • pp.5-9
    • /
    • 2005
  • Currently most Internet documents including data are made based on predefined templates, but templates are usually formed only for main data and are not helpful for information retrieval against indexes, advertisements, header data etc. Templates in such forms are not appropriate when Internet documents are used as data for information retrieval. In order to process Internet documents in various areas of information retrieval, it is necessary to detect additional information such as advertisements and page indexes. Thus this study proposes a method of detecting the layout of Web pages by identifying the characteristics and structure of block tags that affect the layout of Web pages and calculating distances between Web pages. This method is purposed to reduce the cost of Web document automatic processing and improve processing efficiency by providing information about the structure of Web pages using templates through applying the method to information retrieval such as data extraction.

  • PDF