• 제목/요약/키워드: full-text search

검색결과 88건 처리시간 0.035초

전문에 대한 검색시스템의 구현 (Implementation of Information Retrieval System for Full-Text)

  • 김대규;정희택;강영만;한순희;조혁현
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국해양정보통신학회 2000년도 추계종합학술대회
    • /
    • pp.337-340
    • /
    • 2000
  • 인터넷을 이용한 정보검색이 일반화되면서, 보다 정확하고 꼭 필요한 정보의 요구가 일반화되었다. 정확한 정보의 제공을 위해, 된 정보에 대한 중심어(keyword) 검색뿐만 아니라 전문(Full-Text)에 대한 검색 요구가 일반화되었다. 본 연구에서는 전문 검색을 위한 설계 방안을 제안한다. 기존에 제안된 전문 검색 방안과 오라클에서 제공하는 interMedia Text를 이용한 전문 검색 방안을 비교한다. 이를 기반으로 정보 검색 시스템에서 구현 방안을 제시한다.

  • PDF

Improving Elasticsearch for Chinese, Japanese, and Korean Text Search through Language Detector

  • Kim, Ki-Ju;Cho, Young-Bok
    • Journal of information and communication convergence engineering
    • /
    • 제18권1호
    • /
    • pp.33-38
    • /
    • 2020
  • Elasticsearch is an open source search and analytics engine that can search petabytes of data in near real time. It is designed as a distributed system horizontally scalable and highly available. It provides RESTful APIs, thereby making it programming-language agnostic. Full text search of multilingual text requires language-specific analyzers and field mappings appropriate for indexing and searching multilingual text. Additionally, a language detector can be used in conjunction with the analyzers to improve the multilingual text search. Elasticsearch provides more than 40 language analysis plugins that can process text and extract language-specific tokens and language detector plugins that can determine the language of the given text. This study investigates three different approaches to index and search Chinese, Japanese, and Korean (CJK) text (single analyzer, multi-fields, and language detector-based), and identifies the advantages of the language detector-based approach compared to the other two.

퍼지 논리를 이용한 사용자 중심적인 Full-Text 검색방법에 관한 연구 (Consideration of a Robust Search Methodology that could be used in Full-Text Information Retrieval Systems)

  • 이원부
    • Asia pacific journal of information systems
    • /
    • 제1권1호
    • /
    • pp.87-101
    • /
    • 1991
  • The primary purpose of this study was to investigate a robust search methodology that could be used in full-text information retrieval systems. A robust search methodology is one that can be easily used by a variety of users (particularly naive users) and it will give them comparable search performance regardless of their different expertise or interests In order to develop a possibly robust search methodology, a fully functional prototype of a fuzzy knowledge based information retrieval system was developed. Also, an experiment that used this prototype information retreival system was designed to investigate the performance of that search methodology over a small exploratory sample of user queries To probe the relatonships between the possibly robust search performance and the query organization using fuzzy inference logic, the search performance of a shallow query structure was analyzes. Consequently the following several noteworthy findings were obtained: 1) the hierachical(tree type) query structure might be a better query organization than the linear type query structure 2) comparing with the complex tree query structure, the simple tree query structure that has at most three levels of query might provide better search performance 3) the fuzzy search methodology that employs a proper levels of cut-off value might provide more efficient search performance than the boolean search methodology. Even though findings could not be statistically verified because the experiments were done using a single replication, it is worth noting however, that the research findings provided valuable information for developing a possibly robust search methodology in full-text information retrieval.

  • PDF

WeChat 메신저의 향상된 복호화 방안과 SQLite Full Text Search 데이터를 이용한 삭제된 메시지 복구에 관한 연구 (Study on Improved Decryption Method of WeChat Messenger and Deleted Message Recovery Using SQLite Full Text Search Data)

  • 허욱;박명서;김종성
    • 정보보호학회논문지
    • /
    • 제30권3호
    • /
    • pp.405-415
    • /
    • 2020
  • 스마트폰의 보급률이 늘어남에 따라 모바일 포렌식은 현대 디지털 포렌식 수사에서 필수적인 요소다. 모바일 메신저 데이터는 사용자의 생활패턴, 심리상태 등의 정보를 획득할 수 있기 때문에 모바일 포렌식에서 매우 중요한 데이터이다. 메신저 데이터 분석을 위해서는 암호화된 메신저 데이터의 복호화 기술이 필요하며, 대부분의 메신저가 메시지 삭제 기능을 제공하므로 삭제된 메시지를 복구하는 기술이 요구된다. 전 세계 약 10억 명이 사용하고 있는 메신저인 WeChat은 IMEI (International Mobile Equipment Identity) 정보를 이용하여 데이터를 암호화하며, 메시지 삭제 기능을 제공한다. 본 논문에서는 IMEI 정보가 존재하지 않는 경우의 데이터 복호화 방안을 제시하였으며, SQLite 데이터베이스의 전문 검색기능을 위하여 생성된 FTS (Full Text Search) 데이터베이스를 사용하여 삭제된 메시지를 복구하는 방법에 대하여 제안한다.

전문데이터베이스의 탐색특성에 관한 연구 - 주제전문가와 탐색전문가 - (A Study of the Behaviours in Searching Full-Text Databases- Subject Specialists vs. Professional Searchers -)

  • 이응봉
    • 한국문헌정보학회지
    • /
    • 제30권2호
    • /
    • pp.51-86
    • /
    • 1996
  • 본 연구는 전문데이터베이스의 탐색에 있어서 주제전문가와 탐색전문가는 어떠한 특징적인 차이가 있는지를 밝히려 하였다. 이 연구를 통하여 얻어진 결론을 요약하면, 주제전문가와 탐색전문가는 전문데이터베이스의 탐색에, 있어서 탐색질문의 분석(탐색질문의 이해도. 탐색어 선정의 난이도, 탐색결과에 대한 기대수준), 탐색과정(탐색어수, 연산자 순 브라우징 문헌 순 접속시긴 출력문헌 건당 소요시긴 적합문헌 건당 소요시간), 탐색결과 (적합문헌수 재현율 정확율, 총 탐색비용 출력문헌 건당 소요비용, 적합문헌 건당 소요비용, 탐색결과에 대한 만족도)에 대하여 뚜렷한 차이를 나타내는 것으로 밝혀졌다.

  • PDF

실시간 속기 자막 환경에서 멀티미디어 정보 검색을 위한 Prefix Array (The Prefix Array for Multimedia Information Retrieval in the Real-Time Stenograph)

  • 김동주;김한우
    • 대한전기학회:학술대회논문집
    • /
    • 대한전기학회 2006년 학술대회 논문집 정보 및 제어부문
    • /
    • pp.521-523
    • /
    • 2006
  • This paper proposes an algorithm and its data structure to support real-time full-text search for the streamed or broadcasted multimedia data containing real-time stenograph text. Since the traditional indexing method used at information retrieval area uses the linguistic information, there is a heavy cost. Therefore, we propose the algorithm and its data structure based on suffix array, which is a simple data structure and has low space complexity. Suffix array is useful frequently to search for huge text. However, subtitle text of multimedia data is to get longer by time. Therefore, suffix array must be reconstructed because subtitle text is continually changed. We propose the data structure called prefix array and search algorithm using it.

  • PDF

국내외 기술정보의 연계 서비스 체제 구축 (Implementation of One-Stop Service System on Domestic & Foreign Technology Information)

  • 서진이;노경란
    • 정보관리연구
    • /
    • 제32권1호
    • /
    • pp.1-22
    • /
    • 2001
  • 본 연구는 이용자가 필요로 하는 과학기술정보를 찾기까지 학술지 목록 데이터베이스, 학술지기사 데이터베이스, 원문 데이터베이스를 각기 개별적으로 검색하는 기존의 방식에서 벗어나 통합검색을 지원하는 학술지 원 클릭 서비스 체제를 구현하고자 수행되었다. 데이터베이스 간, 그리고 DB와 전자 저널을 통합하여 학술지 원 클릭 서비스 체제를 구현함으로써 이용자는 학술지 브라우징, 학술지 검색, 학술지 기사검색, 전자 저널 보기, Alert 서비스, My Favorite Journal및 Keyword 등록관리, 원문복사신청을 단일 인터페이스 상에서 이용할 수 있다. 이용자는 학술지 OPAC을 통하여 모든 정보원을 검색하고 학술지 원문까지 입수할 수 있다.

  • PDF

학위논문 전문데이터베이스 구축 및 서비스환경 구현 (Construction of Full-Text Database and Implementation of Service Environment for Electronic Theses and Dissertations)

  • 이기호;김진숙;윤화묵
    • 한국정보처리학회논문지
    • /
    • 제7권1호
    • /
    • pp.41-49
    • /
    • 2000
  • 1990년대 중반부터 다양하고 강력한 문서편집기의 보편화와 더불어 국내외의 대학에서는 책자형태의 논문제출과 동시에 전자형태 학위논문의 제출을 의무화하고 있다. 그러나 제출된 방대한 야의 전자형태의 논문들은 한글, MS-Word, Latexe 등 다양한 문서편집기로 작성되었고 문서형식의 표준화가 이루어지지 않아 효율적으로 활용되지 못하고 있는 실정이다. 본 논문에서는 다양한 형태로 존재하는 학위논문들을 하나의 통일된 중간포맷으로 변혼하고, 변환된 논물들을 전문데이터베이스(Full Text Datsbase)화하여 이를 인터넷을 통해 효육적으로 검색하고 서비스하기 위한 학위논문 전문검색시스템을 구현한다.

  • PDF

대학도서관의 학위논문 전문DB구축방안 (Design for Creating Full-Text Database of Korean Dissertation)

  • 방준필
    • 한국비블리아학회지
    • /
    • 제9권1호
    • /
    • pp.39-52
    • /
    • 1998
  • 대학도서관에서 전자도서관 서비스를 위하여 전문(Full-Text) DB,특히 학위논문 DB를 구축하는 방법을 제시하였다. 알파벳 문서와 달리 한글 문서는 전문DB로 구축하는데 범용성을 가진 표현화된 방법이 많지 않다. 따라서 관련기술의 발전을 고려하여 적절한 DB 구축방법을 설계해야 한다. 이를 위하여 텍스트 형태와 이미지 형태의 파일 포맷, 각종 솔루션, 뷰어, 검색, 저작권을 고려하여 전문DB 구축원칙을 정하고, 고려대학교 도서관을 모델로 적용하여 전문DB 구축 원칙과 방향을 설정하였다.

  • PDF

장애인을 위한 해양 라이프가드 고려사항: 문헌연구 (Beach-Lifeguard Considerations for Individuals with Disabilities: A Literature Review)

  • 김재화;김혜민
    • 한국융합학회논문지
    • /
    • 제10권8호
    • /
    • pp.245-253
    • /
    • 2019
  • 한국의 해양 라이프가드들은 아직 장애인을 위한 구조 및 안전 관리를 수행할 준비가 되어있지 않다. 더욱이 대부분의 라이프가드 훈련들이 장애인 구조에 관한 정보 혹은 훈련이 제공되지 않고 있다. 본 연구의 목적은 문헌 검토를 실시하여 장애인을 위한 해양 라이프가드, 수상 안전관리와 관련하여 주요 이슈와 문제점을 찾아내는 데 있다. 데이터베이스(e.g., CINAHL Plus with Full Text, ERIC, MEDLINE, SPORTDiscus with Full Text)를 사용하여 연구논문과 해양안전과 관련한 국가/민간단체들의 문서들을 검색하였다. 사용된 검색어 혹은 키워드는 물 안전, 구조 요원, 익사 방지 등이 있었다. 주요 이슈를 파악하기 위해 수집된 문서내용을 분석(내용 분석법)을 실시하였다. 결과는 내용분석결과를 토대로 장애인 구조(rescue), 익사방지 및 수상안전과 관련된 중요한 다섯 가지 이슈들을 도출할 수 있었다.