• Title/Summary/Keyword: 색인화

Search Result 272, Processing Time 0.024 seconds

FRIP Stystem For Region-based Image Retrieval (영역기반 검색환경을 위한 FRIP 시스템)

  • 고병철;변혜란
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2000.04b
    • /
    • pp.499-501
    • /
    • 2000
  • 본 논문에서는 영역기반 검색환경을 제공하는 FRIP(Finding Region in the Pictures) 시스템을 소개한다. FRIP 시스템은 영역 기반 검색환경을 제공하기 위해서, 우선적으로 영상을 분할하고, 각 분할된 영역으로부터 색상, 질감, 크기, 모양, 위치 정보와 같은 최적의 특징 벡터들을 추출하여 색인화시킨다. 그런 뒤에, 사용자가 검색하고자 하는 영역과 검색 영상 수 k를 입력하면, 유사성 측정 식에 의해 가장 유사한 k만큼의 영상을 우선 순위 형태로 사용자에 보여주게 된다. 본 시스템에서는 영상을 분할하기 위해서 기본적인 RGB 색상계를 확장(Scaling 및 이동(Shifting) 알고리즘을 통해 영상의 대비 정도가 향상된 새로운 색상계로 변환시키고, 원형 필터를 설계하여, 영역 안에 포함된 의미 없는 작은 영역을 제거하도록 하였다. 그리고 이렇게 분할된 각 영역들로부터, 본 시스템에서 제안하는 모양 기술자인 MRS(Modified Radius-based Signature)를 포함하여 5가지의 최적의 특징 벡터들을 전처리 단계에서 데이터베이스에 색인으로 저장하고 유사성 측정을 위한 수치로 사용하였다.

  • PDF

A Study on File Search Engine Based on DBMS (DBMS을 활용한 파일 검색엔진 연구)

  • Kim, HyoungSeuk;Yu, Heonchang
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • 2016.10a
    • /
    • pp.548-551
    • /
    • 2016
  • 기존 그리드 기반의 전통적인 RDBMS는 비구조적 데이터에 대한 색인이 지원되지 않았다. 이러한 제약 조건들로 인해 파일 문서 및 비 구조화된 데이터의 검색 엔진으로는 부적합하였다. 최근에 다양한 검색 오픈소스(Solr, Lucene)등으로 검색 엔진이 개발되어 활용되고 있지만, 검색한 결과와 기존 데이터의 연동이 쉽지 않고 구조 변경이 어려우며, 사용자의 다양한 요구 사항 수용이 쉽지 않은 단점을 가지고 있다. 따라서 본 연구에서는 빠른 검색을 위한 색인 (index) 최적화와 대용량 데이터 처리를 위한 파티션 기반 데이터의 분할 및 정복 (divide and conquer) 처리, 이중화된 검색어 색인 기능을 구현하였다. 또한 동의어 사전을 구축하여 연관 관계 분석이 가능하도록 DB를 구축하여 검색어와 동의어의 상호 관계성을 유지하였으며 오픈 소스보다 발전한 형태의 검색 엔진을 개발하는 것을 목표로 하였다. 본 연구를 위해 약 400만건 이상의 다양한 포맷 (Ms-office, Hwp, Pdf, Text)등의 파일 문서를 샘플로 실험을 진행하였다.

Design and Implementation of an MPEG2 Non-linear Editor in Client/Server Environment (클라이언트/서버 환경에서의 MPEG-2 비선형 편집기의 설계 및 구현)

  • 김소만;송기택;유지욱;이성환
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2000.04b
    • /
    • pp.541-543
    • /
    • 2000
  • 최근 들어, 통신 및 멀티미디어의 발달과 더불어 대용량 동영상 데이터의 효과적인 관리 및 처리 방법에 대한 연구가 활발히 진행되고 있는 추세이다. 따라서 본 논문에서는 동영상 압축표준인 MPEG-2 데이터의 효과적인 관리 및 처리를 위한 클라이언트/서버 환경에서의 비선형 편집 시스템을 구현하였다. 본 시스템은 압축 정보를 이용하여 최소한의 복호화 과정을 통해 장면전화 검출 및 색인을 수행하는 색인부의 DirectX를 기반으로 한 편집부로 크게 구성되어 있다. 본 논문에서는 압축 정보를 사용하여 빠르게 색인을 수행하고, DirectX 기술을 사용함으로써 다양한 편집 기능을 제공하며 사용자에게 직관적이고 간편한 인터페이스를 제공한다. 또한 클라이언트/서버 환경에서의 편집기능을 제공함으로써 고성능의 편집 서버를 통해 저사양의 클라이언트 컴퓨터에서도 소프트웨어적으로 MPEG-2 동영상을 효과적으로 편집할 수 있는 시스템을 구현하였다.

  • PDF

Bit-Vector-Based Space Partitioning Indexing Scheme for Improving Node Utilization and Information Retrieval (노드 이용률과 검색 속도 개선을 위한 비트 벡터 기반 공간 분할 색인 기법)

  • Yeo, Myung-Ho;Seong, Dong-Ook;Yoo, Jae-Soo
    • Journal of KIISE:Computing Practices and Letters
    • /
    • v.16 no.7
    • /
    • pp.799-803
    • /
    • 2010
  • The KDB-tree is a traditional indexing scheme for retrieving multidimensional data. Much research for KDB-tree family frequently addresses the low storage utilization and insufficient retrieval performance as their two bottlenecks. The bottlenecks occur due to a number of unnecessary splits caused by data insertion orders and data skewness. In this paper, we propose a novel index structure, called as $KDB_{CS}^+$-tree, to process skewed data efficiently and improve the retrieval performance. The $KDB_{CS}^+$-tree increases the number of fan-outs by exploiting bit-vectors for representing splitting information and pointer elimination. It also improves the storage utilization by representing entries as a hierarchical structure in each internal node.

A Korean Corpus Analysis Tool for Language Information Acquisition (언어 정보 획득을 위한 한국어 코퍼스 분석 도구)

  • Lee, Ho;Kim, Jin-Dong;Rim, Hae-Chang
    • Annual Conference on Human and Language Technology
    • /
    • 1994.11a
    • /
    • pp.297-304
    • /
    • 1994
  • 코퍼스는 기계 가독형으로 개장되어 있는 실제 사용 언어의 집합으로 자연어 처리에 필요한 여러 가지 언어 정보를 내재하고 있다. 이들 정보는 코퍼스 분석기를 이용하여 획득할 수 있으며 용례와 각종 통계 정보 및 확률 정보, 연어 목록 등은 코퍼스에서 추출할 수 있는 대표적인 언어 정보들이다. 그러나 기존의 한국어 코퍼스 분석 도구들은 용례 추출 기능만을 보유하여 활용 범위가 제한되어 있었다. 이에 본 논문에서는 대량의 한국어 코퍼스를 분석하여 용례뿐만 아니라 자연어 처리의 제분야에서 필요한 언어 정보들을 추출하는 방법에 대해 연구하였으며 이의 검증을 위해 KCAT(Korean Corpus Analysis Tool)를 구현하였다. KCAT는 코퍼스 색인, 용례 추출, 통계 정보 추출, 연어 추출 부분으로 구성되어 있다. 용례 색인을 위해서는 여러 가지 사전과 용례 색인 구조가 필요한데 KCAT에서는 가변 차수 B-Tree 구조를 이용하여 사전을 구성하며 용례 색인을 위해 버킷 단위의 역 화일 구조를 이용한다. 질 좋은 용례의 추출을 위해 KCAT는 다양한 용례 연산 및 정렬 기능을 제공한다. 또한 통계적 방법의 자연어 처리 분야를 위해 어휘 확률, 상태 전이 확률, 관측 심볼 확률, 상호 정보, T-score 등을 제공하며, 기계 번역 분야에서 필요한 연어를 추출한다.

  • PDF

Efficient Indexing structure for Moving Object Trajectoriest (이동객체궤적에 대한 효율적인 색인구조)

  • Kim, Gyu-Jae;Cho, Woo-hyun
    • Proceedings of the Korean Institute of Information and Commucation Sciences Conference
    • /
    • 2015.10a
    • /
    • pp.360-363
    • /
    • 2015
  • In n-dimensional spatial data, Minimum Boundary Rectangle(MBR) was used to handle the moving object trajectories data. But, this method has inaccurate approximation. So, It makes many dead space and performs unnecessary operation when processing a query. In this paper, we offer new index structure using approximation. We developed algorithm that make index strucutre by using Douglas-Peucker Algorithm and had a comparison experiment.

  • PDF

인터넷을 통한 산업보건의 정보수집

  • No, Yeong-Man
    • 월간산업보건
    • /
    • s.89
    • /
    • pp.36-38
    • /
    • 1995
  • 인터넷은 한마디로 "정보의 바다"라고 할 수 있다. 다른 방향에서 본다면 인터넷이란 하나의 거대한 도서관이라고도 할 수 있다. 도서관에서는 각 정보를 색인화하여 쉽게 정보를 찾아 볼수 있게 되어 있고 새로운 정보가 나오면 추가로 색인을 재 정리하는 시스템으로 되어 있다. 인터넷도 도서관의 색인 시스템과 마ㅏㄴ가지로 전세계의 전산망 특히 산업보건과 관련된 기관에 접속하여 키보드로 산업보건정보를 찾을수 있게 되어 있다. 그렇다면 우리가 어떻게 전세계에 산재되어 있는 대형, 소형, IBM, 매킨토시 컴퓨터의 전산망에 접근하여 정보를 찾아 낼 수 있는가? 하고 의문을 갖는 사람들이 있을 것이다. 인터넷이 바로 그것을 가능하게 해준다. 그러면 어떻게 인터넷에 접근을 할 수 있는가? 많은 대학의 전산망, 교육망, 연구망을 통해 인터넷에 연결되어 있고 여러가지 상업서비스도 생겨나서 인터넷접속이 얼마든지 가능하다. 그러나 여기에는 또 한가지의 문제가 있다. 인터넷은 UNIX 운영시스템으로 구성되어 있기 때문에 약간의 UNIX언어를 알아야 인터넷 접근이 가능하다는 것이다. 이런한 문제 때문에 일반인들은 인터넷의 접근을 회피하게 된다. 그러나 이러한 단점은 World Wide Web(WWW)와 Web browser라는 프로그램이 나오면서 해결되었고 요즈음 일반적으로 많이 사용하고 있는browser는 Mosaic과 Netscape라는 프로그램이다. Netscape은 UNIX운영시스템이 탑재된 work station이나 대형컴퓨터에 보다 많이 이용되고 일반 개인용컴퓨터 사용자는 Mosaic 프로그램 버그(bug)가 적기 때문에 주로 사용하고 있다. Netscape도 사용법에 있어서는 Mosaic과 별 차이가 없다. 필자는 Netscape보다는 Mosaic을 주로 사용해 왔기 때문에 Mosaic을 이용하여 인터넷에 접근하는 방법과 필자가 접속해 본 미국의 산업보건관련 기관을 소개하고자 한다.

  • PDF

Vulnerability Analysis on Fire Service Zone using Map Overlay Method in GIS (GIS 기반 중첩기법을 이용한 소방서비스 취약지역 분석)

  • Lee, Seul-Ji;Lee, Ji-Yeong
    • Journal of the Korean Society of Surveying, Geodesy, Photogrammetry and Cartography
    • /
    • v.29 no.1
    • /
    • pp.91-100
    • /
    • 2011
  • Fire stations should be located in optimal location to act quickly in case of emergency and minimize damages as a public facility that protects life and property of local residents. Siting fire stations without regard for the accessibility and occurrence factors of an accident may provide fire service unequally. Therefore service analysis is necessary to reduce the blind spot of disaster and safety and to offer equal fire-service at this time. Especially fire stations can service more efficiently than before by reducing a more likely vulnerable area. This study suggests methods of mapping index of value that represents vulnerability of the occurrence of an accident and extracting service zone map of fire stations, as an initial research for offering efficient fire service. Geographical distribution mismatch between service zone map and vulnerability map is figured out and vulnerable area for fire service is defined by using map overlay method.

Evaluation of the Feature Selection function of Latent Semantic Indexing(LSI) Using a kNN Classifier (잠재의미색인(LSI) 기법을 이용한 kNN 분류기의 자질 선정에 관한 연구)

  • Park, Boo-Young;Chung, Young-Mee
    • Proceedings of the Korean Society for Information Management Conference
    • /
    • 2004.08a
    • /
    • pp.163-166
    • /
    • 2004
  • 텍스트 범주화에 관한 선행연구에서 자주 사용되면서 좋은 성능을 보인 자질 선정 기법은 문헌빈도와 카이제곱 통계량 등이다. 그러나 이들은 단어 자체가 갖고 있는 모호성은 제거하지 못한다는 단점이 있다. 본 연구에서는 kNN 분류기를 이용한 범주화 실험에서 단어간의 상호 관련성이 자동적으로 유도됨으로써 단어 자체 보다는 단어의 개념을 분석하는 잠재의미색인 기법을 자질 선정 방법으로 제안한다.

  • PDF

The development of a document retrieval system using thesaurus and signature file (시소러스 및 요약화일을 이용한 문서 검색시스템)

  • Jeong, Sang-Cheol;Shin, Dong-Wook
    • Annual Conference on Human and Language Technology
    • /
    • 1994.11a
    • /
    • pp.400-408
    • /
    • 1994
  • 본 논문에서는 요약화일을 이용하여 복합명사를 효율적으로 처리하며 시소러스를 이용하여 검색하는 한글문서 검색시스템을 제안한다. 본 한글문서 검색 시스템은 한글문서를 대상으로 색인하는 자동색인기와 사용자의 질의를 받아 관련된 문서를 검색하는 검색기로 구성된다. 자동색인기는 우선 한글문서를 대상으로 최장일치 방법으로 명사들을 출출한 후 복합명사의 패턴을 분석하여 복합명사의 가능성이 높은 것들을 복합명사화한다. 두번째로 이들 복합명사들을 1+2SP 방식으로 코딩한 후 요약화일 방법을 이용하여 요약화일을 작성한다. 검색기는 사용자 질의어를 받아 명사들을 추출한 후 시소러스를 이용하여 질의어를 확장한다. 다음 확장된 질의어를 1+2SP 방식으로 코딩한 후 관련된 문서를 검색한다. 본 논문에서는 한국통신에서 만든 코퍼스를 이용하여 제안된 방법의 성능을 평가하였는데 복합명사 처리 및 시소러스 이용방식이 효율적임이 입증되었다. 또한 KAIST에서 개발한 문서검색 시스템보다 동일한 코퍼스로 실험하였을 경우 재현률 및 정확률이 $7{\sim}8%$ 정도 앞서 기존의 시스템보다도 성능이 우수하다는 것이 밝혀졌다.

  • PDF