• 제목/요약/키워드: 색인 클러스터링

검색결과 106건 처리시간 0.021초

MPEG으로 압축된 뉴스 데이터에서의 DC성분 추출과 컬러 클러스터링을 이용한 앵커 프레임 검색 기법 (An Anchor-frame Detection Algorithm in MPEG News Data using DC component extraction and Color Clustering)

  • 정정훈;이근섭;오화종;최병욱
    • 대한전자공학회:학술대회논문집
    • /
    • 대한전자공학회 2000년도 제13회 신호처리 합동 학술대회 논문집
    • /
    • pp.729-732
    • /
    • 2000
  • 대용량 비디오 데이터의 이용에 있어 효과적인 비디오 검색을 위해서는 비디오 데이터의 색인 과정이 필요하다. 효과적인 비디오 데이터의 색인을 위해서는 의미적 단위인 씬(Scene)으로 이루어진 비디오 데이터를 물리적인 경계면인 컷(장면전환점)으로 검출하는 기법이 필수적이며 각 샷에서의 키 프레임 추출 또한 필수적이다. 본 논문에서는 뉴스 비디오데이터의 키 프레임인 앵커 프레임의 효과적인 검색을 위해 DC 성분 추출과 이진 검색기법, 그리고 컬러 클러스터링을 이용하고 있다. 본 논문에서 제하고 있는 방법을 검증하기 위해서 47분 10초 분량의 MPEG-2 로 압축된 뉴스 비디오 데이터에 적용한 결과 91.3%의 정확도와 84.0%의 재현율을 보여 제안한 방법의 우수성을 증명하고 있다.

  • PDF

대화식 클러스터링 기법을 이용한 칼라 지도의 문자 영역 추출에 관한 연구 (Character Extraction from Color Map Image Using Interactive Clustering)

  • 안창;박찬정;이상범
    • 한국정보처리학회논문지
    • /
    • 제4권1호
    • /
    • pp.270-279
    • /
    • 1997
  • 지도 영상에 포함된 문자들을 효율적으로 인식하기 위해서는, 문자 영역만을 추 출하여 독립된 계층으로 만드는 전처리 단계가 선행되어야 한다. 본 논문에서는 칼라 지도 영상의 색 정보를 대화식 클러스터링 기법에 의해 색 별로 분리하고, 문자 영역 을 추출하는 알고리즘을 제안하였다. 제안된 대화식 클러스터링 기법은 칼라 영상 중 에서 사용자가 분리하기 원하는 색을 대화식으로 선택하여 각각의 선택된 색을 중심 으로 클러스터를 형성하고 분리한다. 문자를 추출하는 알고리즘은 문자를 표현하는 색만을 추출한 이전 영상을 벡터 데이터화 한 후 각 원시 요소들의 상호 관계를 고려 하여 직선, 원, 문자의 세 계층으로 분류하는 것으로서, 문자와 직선이 중첩되어, 하 나의 연결 요소를 이루고 있을 때에도 효과적으로 문자를 분리할 수 있다. 알고리즘 의 평가를 위해 1:3,000의 지번약도에 대한 실험을 수행하였으며, 선분과 문자가 중 첩되어 있는 경우에도 각각 분리할 수 있음을 확인하였다.

  • PDF

용어 자동분류를 위한 퍼지 클러스터링 기법 분석 (Analytical Study of Fuzzy Clustering Technique for Automatic Term Classification)

  • 한승희
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 2003년도 제10회 학술대회 논문집
    • /
    • pp.95-103
    • /
    • 2003
  • 목차 및 권말색인과 같은 인쇄형태의 정보내용에 대한 구조화된 접근방식에서 착안하여 전자 문서의 내용에 대한 새로운 형태의 접근방식을 개발할 수 있는데, 이를 위한 방안으로 용어 자동분류 기법이 있다. 본 연구에서는 용어의 의미모호성 문제를 해결하는 동시에 용어간 계층관계 표현이 가능한 자동분류 기법으로 퍼지 클러스터링 기법을 제안하고, 대표적인 퍼지 클러스터링 알고리즘인 퍼지 c-means 기법에 대해 분석하고자 한다.

  • PDF

자동 문서 클러스터링을 위한 디스크립터 추출 방안 (A Method of Descriptor Extraction for Automatic Document Clustering)

  • 윤보현;강현규;고형대
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2000년도 제13회 춘계학술대회 및 임시총회 학술발표 논문집
    • /
    • pp.230-233
    • /
    • 2000
  • 기존의 검색엔진은 검색결과를 적합도 순서로 나열하여 사용자가 원하는 문서를 찾는데 어려움이 있다. 이러한 문제의 해결책으로 검색결과 문서에 대해 자동 클러스터링을 수행하여 문서 내용이 유사한 문서가 하나의 클러스터내에 존재하도록 한다. 본 논문에서는 검색 결과 문서의 클러스터링에서 필요한 디스크립터 추출 방안을 제안한다. 각 클러스터 내에서 디스크립터를 추출하기 위해 정보검색의 색인과정에서 사용하는 용어 가중치 계산 방법을 이용한다.

  • PDF

클러스터링 기법을 이용한 개별문서의 지식구조 자동 생성에 관한 연구 (Automatic Generation of the Local Level Knowledge Structure of a Single Document Using Clustering Methods)

  • 한승희;정영미
    • 정보관리학회지
    • /
    • 제21권3호
    • /
    • pp.251-267
    • /
    • 2004
  • 이 연구에서는 전통적인 인쇄매체 환경에서 지식에 대해 지역적인 접근법을 제공하는 권말색인과 목차의 기능에 착안하여 용어 클러스터링 실험과 클러스터 대표어 선정 실험을 통해 개별문서의 지식구조 자동 생성 기법을 제안하였다. 자동 생성된 지식구조가 갖는 기능성을 평가하여 정보 검색 환경에서의 적용 가능성을 확인하였다. 용어 클러스터링 실험에서는 워드 기법의 성능이 중복 분류를 허용하는 퍼지 K-means 클러스터링 기법에 비해 높았으며, 클러스터 대표어 선정 기법으로는 단락빈도를 이용한 경우가 가장 좋은 성능을 나타냈다. 또한, 이용자 태스크를 기반으로 하여 최종적으로 생성된 지식구조의 기능성을 평가한 결과, 이 연구에서 자동 생성된 지식구조가 인쇄매체 환경에서의 권말색인과 목차가 갖는 기능을 어느 정도 수행한다는 것을 입증하였다.

이동체 데이터베이스를 위한 R-tree 기반 색인구조에서 궤적 클러스터를 사용한 분할 정책 (Splitting policies using trajectory clusters in R-tree based index structures for moving objects databases)

  • 김진곤;전봉기;홍봉희
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2003년도 가을 학술발표논문집 Vol.30 No.2 (2)
    • /
    • pp.37-39
    • /
    • 2003
  • 이동체 데이터베이스를 위한 과거 궤적 색인으로 R-tree계열이 많이 사용된다. 그러나 R-tree계열의 색인은 공간 근접성만을 고려하였기 때문에 동일 궤적을 검색하기에는 많은 노드 접근이 필요하다. 이동체 색인의 검색에서 영역 질의와 궤적 질의는 공간 근접성과 궤적 연결성과 같이 상반된 특징으로 인하여 함께 고려되지 않았다. 이동체 색인에서 영역 질의의 성능개선을 위해서는 노드 간의 심한 중복과 사장 공간(Dead Space)을 줄여야 하고, 궤적 질의의 성능 개선을 위해서는 이동체의 궤적 보존이 이루어져야 한다. 이와 같은 요구 조건을 만족하기 위해, 이 논문에서는 R-tree 기반의 색인 구조에서 새로운 분할 정책을 제안한다. 제안하는 색인 구조의 노드 분할 정책은 궤적 클러스터링을 위한 동일 궤적을 그룹화해서 분할하는 공간 축 분할 정책과 공간 활용도를 높이는 시간 축 분할 정책을 제안한다. 본 논문에서는 R-tree기반의 색인 구조에서 변경된 분할 정책을 구현하고, 실험 평가를 수행한다. 이 성능 평가를 통해서 검색성능이 우수함을 보인다.

  • PDF

공간 데이터 웨어하우스에서 부분 색인을 이용한 효율적인 색인 재구축 기법 (Efficient Index Reconstruction Methods using a Partial Index in a Spatial Data Warehouse)

  • 곽동욱;정영철;유병섭;김재홍;배해영
    • 한국공간정보시스템학회 논문지
    • /
    • 제7권3호
    • /
    • pp.119-130
    • /
    • 2005
  • 공간 데이터 웨어하우스는 공간정보를 주제 중심적이고 통합적이며 시간성을 가지는 비 휘발성 자료로 저장하여 의사결정을 효율적으로 지원하는 시스템이다. 이 시스템은 구축기와 공간 데이터 웨어하우스 서버로 구성되어 있다. 공간 데이터 웨어하우스 서버는 구축기에서 전송된 데이터를 적재하기 위해 사용자 서비스를 정지하고, 사용자의 빠른 응답시간을 위해 적재된 데이터로 색인을 구축한다. 색인 구축을 위한 기존 기법에는 벌크 삽입 기법과 색인 전송 기법이 있다. 벌크 삽입 기법은 색인을 구축하기 위한 클러스터링 비용이 크며 검색 성능도 떨어진다. 색인 전송 기법은 주기적인 소스 데이터의 변경을 지원하지 않는 문제점이 있다. 본 논문에서는 공간 데이터 웨어하우스에서의 부분 색인을 이용한 효율적인 색인 재구축 기법을 제안한다. 제안 기법은 부분 색인을 직접 전송, 기록하며 물리적 위치 정보를 예상하여 기록할 수 있는 효율적인 색인 재구축 기법이다. 구축기에서 추출된 데이터를 공간의 근접도가 아닌 색인의 구조에 맞게 클러스터링하며, 생성된 각 클러스터를 부분 색인으로 구성하여 페이지 단위로 전송한다. 공간 데이터 웨어하우스 서버에서는 전송된 부분 색인을 저장하기 위해 물리적으로 연속된 공간을 예약하고 예약된 공간에 부분 색인을 기록한다. 기록된 부분 색인을 공간 데이터 웨어하우스 서버의 기 구축된 색인에 삽입함으로써 색인 재구축을 위한 검색, 분할, 재조정 비용이 최소화된다.

  • PDF

LSI를 이용한 문서 클러스터링 (The Document Clustering using LSI of IR)

  • 고지현;최영란;유준현;박순철
    • 한국산업정보학회:학술대회논문집
    • /
    • 한국산업정보학회 2002년도 춘계학술대회 논문집
    • /
    • pp.330-335
    • /
    • 2002
  • 정보검색시스템에서 가장 중요한 것은 사용자의 요구에 부합하는 결과를 도출하는 것이다. 이를 위하여 사용자의 질의와 연관된 모든 문서들을 추출하게 되는데, 이 많은 결과 문서들 중에서 사용자가 원하는 문서는 소수이고, 원하는 문서를 찾는 것도 쉽지 않다. 따라서 적절한 결과 문서를 도출하기 위하여 연관된 문서들끼리 그룹화 시키는 클러스터링 방법이 많이 이용된다. 본 논문에서는 기존의 문서내의 색인어 보다는 그 의미에 기반하여 클러스터링 하였다. 이를 위하여 LSI 모델을 적용하였고, 문서 클러스터링 방법으로 많이 사용하고 있는 K-Means 알고리즘을 이용한 클러스터링과의 차이점을 비교, 분석하였다.

  • PDF

LSI 를 이용한 가중치 변화에 따른 클러스터링 결과 분석 (The Analysis of Clustering Result with Weight Change using LSI)

  • 고지현;오형진;박순철
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2002년도 춘계학술발표논문집 (하)
    • /
    • pp.1009-1012
    • /
    • 2002
  • 정보검색시스템에서 가장 중요한 것은 사용자의 요구에 부합하는 결과를 도출하는 것이다. 이를 위하여 사용자의 질의와 연관된 모든 문서들을 추출하게 되는데, 이 많은 결과 문서들 중에서 사용자가 원하는 문서는 소수이고, 원하는 문서를 찾는 것도 쉽지 않다. 따라서 적절한 결과 문서 도출을 위하여 연관된 문서들끼리 그룹화 시키는 클러스터링 방법이 많이 이용된다. 본 논문에서는 클러스터링에 영향을 끼치는 요소 중 문서별 색인어의 가중치가 클러스터링에 끼치는 영향을 알아보았다. 이를 위해 가중치의 변화에 따른 클러스터링 된 결과를 LSI 를 이용하여 도식화하고 그 결과를 분석하였다.

  • PDF

시소러스 브라우저 자동구현을 위한 Metadata를 이용한 색인어 처리방안에 대한 연구 (A Theoretical Study on Indexing Methods using the Metadata for the Automatic Construction of a Thesaurus Browser)

  • 서휘
    • 한국도서관정보학회지
    • /
    • 제35권4호
    • /
    • pp.451-467
    • /
    • 2004
  • 본 연구에서는 시소러스 브라우저를 자동으로 구성하기 위한 방법에 대한 이론적인 연구와 함께 시소러스 브라우저 구성과정의 핵심인 자동색인과 용어 간 계층을 자동으로 형성하는 클러스터링 알고리즘에 대한 선행 연구결과를 제시하였다. 그리고 웹 문헌에서 전통적인 종이 형태 문헌의 서지사항에 해당하는 메타데이터를 분석하고 이를 처리하는 방안을 조사함에 의해 웹 문헌에서 색인어를 자동으로 추출할 수 있는 방안에 대하여 연구하였다. 또한 대부분의 웹 문헌에 메타데이터가 수록되어 있지 않음에 착안하여 기존의 웹 문헌에 메타데이터 자동 편집기를 이용하여 메타데이터를 수록하는 방안에 대한 연구결과를 제시하였다.

  • PDF