• 제목/요약/키워드: 색인 클러스터링

검색결과 106건 처리시간 0.027초

정보검색(情報檢索)에 있어서 용어(用語)의 통계적(統計的) 관련성(關聯性)을 응용(應用)한 클러스터링기법(技法) (A Study on the Clustering Technique Associated with Statistical Term Relatedness in Information Retrieval)

  • Jeong, Jun-Min
    • 정보관리연구
    • /
    • 제18권4호
    • /
    • pp.98-117
    • /
    • 1985
  • 본(本) 논문(論文)에서는 통계적(統計的) 용어조합(用語組合)과 클러스터링기법(技法)에 관한 문헌(文獻)을 간단히 살펴보았다. 선행연구(先行硏究)들로부터 통계적(統計的) 용어조합(用語組合)은 조합기법(組合技法)의 비효율성(非效率性)때문이 아니라 문헌집단(文獻集團)의 이질성(異質性) 때문에 검색(檢索)과 분류(分類)에 적당치 않다는 사실(事實)을 발견(發見)할 수 있다. 그 결과(結果)로부터 정보검색(情報檢索)의 최적화(最適化)를 위한 조합기법(組合技法)으로서 클러스터링과 통계적(統計的) 색인(索引)의 개념(槪念)을 이용(利用)할 수 있다. 본(本) 논문(論文)의 가설(假說)은 클러스터파일내(內)에서 통계적(統計的) 용어조합(用語組合)을 사용(使用)함으로써 정보검색(情報檢索)시스템의 성능(性能)을 상당히 향상(向上)시킬 수 있다는 것이다. 달리말해서, 파일들을 모으고 의미적(意味的)으로 관련(關聯)있는 모든 문헌(文獻)들을 함께 모아줌으로써, 유사조합(類似組合)(spurious association)의 문제(問題)를 상당히 해결(解決)할 수 있을 것이다. 실제적(實際的)으로, 본(本) 논문(論文)에서는 조합기법(組合技法)의 방법론(方法論)을 어떻게 생성(生成)할 수 있을 것인가를 고려했다. 자동용어(自動用語) 상관성(相關性)을 위하여 스타일(stiles)의 조합인자(組合因子)를 이용(利用)했으며 클러스터링 환경(環境)을 위해 커널기법(技法)(kernel method)을 사용(使用)했다.

  • PDF

색인어 군집화를 이용한 효율적인 병렬정보검색시스템 (Term Clustering and Interleaving for Parallel Information Retrieval)

  • 강재호;양재완;정성원;류광렬;권혁철;정상화
    • 한국지능정보시스템학회:학술대회논문집
    • /
    • 한국지능정보시스템학회 2002년도 춘계학술대회 논문집
    • /
    • pp.401-409
    • /
    • 2002
  • 인터넷과 같은 대량의 정보에 대응할 수 있는 고성능 정보검색시스템을 구축하기 위해서는 지금까지 고가의 중대형 컴퓨터를 주로 활용하여 왔으나, 최근 가격대 성능비가 높은 PC 클러스터 시스템을 활용하는 방안이 경제적인 대안으로 떠오르고 있다. PC 클러스터 상에서의 병렬정보검색시스템을 효율적으로 운영하기 위해서는 사용자가 입력한 질의를 처리하는데 요구되는 개별 PC의 디스크 I/O 및 검색관련 연산을 모든 PC에 가능한 균등하게 분배할 필요가 있다. 본 논문에서는 같은 질의에 동시에 등장할 가능성이 높은 색인어들끼리 군집 화하고 생성된 군집을 활용하여 색인어들을 각 PC에 분산저장함으로써 보다 높은 수준의 병렬화를 달성할 수 있는 방안을 제시한다. 대용량 말뭉치를 활용한 실험결과 본 논문에서 제시하는 분산저장기법이 충분한 효율성을 가지고 있음을 확인하였다.

  • PDF

2D-THI: XML 데이테베이스를 위한 이차원 타입상속 계층색인 (2D-THI: Two-Dimensional Type Hierarchy Index for XML Databases)

  • 이종학
    • 한국멀티미디어학회논문지
    • /
    • 제9권3호
    • /
    • pp.265-278
    • /
    • 2006
  • 본 논문에서는 XML 데이터베이스의 타입상속 계층에 대한 색인기법으로 이차원 색인구조를 이용하는 이차원 타입상속 색인기법인 2D-THI를 제안한다. XML 스키마는 타입상속을 지원하는 XML 문서를 위한 스키마 모델 중에 하나이다. 기존의 XML 데이터베이스를 위한 색인기법은 XML 스키마상의 타입상속 계층에 대한 XML 질의를 지원하지 못한다. 따라서 본 논문에서는 XML 질의의 타입상속 계층을 지원하기 위한 색인기법으로 다차원 파일구조를 이용하는 이차원 색인구조를 구성한다. 이차원 색인구조에서 한 축은 색인된 엘리먼트의 킷값 도메인으로 구성하고 다른 한 축은 타입상속 계층의 타입 식별자 도메인으로 구성한다. 이와 같은 이차원 색인구조를 이용함으로써 사용자 질의 패턴에 따라 두 도메인 사이에서 객인 엔트리들의 클러스터링 정도를 조정함으로써 질의처리의 성능을 향상시킬 수 있다. 본 논문에서 제안한 2D-THI의 성능 평가를 위하여, 비용 모델을 개발하고 이를 통하여 2D-THI를 기존의 객체지향 데이터베이스에서 사용하고 있는 CH-index와 CG-tree와 같은 클래스 계층 색인기법들과 색인의 성능을 비교평가 한다. 성능평가의 결과로서, CH-index와 CG-tree에서는 특정 형태의 XML 질의의 경우에만 좋은 성능을 보인 반면, 본 논문에서 제안한 2D-THI에서는 주어진 질의 형태에 따라 최적의 질의처리 성능을 제공할 수 있음을 보인다.

  • PDF

색상 그룹핑과 클러스터링을 이용한 회화 작품의 자동 팔레트 추출 (Automatic Color Palette Extraction for Paintings Using Color Grouping and Clustering)

  • 이익기;이창하;박재화
    • 한국정보과학회논문지:시스템및이론
    • /
    • 제35권7호
    • /
    • pp.340-353
    • /
    • 2008
  • 화풍을 효과적이고 객관적으로 기술하는 한 방법으로 팔레트 추출에 대한 수학적 모델을 제시한다. 이 모델에서는 팔레트를 허용 오차 범위 내에서 회화 작품의 영상을 표현할 수 있는 주요 색상의 집합으로 정의하고 색상 그룹핑과 주요 색상 추출의 두 단계를 거처 팔레트 색상을 추출한다. 색상 그룹핑은 주어진 회화에 대해 적응적으로 색의 분해능을 조절하여 각 회화 작품을 이루는 기초 색상을 추출하며 다음 주요 색상 추출 단계에서 이것과 이것이 차지하는 영역에 대한 정보를 바탕으로 K-Means 클러스터링 알고리즘을 적용하여 팔레트를 얻는다. 실험을 통해 유명 화가의 작품을 대상으로 RGB와 CIE LAB 색상 모델을 사용하여 추출한 팔레트를 3차원 색 공간에 표시하였다. 팔레트 색상의 거리를 사용한 화가 분류 실험과 실사 영상의 색채 변환 실험 통해 이 방법이 화풍 분석과 그래픽 분야에 적용될 수 있음을 확인하였다.

인물 기반 사진 색인을 위한 인물 특징 값 개발에 관한 연구 (Exploiting Person-identity Features for Person-based Photo Indexing)

  • 양승지;서경석;노용만;김상균
    • 방송공학회논문지
    • /
    • 제11권1호
    • /
    • pp.15-27
    • /
    • 2006
  • 본 논문에서는 일련의 디지털 사진들을 특정한 인물에 기반하여 브라우징 하는 것을 돕기 위한 인물 기반 사진 색인 방법을 제안한다. 기존의 인물 기반 영상 색인의 경우, 얼굴 특징값만을 인물 특정값으로 이용하였다. 이에 반하여, 제안하는 방법의 주 된 목적은 얼굴의 주변 정보인 상황 및 옷 정보를 얼굴 정보와 함께 조합하여 색인 과정에 활용함으로써 인물 기반 사진 색인 의 성능을 높이는 것이다 얼굴 특정값과 옷 특징값을 효과적으로 조합하기 위해, 인물을 상황 별로 클러스터링하는 방법이 함께 제안된다 본 논문에서 제안하는 방법의 효용성을 검증하기 위해 1120 장의 사진 데이터베이스를 활용하여 실험을 수행하였다. 실험 결과에서, 기존의 방법에서처럼 얼굴 특정값만을 이용하여 색인을 수행한 경우 약 70%의 평균 성능을 보였으며, 제안 된 방법을 이용하여 색인을 수행한 경우 약 92%의 평균 성능을 보여 제안된 방법이 인물 별 사진 색인에 효과적임을 확인할 수 있었다.

감성인식을 위한 이텐의 색채 조화 식별 (A Study on Speechreading about the Korean 8 Vowels)

  • 신성윤;최병석;이양원
    • 한국컴퓨터정보학회논문지
    • /
    • 제14권10호
    • /
    • pp.93-99
    • /
    • 2009
  • 비디오에서 색채가 즐거움을 주는 조화를 이루는지 알 방법이 없었다. 이러한 색채 조화를 식별함으로서 색채의 조화가 질서감, 명료성, 동류성, 대비성, 그리고 친근감 등을 준다. 따라서 색채 조화를 식별하는 것이 매우 중요하다. 색채 조화는 먼셀, 오스발트, 비렌, 문 스펜서, 이텐, 슈브뢸, 그리고 저드 등이 조화론을 내세워 색채가 조화를 이루는지 판별했다. 이러한 방법들 중 하나인 이텐의 색상환을 이용하여 2색, 3색, 4색, 5색, 그리고 6색의 색채 조화를 식별해보도록 한다. 식별에는 에지 추출, 레이블링 및 클러스터링, 그리고 색채 추출 및 조화 등이 이용된다. 이렇게 색채 조화를 식별함으로써 감성 데이터베이스 구축 및 감성 인식을 위한 기반을 마련한다.

상대적 부하 색인을 기반으로 한 이기종 워크스테이션 클러스터의 부하 균형 (Load Balancing of Heterogeneous Workstation Cluster based on Relative Load Index)

  • 지병준;이광모
    • 한국정보과학회논문지:컴퓨팅의 실제 및 레터
    • /
    • 제8권2호
    • /
    • pp.183-194
    • /
    • 2002
  • 이기종 워크스테이션 클러스터링은 응용 프로그램의 병렬 처리에 유용하며 비용 측면에서 효과적이다. 이기종 워크스테이션 클러스터링 환경에서 총작업반환시간을 최소화하기 위해서는 부하 균형 시스템이 필요하다. 기존의 부하 균형 방식은 각 워크스테이션의 처리능력에 가중치를 미리 부여하여 작업을 분배하는 정적방식이거나, 각 워크스테이션의 상대적 처리능력을 얻기 위해서 성능 테스트 프로그램을 수행하는 동적 방식이 있다. 수행되는 응용 프로그램과는 관계없는 성능 테스트 프로그램은 계산시간을 소비하고 총작업반환시간을 지연시킨다. 이 논문은 상대적 부하 색인에 기초한 효과적 작업 분배 방식과 작업 이주 방식을 제안하였으며 이기종 워크스테이션 클러스터 환경에서 부하 균형 시스스템을 설계 구현하였다. 이 논문에서 제안한 방식의 총작업반환시간을 실험을 통하여 부하 균형을 하지 않은 라운드 로빈 방식의 총작업반환시간과 성능 테스트 프로그램에 의한 부하 균형 방식의 총작업반환시간과 비교하였다. 실험 결과는 비교한 방식보다 제안 방식의 결과가 우수함을 보였다.

내용기반 음악정보 검색을 위한 선율의 시계열 데이터 변환을 이용한 주제선율색인 구성 (Construction of Theme Melody Index by Transforming Melody to Time-series Data for Content-based Music Information Retrieval)

  • 하진석;구경이;박재현;김유성
    • 정보처리학회논문지D
    • /
    • 제10D권3호
    • /
    • pp.547-558
    • /
    • 2003
  • 음악은 서로 다른 높이와 길이를 갖는 음표들을 주어진 박자 안에서 리듬성을 갖도록 나열한 패턴이기 때문에 음악의 선율정보는 시간의 흐름에 따라 정보 값을 갖는 시계열 데이터로 변환할 수 있다 따라서 본 연구에서는 음악의 특성을 유지하도록 선율정보를 정규화와 보정과정을 거쳐 시계열 데이터로 변환하고 유클리드 거리함수를 이용하여 선율정보간의 유사도를 계산하며, 유사성을 갖는 선율들을 클러스터링하여 각 클러스터의 대표성을 갖는 선율을 주제선율로서 추출한다. 그리고 추출된 주제선율로 다차원색인 기법인 M-tree를 이용하여 주제선율색인을 구성한다. 사용자 질의에 대한 검색과정에서도 색인 구성단계와 같은 과정으로 사용자 질의를 시계열 데이터로 변환하여 검색을 한다. 또한, 본 연구에서는 주제선율색인을 이용하여 내용기반 음악 검색을 실시하는 프로토타입 시스템을 개발하여 제안된 주제선율색인 구성기법의 실효성을 시험하였다. 실험결과에 따르면, 주제선율색인을 이용하면 원하는 음악 정보를 적은 공간을 사용하여 빠르고 정확하게 검색할 수 있음을 알 수 있다.

컬러-$x^2$ 명도 히스토그램기반 FCM 클러스터링을 이용한 비디오 분할 (Video Segmentation Using a $color-x^2$ intensity histogram-based FCM Clustering)

  • 이지현;강오형;나도원;이양원
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2005년도 추계학술발표대회 및 정기총회
    • /
    • pp.189-192
    • /
    • 2005
  • 비디오 분할의 목적은 같은 내용들을 가지는 프레임들의 순서를 표현하는 각 샷의 비디오 순서 분할을 위한 것이다. 그리고 색인에 대한 각 샷으로부터 키 프레임을 선택한다. 존재하는 비디오 분할 방법들은 2가지 그룹들로 분류될 수 있다. 먼저 경계값이 할당되어야만 하는 샷 전환 검출(SCD) 접근과 클러스터 수의 사전 지식이 요구되는 클러스터 접근이다. 본 논문에서는 컬러-$x^2$명도 히스토그램 기반 FCM(fuzzy c-means) 클러스터링 알고리즘을 사용하는 비디오 분할 방법을 제안하였다. 이 알고리즘은 앞에서 기술한 2가지 접근의 혼합이다. 그리고 이것은 두 가지 접근들의 결점을 극복하도록 설계 되었다. 실험 결과들은 컬러-$x^2$명도 히스토그램 기반 FCM 클러스링 알고리즘이 강건하고 비디오 시퀀스들의 다양한 형태들에 응용할 수 있다고 제안한다.

  • PDF

자연어를 이용한 자동정보검색시스템 구축에 관한 연구 (A Study of Designing the Automatic Information Retrieval System based on Natural Language)

  • 서휘
    • 한국문헌정보학회지
    • /
    • 제35권4호
    • /
    • pp.141-160
    • /
    • 2001
  • 본 연구에서는 자연어를 이용하여 자동으로 정보검색을 수행하는 시스템을 구축하였다. 구현 시스템은 Delphi 4.0(PASCAL)으로 프로그래밍 하였으며, 자동색인, 클러스터링 기법, 자연어 계층관계의 구축과 표현, 자동정보탐색이 가능하도록 구성했다. 이 시스템을 이용하여 질의어의 표현, 생성, 확장, 탐색식의 구성, 피드백 탐색 등 정보탐색의 전과정을 자동으로 수행할 수 있었다.

  • PDF