• 제목/요약/키워드: Similarity Query

검색결과 246건 처리시간 0.026초

영상 형태 특징을 이용한 내용 기반 검색 시스템 (Content-based Retrieval System using Image Shape Features)

  • 황병곤;정성호;이상열
    • 한국산업정보학회논문지
    • /
    • 제6권1호
    • /
    • pp.33-38
    • /
    • 2001
  • 본 논문에서는 영상의 형태 특징을 이용한 영상 검색 시스템을 제안한다. 형태특징을 얻기 위해서 먼저 체인코드를 이용하여 경계선 추출을 추출하였다. 형태특징으로 객체의 경계선과 무게중심까지의 합, 표준편차 그리고 객체의 장축과 단축 비율 등을 추출하였다. 이러한 형태특징 정보를 이용하여 데이터 베이스에 저장된 영상과 질의 영상을 비교하여 유사도 순위에 따라 후보 영상들을 검색하였다. 본 실험의 결과 크기, 회전 이동 등의 변화에 둔감하였다. 약 170개의 폐곡선을 이루는 영상에 대한 검색 실험을 통하여 모양 정보에 대한 정확도를 측정하였다. 실험 결과 평균 Recall/Precision이 0.72/0.83를 보임으로써 제안된 방법이 유용함을 보였다.

  • PDF

히스토그램 보간에 의한 영상 검색 (Image Search Using Interpolated Color Histograms)

  • 이효종
    • 정보처리학회논문지B
    • /
    • 제9B권5호
    • /
    • pp.701-706
    • /
    • 2002
  • 영상의 색상 정보는 비슷한 영상들의 유사도를 효과적으로 측정하는데 사용된다. 그러나, 색상정보의 크기는 영상 데이터베이스에서 효율적으로 다루기에는 너무나 방대하다. 본 논문에서는 히스토그램 보간법에 의하여 유사한 영상들을 검색하는 새로운 방법을 제시한다 알고리즘의 기본 원리는 색상 히스토그램의 분포를 이용하여 영상을 검색하는 기존 방법에서 출발한다. 그러나, 질의 영상과 대상 영상과의 유사도를 결정하는데 있어서 보간법에 의하여 히스토그램의 분포도를 간략화 시킨다는 근본적인 차이를 가지고 있다. 색상 히스토그램의 분포는 최적 차수의 다항식으로 보간되어서 표현되었다. 히스토그램의 분포가 보간된 후에는 저차원 다항식의 계수들만이 색상 구분자로서 데이터베이스에 저장되고 검색하는데 활용될 수 있다. 제안된 방법은 실제 영상들에 적용되었으며 만족할 만한 결과를 보여주고 있다.

A Dynamic Locality Sensitive Hashing Algorithm for Efficient Security Applications

  • Mohammad Y. Khanafseh;Ola M. Surakhi
    • International Journal of Computer Science & Network Security
    • /
    • 제24권5호
    • /
    • pp.79-88
    • /
    • 2024
  • The information retrieval domain deals with the retrieval of unstructured data such as text documents. Searching documents is a main component of the modern information retrieval system. Locality Sensitive Hashing (LSH) is one of the most popular methods used in searching for documents in a high-dimensional space. The main benefit of LSH is its theoretical guarantee of query accuracy in a multi-dimensional space. More enhancement can be achieved to LSH by adding a bit to its steps. In this paper, a new Dynamic Locality Sensitive Hashing (DLSH) algorithm is proposed as an improved version of the LSH algorithm, which relies on employing the hierarchal selection of LSH parameters (number of bands, number of shingles, and number of permutation lists) based on the similarity achieved by the algorithm to optimize searching accuracy and increasing its score. Using several tampered file structures, the technique was applied, and the performance is evaluated. In some circumstances, the accuracy of matching with DLSH exceeds 95% with the optimal parameter value selected for the number of bands, the number of shingles, and the number of permutations lists of the DLSH algorithm. The result makes DLSH algorithm suitable to be applied in many critical applications that depend on accurate searching such as forensics technology.

대용량 데이터베이스에서 다차원 인덱스를 사용한 효율적인 다단계 k-NN 검색 (Efficient Multi-Step k-NN Search Methods Using Multidimensional Indexes in Large Databases)

  • 이상훈;김범수;최미정;문양세
    • 정보과학회 논문지
    • /
    • 제42권2호
    • /
    • pp.242-254
    • /
    • 2015
  • 본 논문에서는 다차원 인덱스 기반 다단계 k-NN 검색의 성능 향상 문제를 다룬다. 기존 다단계 k-NN 검색에서는 고차원 객체의 저차원 변환으로 인한 정보 손실로 k-NN 질의 결과 매우 큰 허용치(검색 범위)가 결정되어 범위 질의 결과로 많은 후보가 검색된다. 또한, 많은 후보는 후처리 과정에서 매우 많은 I/O 및 CPU 오버헤드를 발생시킨다. 본 논문에서는 이와 같은 고찰에 기반하여 범위 질의의 허용치를 줄여 후보 개수를 줄이고 이를 통해 성능을 향상시키는 방법을 제안한다. 먼저, k-NN 질의 결과로 결정된 허용치를 고차원 및 저차원 객체간 거리 비율로 강제 축소하여 범위 질의에 사용하는 허용치 축소 (근사적) 해결책을 제안한다. 다음으로, k-NN 질의 계수 k 대신 c k 를 사용하여 얻은 보다 타이트(tight)한 허용치로 범위 질의를 수행하는 계수 제어 (정확한) 해결책을 제안한다. 실제 객체 데이터를 사용하여 실험한 결과, 제안한 두 가지 해결책은 기존 다단계 k-NN 검색에 비해 후보 개수와 검색 시간 모두를 크게 향상시킨 것으로 나타났다.

MPEG-7 시각 정보 기술자의 인덱싱 및 결합 알고리즘 (Algorithms for Indexing and Integrating MPEG-7 Visual Descriptors)

  • 송치일;낭종호
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제34권1호
    • /
    • pp.1-10
    • /
    • 2007
  • 본 논문에서는 MPEG-7 시각 정보 기술자인 Dominant Color와 Contour Shape 기술자에 대한 새로운 인덱싱 알고리즘을 제안한다. Dominant Color 기술자에서 사용되는 비교 연산 식은 가우스 혼합 모델에 기초하고 있기 때문에 기술자의 각 속성들을 하나의 칼라 히스토그램 형태로 변형시켜서 인덱스로 사용한다. Contour Shape 기술자는 두 단계 형태의 알고리즘을 사용하는데, 첫 번째 단계에서는 글로벌 변수인 Eccentricity와 Circularity를 사용한 대략적인 비교를 통해서 비슷하지 않은 이미지 오브젝트를 배제시키고 두 번째 단계에서 남겨진 오브젝트들과 질의 오브젝트들간의 Peak 변수를 사용한 비교 연산을 통해 인덱싱을 수행한다. 또한 본 논문은 효율적인 멀티미디어 데이타 검색을 위해서 두 가지의 MPEG-7 시각 정보 기술자 결합 알고리즘을 제안한다. 첫 번째 결합 알고리즘은 가중치를 확률로 변환해서 반영하는 것이고 두 번째는 가중치를 각 비교 연산 결과값의 중요도로 간주하는 방법이다. 실험을 통해서 결과를 분석해 보면 근사화를 통한 인덱스 생성으로 100%의 정확도를 유지 할 수는 없지만 논문에서 제안된 각 기술자의 인덱싱 알고리즘과 기술자들의 결합 알고리즘은 기본 검색 알고리즘과 비교했을 때 매우 빠른 속도 향상을 보여주었다. 본 논문에서 제안된 알고리즘은 MPEG-7을 사용하는 검색 시스템의 데이타베이스 구축에 효율적으로 사용될 수 있다.

CS-트리 : 고차원 데이터의 유사성 검색을 위한 셀-기반 시그니쳐 색인 구조 (CS-Tree : Cell-based Signature Index Structure for Similarity Search in High-Dimensional Data)

  • 송광택;장재우
    • 정보처리학회논문지D
    • /
    • 제8D권4호
    • /
    • pp.305-312
    • /
    • 2001
  • 최근 고차원 색인 구조들이 멀티미디어 데이터베이스, 데이터 웨어하우징과 같은 데이터베이스 응용에서 유사성 검색을 위해 요구된다. 본 논문에서는 고차원 특징벡터에 대한 효율적인 저장과 검색을 지원하는 셀-기반 시그니쳐 트리(CS-트리)를 제안한다. 제안하는 CS-트리는 고차원 특징 벡터 공간을 셀로써 분할하여 하나의 특징 벡터를 그에 해당되는 셀의 시그니쳐로 표현한다. 특징 벡터 대신 셀의 시그니쳐를 사용함으로써 트리의 깊이를 줄이고, 그 결과 효율적인 검색 성능을 달성한다. 또한 셀에 기반하여 탐색 공간을 효율적으로 줄이는 유사성 검색 알고리즘을 제시한다. 마지막으로 우수한 고차원 색인 기법으로 알려져 있는 X-트리와 삽입시간, k-최근접 질의에 대한 검색 시간 그리고 부가저장 공간 측면에서 성능 비교를 수행한다. 성능비교 결과 CS-트리가 검색 성능에서 우수함을 보인다.

  • PDF

공간 히스토그램과 웨이브렛 모멘트의 융합에 의한 영상검색 (Image Retrieval Using the Fusion of Spatial Histogram and Wavelet Moments)

  • 서상용;김남철
    • 대한전자공학회논문지SP
    • /
    • 제38권4호
    • /
    • pp.434-441
    • /
    • 2001
  • 본 논문에서는 공간 히스토그램과 웨이브렛 모멘트를 융합하여 검색 효율을 크게 향상시키는 방법을 제안한다. 이 방법에서는 질의영상과 DB영상간의 유사도를 구할 때 히스토그램의 유사도와 웨이브렛 모멘트의 유사도를 효과적으로 융합한다. 즉, 공간적 이동, 회전 등에 강한 히스토그램 특징과 주파수 대역별로 구해지는 웨이브렛 모멘트 특징을 잘 융합함으로써 검색성능의 향상을 추구한다. 제안한 방법의 성능을 평가하기 위한 시험영상 DB로는 Brodatz 질간 영상 DB와 Corel Draw Photo 영상 DB를 사용하였다. 실험 결과, 제안한 방법으로 구한 검색율이 Brodatz DB에서 히스토그램이나 웨이브렛 모멘트만으로 구한 검색율보다 각각 5.3%와 13.8% 향상되었고, Corel Draw Photo DB에서는 각각 15.5%와 3.2% 향상됨을 확인할 수 있었다.

  • PDF

Complete Sequence of a Gene Encoding KAR3-Related Kinesin-like Protein in Candida albicans

  • Kim Min-Kyoung;Lee Young Mi;Kim Wankee;Choi Wonja
    • Journal of Microbiology
    • /
    • 제43권5호
    • /
    • pp.406-410
    • /
    • 2005
  • In contrast to Saccharomyces cerevisiae, little is known about the kinesin-like protein (KLP) in Candida albicans. The motor domain of kinesin, or KLP, contains a subregion, which is well conserved from yeast to humans. A similarity search, with the murine ubiquitous kinesin heavy chain region as a query, revealed 6 contigs that contain putative KLPs in the genome of C. albicans. Of these, the length of an open reading (ORF) of 375 amino acids, temporarily designated CaKAR3, was noticeably short compared with the closely related S. cerevisiae KAR3 (ScKAR3) of 729 amino acids. This finding prompted us to isolate a ${\lambda}$ genomic clone containing the complete CaKAR3 ORF, and here the complete sequence of CaKAR3 is reported. CaKAR3 is a C-terminus motor protein, of 687 amino acids, encoded by a non-disrupting gene. When compared with ScKAR3, the amino terminal region of 112 amino acids was unique, with the middle part of the 306 amino acids exhibiting $25\%$ identity and $44\%$ similarity, while the remaining C-terminal motor domain exhibited $64\%$ identity and $78\%$ similarity, and have been submitted to GeneBank under the accession number AY182242.

CRM을 위한 은닉 마코프 모델과 유사도 검색을 사용한 시계열 데이터 예측 (Time-Series Data Prediction using Hidden Markov Model and Similarity Search for CRM)

  • 조영희;전진호;이계성
    • 한국컴퓨터정보학회논문지
    • /
    • 제14권5호
    • /
    • pp.19-28
    • /
    • 2009
  • 시계열의 예측에 대한 문제는 오랫동안 많은 연구자들의 연구의 대상이었으며 예측을 위한 많은 방법이 제안되었다. 본 논문에서는 은닉 마코프 모델(Hidden Markov Model)과 우도(likelihood)를 사용한 유사도 검색을 통하여 향후 시계열 데이터의 운행 방향을 예측하는 방법을 제안한다. 이전에 기록된 시계열 데이터에서 질의 시퀸스(sequence)와 유사한 부분을 검색하고 유사 부분의 서브 시퀸스를 사용하여 시계열을 예측하는 방법이다. 먼저 주어진 질의 시퀸스에 대한 은닉 마코프 모델을 작성한다. 그리고 시계열 데이터에서 순차적으로 일정 길이의 서브 시퀸스를 추출하고 추출된 서브 시퀸스와 작성된 은닉 마코프 모델과의 우도를 계산한다. 시계열 데이터로부터 추출된 서브 시퀸스 중에서 우도가 가장 높은 시퀸스를 유사 시퀸스로 결정하고 결정된 부분 이후의 값을 추출하여 질의 시퀸스 이후의 예측 값을 추정한다. 실험 결과 예측 값과 실제 값이 상당한 유사성을 나타내었다. 제안된 방법의 유효성은 코스피(KOSPI) 종합주가지수를 대상으로 실험하여 검증한다.

개선된 chain code와 HMM을 이용한 내용기반 영상검색 (Content-based Image Retrieval using an Improved Chain Code and Hidden Markov Model)

  • 조완현;이승희;박순영;박종현
    • 대한전자공학회:학술대회논문집
    • /
    • 대한전자공학회 2000년도 제13회 신호처리 합동 학술대회 논문집
    • /
    • pp.375-378
    • /
    • 2000
  • In this paper, we propose a novo] content-based image retrieval system using both Hidden Markov Model(HMM) and an improved chain code. The Gaussian Mixture Model(GMM) is applied to statistically model a color information of the image, and Deterministic Annealing EM(DAEM) algorithm is employed to estimate the parameters of GMM. This result is used to segment the given image. We use an improved chain code, which is invariant to rotation, translation and scale, to extract the feature vectors of the shape for each image in the database. These are stored together in the database with each HMM whose parameters (A, B, $\pi$) are estimated by Baum-Welch algorithm. With respect to feature vector obtained in the same way from the query image, a occurring probability of each image is computed by using the forward algorithm of HMM. We use these probabilities for the image retrieval and present the highest similarity images based on these probabilities.

  • PDF