• 제목/요약/키워드: 패턴 매칭 알고리즘

검색결과 156건 처리시간 0.028초

시계열 데이터베이스에서 인덱스 보간법을 기반으로 정규화 변환을 지원하는 서브시퀀스 매칭 알고리즘 (An Index Interpolation-based Subsequence Matching Algorithm supporting Normalization Transform in Time-Series Databases)

  • 노웅기;김상욱;황규영
    • 한국정보과학회논문지:데이타베이스
    • /
    • 제28권2호
    • /
    • pp.217-232
    • /
    • 2001
  • 본 논문에서는 시계열 데이터베이스에서 정규화 변환을 지원하는 서브시퀀스 매칭 알고리즘을 제안한다. 정규화 변환을 시계열 데이터 간의 절대적인 유클리드 거리에 관계 없이, 구성하는 값들의 상대적인 변화 추이가 유사한 패턴을 갖는 시계열 데이터를 검색하는 데에 유용하다. 기존의 서브시퀀스 매칭 알고리즘을 확장 없이 정규화 변환 서브시퀀스 매칭에 단순히 응용할 경우, 질의 결과로 반환되어야 할 서부시퀀스를 모두 찾아내지 못하는 착오 기각이 발생한다. 또한, 정규화 변환을 지원하는 기존의 전체 매칭 알고리즘의 경우, 모든 가능한 질의 시퀀스 길이 각각에 대하여 하나씩의 인덱스를 생성하여야 하므로, 저장 공간 및 데이터 시퀀스 삽입/삭제의 부담이 매우 심각하다. 본 논문에서는 인덱스 보간법을 이용하여 문제를 해결한다. 인덱스 보간법은 인덱스가 요구되는 모든 경우 중에서 적당한 간격의 일부에 대해서만 생성된 인덱스를 이용하며, 인덱스가 필요한 모든 경우에 대한 탐색을 수행하는 기법이다. 제안된 알고리즘은 몇 개의 질의 시퀀스 길이에 대해서만 각각 인덱스를 생성한 후, 이를 이용하여 모든 가능한 길이의 질의 시퀀스에 대해서 탐색을 수행한다. 이때, 착오 기각이 발생하지 않음을 증명한다. 제안된 알고리즘은 질의 시에 주어진 질의 시퀀스의 길이에 따라 생성되어 있는 인덱스 중에서 가장 적절한 것을 선택하여 탐색을 수행한다. 이때, 생성되어 있는 인덱스의 개수가 많을수록 탐색 성능이 향상된다. 필요에 따라 인덱스의 개수를 변화함으로써 탐색 성능과 저장 공간 간의 비율을 유연하게 조정할 수 있다. 질의 시퀀스의 길이 256 ~ 512중 다섯 개의 길이에 대해 인덱스를 생성하여 실험한 결과, 탐색 결과 선택률이 $10^{-2}$일 때 제안된 알고리즘의 탐색 성능이 순차 검색에 비하여 평균 2.40배, 선택률이 $10^{-5}$일 때 평균 14.6배 개선되었다. 제안된 알고리즘의 탐색 성능은 탐색 결과 선택률이 작아질수록 더욱 향상되므로, 실제 데이터베이스 응용에서의 효용성이 높다고 판단된다.

  • PDF

선택적 패턴블럭 신경회로망을 이용한 불특정 화자 인식 (A Study on Unspecified Speaker Recognition by Selective Pattern-Block Neural Network)

  • 강명광
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1995년도 제12회 음성통신 및 신호처리 워크샵 논문집 (SCAS 12권 1호)
    • /
    • pp.96-99
    • /
    • 1995
  • 본 연구는 특징 파라메터의 특성을 고려한 신경회로망에 관한 연구로서 패턴블럭 선택적 신경회로망을 제안하고, 제안한 신경회로망의 성능을 평가하기 위하여 한국어 단모음에 대한 불특정 화자 인식 실험을 하였다. 각 패턴에 따른 특징 파라메터의 변화를 고려하지 않은 기존의 패턴매칭 알고리즘에 비하여 제안된 신경회로망은 인가된 패턴을 파라메터의 특성에 맞게 몇 개의 부패턴으로 분할한 후 가장 최적의 부패턴을 선택하여 학습하고 인지하는 것이 그 특성이다.

  • PDF

SOFM 신경회로망을 이용한 한국어 음소 인식 (Korean Phoneme Recognition Using Self-Organizing Feature Map)

  • 전용구
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1993년도 학술논문발표회 논문집 제12권 1호
    • /
    • pp.233-237
    • /
    • 1993
  • 본 논문에서는 패턴 매칭 방법에 근거하여 인식 단위가 음소인 음소 기반 인식 시스템을 구성하였다. 선택한 신경망 구조는 생물학적 신경망인 코호넨(T. Kohonen)의 SOFM(Self-Organizing Feature Map)으로 패턴 매칭 과정 중 cluster로 사용하였다. SOFM 신경망은 신호 공간에 대해서 최적의 국소(局所) 해부적 사사에 의한 자기 조직화 과정을 수행하며, 그 결과 인식 문제에 있어서 상당히 높은 정확도를 나타낸다. 따라서 SOFM 신경망은 음소 인식에도 효과적으로 응용될 수 있다. 또한 음소 인식 시스템의 성능 향상을 위해 K-means 클러스터링 알고리즘이 결합된 학습 알고리즘을 제안하였다. 제안된 음소 인식 시스템의 성능을 평가하기 위해, 먼저, 우리말 음소들을 모음, 파열음, 마찰음, 파찰음, 유음 및 비음, 종성의 6개 음소군으로 분류하고 각 음소군에 대한 특징 지도를 구성하여 labeler의 기능을 수행하게 하였다. 화자 종속 인식실험 결과 87.2%의 인식률을 보였으며 제안한 학습법의 빠른 수렴성과 인식률 향상을 확인하였다.

  • PDF

컨텍스트 인식 기반 개인화 추천 서비스를 위한 사용자 행동패턴 추론 모델 (A Model to Infer Users' Behavior Patterns for Personalized Recommendation Service based Context-Awareness)

  • 서효석;이상용
    • 디지털융복합연구
    • /
    • 제10권2호
    • /
    • pp.293-297
    • /
    • 2012
  • 컨텍스트 인식 환경에서 개인화 추천 서비스를 제공하기 위해서는 수집된 컨텍스트 정보를 빠르게 분석하고, 효과적으로 사용자의 목적을 추론할 수 있어야 한다. 그러나 모바일 장비에서 수집되는 컨텍스트는 환경에 따라 데이터의 차이가 발생함으로 인해 기존의 추론 알고리즘을 그대로 적용하기에는 적합하지 않고 모바일 환경에 적합한 효율적인 알고리즘이 필요하다. 본 연구에서는 정보의 누락이나 오류 등으로 인한 손실을 최소화하기 위해 나이브 베이즈 분류기를 사용하여 행동 패턴을 분류하였다. 또한 사용자의 성향을 효과적으로 학습하고 행동 목적을 추론하기 위하여 패턴 매칭 기법을 시용하였다. 제안한 개인화 추천 서비스 시스템을 스마트폰에서 어플리케이션을 추천하는 서비스를 적용하여 정확도를 평가하였다.

YARA 속도 개선을 위한 새로운 S/W 구조설계 (A New S/W Architecture for YARA Speed Enhancement)

  • 김창훈
    • 한국통신학회논문지
    • /
    • 제41권12호
    • /
    • pp.1858-1860
    • /
    • 2016
  • 논문에서는 YARA의 스캐닝 스레드 알고리즘을 개선하여 다수의 룰 파일 패턴 매칭을 수행할 수 있는 새로운 소프트웨어 구조를 제안한다. 제안하는 방식은 기존의 YARA에 비해 매칭을 위한 룰 파일의 메모리 적재 횟수를 감소시킨다. 따라서 제안된 구조를 적용할 경우 메모리 사용량은 룰 파일의 개수에 비례하여 증가하지만 패턴 매칭 수행에 따른 시간을 감소시킬 수 있다.

유전 알고리즘을 이용한 퍼지 패턴 매칭 분류기의 설계와 응용 (A design of fuzzy pattern matching classifier using genetic algorithms and its applications)

  • 정순원;박귀태
    • 전자공학회논문지B
    • /
    • 제33B권1호
    • /
    • pp.87-95
    • /
    • 1996
  • 본 논문에서는 새로운 퍼지 패턴 매칭 분류기(fuzzy pattern matching classifier) 설계 방법을 제안하였다. 기존의 퍼지 패턴 매칭 분류기를 설계함에 있어 분류기의 성능에 결정적인 영향을 미치는 소속 함수 (membership functions)의 모양과 개수에 대한 정확한 정보를 알 수 없었다. 따라서 소속 함수를 구하기 위하여 시행 착오(trial-error)법 혹은 경험에 의존하는(heuristic) 방법이 사용되어 왔다. 그러나 이러한 방법은 다양한 종류의 패턴에 대하여 적용하기에는 한계가 있다. 본 논문에서는 유전 알고리즘을 사용하여 분류 에러를 최소로 줄이는 소속 함수의 적절한 모양과 개수를 찾기 위한 새로운 방법을 제안한다. 유전 알고리즘(genetic algorithms)은 진화라는 생물학적 모델을 기초로한 통계적 알고리즘의 한 부류이다. 이는 여러 함수 최적화 문제에 적용되어 최적 혹은 최적 근처의 해를 찾아 준다. 본 논문에서 유전 알고리즘은 분류 에러에 반비례하는 적합도 함수(fitness function)를 기본으로 소속 함수의 모양과 개수를 결정하는데 쓰인다. 유전 알고리즘에 있어서의 스트링은 소속 함수를 결정하게 되며 인식 결과는 다음 세대의 재생(reproduction) 연산에 영향을 미치게 된다. 제안되는 방법을 타이어 접지면 패턴과 필기체 영문자 인식에 적용하여 보았다. 실험 결과는 본 방법이 유용함을 보여준다.

  • PDF

영상의 색상 분포 정합을 이용한 얼굴 검출 알고리즘 (Face Detection Algorithm Using Color Distribution Matching)

  • 권성근
    • 한국멀티미디어학회논문지
    • /
    • 제16권8호
    • /
    • pp.927-933
    • /
    • 2013
  • OpenCV (Open Computer Vision)에서 제공하는 얼굴 인식 알고리즘에서는 Haar 특징(Haar feature)들과 대상 영상의 정합 과정인 Haar 매칭 (Haar Matching)을 통하여 얼굴을 검출하는데, 이때 Haar 특징들은 정면 얼굴로 구성된 훈련 영상을 통해 학습된다. 따라서 OpenCV의 얼굴 검출 방법은 정면 얼굴에 대해서는 높은 얼굴 검출율을 보이지만, 정면을 응시하지 않거나 얼굴의 형태가 변형된 경우에는 얼굴을 정확하게 검출하지 못하는 경우가 빈번히 발생한다. 본 논문에서는 측면 얼굴 혹은 형태가 변형된 얼굴에서도 컬러 히스토그램의 분포 특성은 유사하다고 가정하고, 히스토그램 패턴 매칭(histogram pattern matching)을 이용한 얼굴 검출 방법을 제안한다. 제안한 방법에서는 Haar 매칭 오류가 발생한 프레임에 대하여, 정확하게 검출된 이전 프레임의 얼굴 영역에 대한 히스토그램 패턴 매칭을 통하여 가장 유사한 히스토그램 분포를 갖는 영역을 얼굴로 인식한다. 제안한 방법의 얼굴 검출 알고리즘의 성능을 평가하기 위한 모의실험에서 제안한 얼굴 검출 방법이 OpenCV보다 얼굴 검출율이 8% 정도 향상됨을 확인하였다.

수정된 LVQ2 알고리즘을 이용한 음소분류 (Phoneme Classification using the Modified LVQ2 Algorithm)

  • 김홍국;이황수
    • The Journal of the Acoustical Society of Korea
    • /
    • 제12권1E호
    • /
    • pp.71-77
    • /
    • 1993
  • 패턴매칭 기법에 근거한 음성 인식 시스템은 크게 clustering 과정과 labeling 과정으로 구성된다. 본 논문에서는 Kohonen의 featrue map 알고리즘과 LVQ2 알고리즘을 각각 clusterer와 labeler로 하는 음소인식 시스템을 구성한다. 구성된 인식시스템의 성능을 향상시키기 위해서 수정된 LVQ2알고리즘(MLVQ2)을 제안한다. MLVQ2는 selective learning, LVQ2, perturbed LVQ2 그리고 기존의 LVQ2의 4단계 학습과정으로 구성된다. 제안된 음소 인식 알고리즘의 성능을 평가하기 위하여 LVQ2와 MLVQ2를 각각 사용하여 6가지의 한국어 음소군에 대한 feature map을 만든다. 음소인식 실험결과, LVQ2와 MLVQ2를 사용하는 경우 각각 60.5%와 65.4%의 인식률을 얻을 수 있었다.

  • PDF

시계열 데이타베이스의 인덱스 보간법을 기반으로 정규화 변환을 지원하는 서브시퀀스 매칭 알고리즘 (An Index-Based Subsequence Matching Algorithm Supporting Normalization Transform in Time-Series Databases)

  • 노웅기;감상욱;황규영
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2000년도 봄 학술발표논문집 Vol.27 No.1 (B)
    • /
    • pp.152-154
    • /
    • 2000
  • 본 논문에서는 시계열 데이터베이스에서 정규화 변환을 지원하는 서브시퀀스 매칭 알고리즘을 제안한다. 정규화 변환은 시계열 데이터간의 절대적인 유클리드 거리에 관계없이, 구성하는 값들의 상대적인 변화 추이가 유사한 패턴을 갖는 시계열 데이터를 검색하는 데에 유용하다. 제안된 알고리즘은 몇 개의 질의 시퀀스 길이에 대해서만 각각 인덱스를 생성한 후, 이를 이용하여 모든 가능한 길이의 질의 시퀀스에 대해서 탐색을 수행한다. 이때, 착오 기각이 발생하지 않음을 증명한다. 본 논문에서는 이와 같이 인덱스가 요구되는 모든 경우 중에서 적당한 간격의 일부에 대해서만 생성된 인덱스를 이용한 탐색 기법을 인덱스 보간법이라 부른다. 질의 시퀀스의 길이 256~512 중 다섯 개의 길이에 대해 인덱스를 생성하여 실험한 결과, 탐색 결과를 선택률이 10-5일 때 제안된 알고리즘의 탐색 성능이 순차 검색에 비하여 평균 14.6배 개선되었다.

  • PDF

음절 복원 알고리즘을 이용한 핵심어 오류 보정 시스템 (Key-word Error Correction System using Syllable Restoration Algorithm)

  • 안찬식;오상엽
    • 한국컴퓨터정보학회논문지
    • /
    • 제15권10호
    • /
    • pp.165-172
    • /
    • 2010
  • 어휘 인식 시스템의 오류 보정방법으로는 오류 패턴매칭 기반 방법과 어휘의미 패턴 기반방법이있으며, 이들 방법에서는 오류 보정을 위해 핵심어를 의미적으로 분석하지 못하는 문제점을 가지고 있다. 이를 개선하기 위해 본 논문에서는 음절 복원 알고리즘을 이용한 핵심어 오류 보정 시스템을 제안한다. 인식된 음소 열을 의미 분석 과정을 거쳐 음소가 갖는 의미를 파악하고 음절 복원 알고리즘을 통해 음운 변동이 적용되기 이전의 문자열로 복원하므로 핵심어를 명확히 분석하고 오인식을 줄일 수 있다. 시스템 분석을 위해 음소 유사율과 신뢰도를 이용하여 오류 보정율을 구하였으며, 어휘 인식 과정에서 오류로 판명된 어휘에 대하여 오류 보정을 수행하였다. 에러 패턴 학습을 이용한 방법과 오류 패턴 매칭 기반 방법, 어휘 의미 패턴 기반 방법의 성능 평가 결과 3.0%의 인식 향상율을 보였다.