• 제목/요약/키워드: GMM

검색결과 543건 처리시간 0.026초

Mahalanobis 거리측정 방법 기반의 GMM-Supervector SVM 커널을 이용한 화자인증 방법 (Speaker Verification Using SVM Kernel with GMM-Supervector Based on the Mahalanobis Distance)

  • 김형국;신동
    • 한국음향학회지
    • /
    • 제29권3호
    • /
    • pp.216-221
    • /
    • 2010
  • 본 논문에서는 Gaussian Mixture Model (GMM)-supervector의 Mahalanobis 거리측정 방법 기반의 Support Vector Machine (SVM) 커널을 이용한 새로운 화자인증 방법을 제안한다. 제안된 GMM-supervector SVM 커널방식은 GMM 방식과 SVM 방식을 결합한 방식으로서, GMM 파라미터에 의해 형성된 화자 및 비 화자 GMM-supervectors의 화자인증 임계값을 Mahalanobis 거리측정 방법기반의 SVM 커널에 적용함으로써 화자인증 정확도를 높인다. 제안한 방식의 성능 측정을 위해 20명의 화자를 대상으로 문장독립형 화자인증 실험을 수행하여 기존에 사용되고 있는 GMM, SVM, Kullback-Leibler (KL) divergence 거리측정 방법 기반의 GMM-supervector SVM 커널, Bhattacharyya 거리측정 방법기반의 GMM-supervector SVM 커널 방식을 통한 화자인증 결과들과 비교하였다.

수정된 EM알고리즘을 이용한 GMM 화자식별 시스템의 성능향상 (Performance Enhancement of Speaker Identification System Based on GMM Using the Modified EM Algorithm)

  • 김성종;정익주
    • 음성과학
    • /
    • 제12권4호
    • /
    • pp.31-42
    • /
    • 2005
  • Recently, Gaussian Mixture Model (GMM), a special form of CHMM, has been applied to speaker identification and it has proved that performance of GMM is better than CHMM. Therefore, in this paper the speaker models based on GMM and a new GMM using the modified EM algorithm are introduced and evaluated for text-independent speaker identification. Various experiments were performed to evaluate identification performance of two algorithms. As a result of the experiments, the GMM speaker model attained 94.6% identification accuracy using 40 seconds of training data and 32 mixtures and 97.8% accuracy using 80 seconds of training data and 64 mixtures. On the other hand, the new GMM speaker model achieved 95.0% identification accuracy using 40 seconds of training data and 32 mixtures and 98.2% accuracy using 80 seconds of training data and 64 mixtures. It shows that the new GMM speaker identification performance is better than the GMM speaker identification performance.

  • PDF

음소별 GMM을 이용한 화자식별 (Speaker Identification using Phonetic GMM)

  • 권석봉;김회린
    • 대한음성학회:학술대회논문집
    • /
    • 대한음성학회 2003년도 10월 학술대회지
    • /
    • pp.185-188
    • /
    • 2003
  • In this paper, we construct phonetic GMM for text-independent speaker identification system. The basic idea is to combine of the advantages of baseline GMM and HMM. GMM is more proper for text-independent speaker identification system. In text-dependent system, HMM do work better. Phonetic GMM represents more sophistgate text-dependent speaker model based on text-independent speaker model. In speaker identification system, phonetic GMM using HMM-based speaker-independent phoneme recognition results in better performance than baseline GMM. In addition to the method, N-best recognition algorithm used to decrease the computation complexity and to be applicable to new speakers.

  • PDF

MFCC를 이용한 GMM 기반의 음성/혼합 신호 분류 (Speech/Mixed Content Signal Classification Based on GMM Using MFCC)

  • 김지은;이인성
    • 전자공학회논문지
    • /
    • 제50권2호
    • /
    • pp.185-192
    • /
    • 2013
  • 본 논문에서는 MFCC를 이용한 GMM 기반의 음성과 혼합 신호 분류 알고리즘을 MPEG의 표준 코덱인 USAC에 적용하였다. 효과적인 패턴 인식을 위해 GMM을 이용하였고, EM알고리즘을 사용하여 최적의 GMM 파라미터를 추출하였다. 제안하는 분류 알고리즘은 두 가지 중요한 부분으로 나뉜다. 첫째는 GMM을 통해 최적의 파라미터를 추출하는 것 이고, 두 번째는 MFCC 값을 이용한 패턴인식을 통해 음성/혼합 신호를 분류하였다. 제안된 알고리즘의 성능을 평가한 결과 MFCC를 이용한 GMM 기반의 제안된 방법이 기존 USAC의 방법보다 우수한 음성/혼합 신호 분류 성능을 보였다.

확산모형에 대한 일반화적률추정법의 개선 (Improved Generalized Method of Moment Estimators to Estimate Diffusion Models)

  • 최영수;이윤동
    • 응용통계연구
    • /
    • 제26권5호
    • /
    • pp.767-783
    • /
    • 2013
  • 일반화적률추정법(GMM)은 금융자료에 대한 모형모수의 추정에 자주 이용되는 방법이다. 특히 GMM은 현대금융 공학 이론의 기본을 이루는 확산모형의 추정에도 매우 자주 사용된다. 그러나 최근의 연구에서 GMM은 확산모형의 모수, 특히 확산계수에 관계되는 모수의 추정에 있어서 그 성능이 좋지 못함이 지적되었다. 본 연구에서는 GMM의 이러한 단점을 개선하기 위한 대안적 방법들을 제시하고 그 통계적 성능을 시뮬레이션 연구를 통해서 비교하게 된다. 이런 과정을 통하여 제안되고 검토된 추정방법들 중, Shoji와 Ozaki (1998)가 제안한 국소선형근사법의 결과를 적용하여 GMM의 성능을 개선한 NGMM-Y 추정량이 매우 우수한 성질을 가지고 있음을 확인하게 된다. 특히 NGMM-Y 추정량은 확산계수에 관계된 모수의 추정에 있어서 비교대상이 된 다른 대안적 GMM 방법들에 비하여 우수한 성질을 가지고 있음을 확인하게 된다.

NLL과 GMM을 중심으로 한 확산모형 추정법 비교 (Comparison Study on the Performances of NLL and GMM for Estimating Diffusion Processes)

  • 김대균;이윤동
    • 응용통계연구
    • /
    • 제24권6호
    • /
    • pp.1007-1020
    • /
    • 2011
  • 현대금융공학에 있어서 확산모형은 중요한 역할을 담당하고 있다. 다양한 형태의 확산모형이 제안되어왔고 현실에 응용되어 왔다. 확산모형을 이용하여 금융자료를 분석하기 위하여는 확산모형의 모수를 추정하는 것이 필수불가결한 단계이다. 이들 모수에 대한 다양한 추정방법들이 제안되어 왔고, 많은 연구에서 이러한 추정방법들이 갖는 성질에 대하여 연구되어져왔다. 이 연구에서는 그 적용방법이 단순하여 가장 자주 사용되는 것으로 알려진, 오일러 근사법과 신국소근사법(NLL) 그리고 일반화 적률법(GMM)과 같은 세 가지 추정방법들에 대한 통계적 성질을 검토하게 될 것이다. 모의실험연구를 통하여 오일러근사법이나 NLL방법이 GMM 방법에 비하여 훨씬 좋은 성질을 가지고 있음을 보이게 된다. 특히 GMM은 적용방법이 단순할 뿐만 아니라 강건성(robustness)이라는 좋은 성질을 가지고 있는 것으로 알려져 있어서 많은 연구에서 매우 자주 사용되는 추정방법이다. 그러나 본 연구에서 확인해 본 바와 같이 GMM은 그 사용법이 오히려 더욱 단순한 NLL이나 오일러방법에 비하여 열등한 통계적 성질을 보여주고 있었다. 특히나 확산계수에 추정모수가 포함된 경우에 GMM은 매우 좋지 못한 성질을 보이게 된다.

국부 퍼지 클러스터링 PCA를 갖는 GMM을 이용한 화자 식별 (Speaker Identification Using GMM Based on Local Fuzzy PCA)

  • 이기용
    • 음성과학
    • /
    • 제10권4호
    • /
    • pp.159-166
    • /
    • 2003
  • To reduce the high dimensionality required for training of feature vectors in speaker identification, we propose an efficient GMM based on local PCA with Fuzzy clustering. The proposed method firstly partitions the data space into several disjoint clusters by fuzzy clustering, and then performs PCA using the fuzzy covariance matrix in each cluster. Finally, the GMM for speaker is obtained from the transformed feature vectors with reduced dimension in each cluster. Compared to the conventional GMM with diagonal covariance matrix, the proposed method needs less storage and shows faster result, under the same performance.

  • PDF

화자 확인을 위한 하이브리드 GMM/SVM 방식에 대한 연구 (Research of Hybrid GMM/SVM Approach for Speaker Verification)

  • 윤유선
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2008년도 춘계학술발표대회
    • /
    • pp.139-140
    • /
    • 2008
  • 문장 독립 화자 확인에서 SVM을 위한 적응된 GMM을 바탕으로 특징을 추출함으로써 GMM과 SVM 사이의 새로운 접근 방식을 제안한다. 우수한 측정성으로 인해, 적응된 GMM은 SVM 화자 확인을 위한 대규모의 음성 데이터로부터 적은 양의, 전형적인 특징 벡터를 추출해오곤 했다. 이 새로운 접근방식을 사용함으로써, 제안된 화자 확인 시스템은 기존의 GMM-UBM 시스템보다 훨씬 나은 성능을 보였다.

다양한 소리 환경에서 UBM 기반의 비명 소리 검출 (Scream Sound Detection Based on Universal Background Model Under Various Sound Environments)

  • 정용주
    • 한국전자통신학회논문지
    • /
    • 제12권3호
    • /
    • pp.485-492
    • /
    • 2017
  • GMM(: Gaussian Mixture Model)은 비명 소리를 검출하기 위해서 가장 많이 사용되는 기법의 하나이다. 기존의 GMM 방식에서는 전체 훈련데이터를 비명소리와 비-비명 소리로 나누고, 훈련과정을 통하여 각각의 GMM 모델을 생성하게 된다. 그러나 본 연구에서는 비명 소리 검출 과정이 화자인식과 매우 유사하다는 점에 착안하여 화자인식에서 매우 효과적으로 사용된 UBM(: Universal Background Model) 방식을 비명소리 검출에 적용할 것을 제안하였다. 제안된 UBM 방식을 통한 검출 실험 결과 기존의 GMM 방식에 비하여 더 나은 검출 성능을 보임을 인식 실험을 통하여 확인 할 수 있었다.

VQ와 GMM을 이용한 문맥독립 화자인식기의 성능 비교 (Performance comparison of Text-Independent Speaker Recognizer Using VQ and GMM)

  • 김성종;정훈;정익주
    • 음성과학
    • /
    • 제7권2호
    • /
    • pp.235-244
    • /
    • 2000
  • This paper was focused on realizing the text-independent speaker recognizer using the VQ and GMM algorithm and studying the characteristics of the speaker recognizers that adopt these two algorithms. Because it was difficult ascertain the effect two algorithms have on the speaker recognizer theoretically, we performed the recognition experiments using various parameters and, as the result of the experiments, we could show that GMM algorithm had better recognition performance than VQ algorithm as following. The GMM showed better performance with small training data, and it also showed just a little difference of recognition rate as the kind of feature vectors and the length of input data vary. The GMM showed good recognition performance than the VQ on the whole.

  • PDF