Multi-Speaker Speech Recognition in Noisy Environments

잡음 환경에서의 복수 화자 음성인식

  • Oh Yoon Hark (Dept. of Electronics Engineering, Pusan National University) ;
  • Hur Ho Young (Dept. of Electronics Engineering, Pusan National University) ;
  • Song Myung Gyu (Dept. of Electronics Engineering, Pusan National University) ;
  • Kim Hyung Soon (Dept. of Electronics Engineering, Pusan National University)
  • Published : 2000.11.01

Abstract

본 논문에서는 잡음 환경에서 복수 화자 음성인식 시스템의 인식 성능 향상에 관한 실험을 하였다. 복수화자 음성인식 방식은 훈련에 참여한 복수의 사용자에 대한 등록 단어 모델을 가지므로, 인식 단계에서 등록화자의 모든 단어 모델들을 테스트 음성과 비교하여 인식 단어를 결정한다 그러나, 이 경우 훈련 환경과 테스트 환경의 불일치에 기인한 인식 성능 저하가 등록 화자수가 많아짐에 따라 더욱 심해지는 문제가 발생한다. 본 논문에서는 이 문제의 해결을 위해 등록 화자들의 모든 단어 모델들을 테스트 음성과 비교하는 대신 화자인식 시스템을 사용해서 발성 화자와 유사한 후보 화자들의 단어 모델들에 대해서만 테스트 음성과 비교하는 방식을 적용함으로써 기존의 방법보다 높은 단어 인식 율을 얻을 수 있었다

Keywords