On the Interval Detection of Implosive Stop Sounds by Frame Energy Difference

프레임간 에너지 차를 이용한 음성신호의 종성 폐쇄음 구간 검출에 관한 연구

  • 배명진 (서울大學校 電子工學科) ;
  • 최정아 (서울大學校 電子工學科) ;
  • 안수길 (서울大學校 電子工學科)
  • Published : 1989.04.01

Abstract

Preprocessing in speech recognition system is useful, for it reduces some of the complicated procedures required for the final recognition. In this paper, we suggest a new preprocessing algorithm for detecting the intervals of implosive stop sounds. Implosive stop sounds follow vowels in Korean language, and its characteristic is included in the region of vowels. When an implosive stop is pronounced, the velum is quickly colsed, thus its energy decays abruptly and the closure lasts for about 50 to 150 msec. The enegy difference between adjacent frames is chosen as a parameter which represents well the above features.

음성 신호의 인식 시스템에서 분류 인식과정은 최종 인식과정에 필요한 복잡한 처리 과정을 줄여주기 때문에 유용하다. 본 논문에서는 종성 폐쇄음의 구간을 검출하는 분류인식 아고리듬을 제안하였다. 한국어의 종성 폐쇄음은 항상 모음 뒤에 발음되며, 그 특징은 모음 구간 내에 포함된다. 종성 폐쇄음 발음시에 연구개가 급히 닫히므로 에너지의 급격한 감소가 일어나고, 폐쇄 구간은 50~150msec간 지속된다. 이러한 성질을 나타내는 파라미터로 프레임간 에너지 차를 제안한다.

Keywords