통합 검색 | Korea Science

Chang, Joon-Hyuk
- ETRI Journal
- /
- 제34권2호
- /
- pp.184-189
- /
- 2012
In this paper, we propose a novel approach to statistical model-based voice activity detection (VAD) that incorporates a second-order conditional maximum a posteriori (CMAP) criterion. As a technical improvement for the first-order CMAP criterion in [1], we consider both the current observation and the voice activity decision in the previous two frames to take full consideration of the interframe correlation of voice activity. This is clearly different from the previous approach [1] in that we employ the voice activity decisions in the second-order (previous two frames) CMAP, which has quadruple thresholds with an additional degree of freedom, rather than the first-order (previous single frame). Also, a soft-decision scheme is incorporated, resulting in time-varying thresholds for further performance improvement. Experimental results show that the proposed algorithm outperforms the conventional CMAP-based VAD technique under various experimental conditions.
https://doi.org/10.4218/etrij.12.0111.0344 인용 PDF KSCI

금종모;장준혁
- 한국통신학회논문지
- /
- 제34권6C호
- /
- pp.588-592
- /
- 2009
본 논문에서는 기존의 global soft decision 방법에서 음성부재확률의 고정 파라미터에 2차 조건 사후 최대 확률기법을 적용한 음성 향상 기법을 제안한다. 기존의 global soft decision 방법은 음성부재확률을 구하기 위해 가정한 가설에 따라 파라미터값을 고정하여 다양한 음성 환경 변화에 민감한 점을 고려하여 본 논문에서 제안한 알고리즘은 기존의 고정 파라미터 값에 직전 2 프레임에서의 음성 존재와 부재에 대한 조건을 부여해주어 음성과 음성사이의 상호 연관성을 고려해주고, 보다 유동적으로 현재 프레임의 음성부재확률을 추정하는 음성향상 기법이다. 제안된 방법의 성능평가를 위해 ITU-T P.862 perceptual evaluation of speech quality (PESQ)를 이용하여 평가하였고, 그 결과 제안된 2차 조건 사후 최대 확률기법을 적용한 global soft decision 방법은 기존의 Global soft decision 방법보다 향상된 결과를 나타내었다.
PDF KSCI

금종모;장준혁
- 대한전자공학회논문지SP
- /
- 제46권4호
- /
- pp.132-138
- /
- 2009
본 논문에서는 기존의 Minima Controlled Recursive Averaging (MCRA)에 2차 조건 사후 최대 확률기법을 적용한 음성 향상 기법을 제안한다. 기존의 MCRA 방법은 현제 프레임의 음성 신호 존재 확률로 잡음 추정을 조정하기 때문에 음성 활동의 프레임간의 상호 연관성을 배제 하였다. 본 논문에서 제안한 알고리즘은 직전 2 프레임에서의 음성의 존재와 부재에 대한 조건을 부여해 주어 현제 프레임의 음성 신호 존재 확률을 수정하는 음성향상 기법을 적용한다. 제안된 2차 조건 사후 최대 확률기법을 적용한 MCRA 방법이 기존의 MCRA 방법보다 향상된 음성향상 결과를 나타내었다.
PDF KSCI

임정수;장준혁
- 대한전자공학회논문지SP
- /
- 제48권5호
- /
- pp.102-108
- /
- 2011
Support vector machine (SVM)은 패턴인식 분야에 많이 사용되어지고 있고 그 한 예로서 3GPP2 selectable mode vocoder(SMV)와 같은 규격화된 코덱에 쓰여 코덱의 음성/음악 분류 성능을 향상시킬 수 있다. 본 논문에서는 SVM을 개선시켜 음성/음악의 분류성능을 더욱 향상시키는 새로운 방법을 제안한다. 음성/음악신호의 각 프레임들은 서로 강한 상관관계를 가지고 있는데, 이를 바탕으로 2차 조건 사후 최대 확률기법을 SVM에 적용하여 음성/음악 분류성능을 향상시킨다. 또한 SVM을 학습시킬 때 적용되는 기존의 기법들과는 달리 제안되는 기법은 SVM이 패턴분류를 행할 때 사용된다. 그렇기 때문에 기존의 기법들과 독립적으로 개발되고 사용될 수 있고, 따라서 패턴분류의 성능을 한층 더 향상시킬 수 있다. 실험을 통해 제안된 기법의 독립성과 성능향상을 기존의 기법들과 비교하여 증명하였다.
PDF KSCI