대역 분할 장구간 예측을 이용한 CELP 부호화기

A CELP Coder using the Band-Divided Long Term Prediction

  • 발행 : 1995.08.01

초록

본 논문에서는 CELP (Code Excited Linear Prediction) 부호화기의 장구간 예측단에 MBE(Multi-Band Excitation) 방법을 도입하여 4.8kbps 이하의 낮은 전송률에서 성능을 향상시키는 방법을 제안한다. 제안한 방법에서는 기존의 CELP 방법으로 장구간 예측을 한 후에도 여전히 남아 있는 주기적 성분들을 다시 한번 다중대역(multiband)으로 장구간 예측을 한다. 이때 전 스펙트럼을 기본 주파수의 하모닉 간격으로 대역 분할하고, 주기적 다중대역 여기 신호는 각 대역 내의 하모닉들에서 여기 신호 스펙트럼과 근사한 크기를 갖는 정현파 (sine wave)의 합으로 표현함으로써 실제 여기 신호의 특성을 잘 반영하도록 한다. 제안된 방법의 성능 평가를 위해서 4.8 kbps의 전송률에서 컴퓨터 모의 실험을 하였다. 음질 평가의 비교 기준 대상으로 4.8 kbps DoD CELP와 4.4 kbps IMBE를 선정하여 주관적인 음질 평가를 실시한 결과 4.8 kbps DoD CELP보다 우수하였고, 4.4 kbps IMBE와는 비슷하였다.

In this paper a way to improve the performance of the long term prediction is proposed, which adopts the Multi-band Excitation (MBE) method in addition to the Code-Excited Linear Prediction (CELP) method at low bit rates below 4.8 kbps. In the proposed method, the multiband long term prediction is performed on the periodic components which still remain after the long term prediction of the conventional CELP method. At this point, the whole frequency region is divided into subbands whose size is equal to the spacing between the harmonics of the fundamental frequency, and the periodic multiband excitation signals. are represented as the sum of sine waves approximately as large as the spectrum of the excitation signals, so that the actual characteristics of the excitation signals can be better taken into account. To evaluate the performance of the proposed method, computer simulation is performed at 4.8 kbps. The 4.8 kbps DoD CELP and the 4.4 kbps IMBE were chosen as the reference vocoders for the speech quality measure. The result of the perceptual speech quality measure showed that the performance of the proposed method is better than that of the 4.8 kbps DoD CELP vocoder, and similar to that of the 4.4 kbps IMBE vocoder.

키워드