통합 검색 | Korea Science

이세원;송재종;이석필;박호종
- 한국음향학회지
- /
- 제30권6호
- /
- pp.353-359
- /
- 2011
본 논문에서는 다성 음악 신호의 보컬 피치 검출 성능을 향상시키기 위해 음악 신호의 보컬 신호를 강화시키는 전처리 기술을 제안한다. 제안한 보컬 강화 기술은 입력된 다성 음악 신호로부터 반주 신호를 예측하고, 예측된 반주 신호를 입력된 보컬 신호의 크기에 맞춰 가공하여 반주 복사본 신호를 생성한다. 마지막으로 주파수 영역에서 반주 복사본 신호를 원래 다성 음악 신호에서 제거하여 보컬이 강화된 출력 신호를 생성한다. 원 음악 신호와 제안한 방법으로 보컬이 강화된 신호에 동일한 보컬 피치 검출 방법을 각각 적용하여 피치 검출의 정확도를 측정하였고, 제안한 기술에 의하여 피치 검출 정확도가 평균 7.1 % 포인트 향상된 것을 확인하였다.
https://doi.org/10.7776/ASK.2011.30.6.353 인용 PDF KSCI

조혜승;김형국
- 한국음향학회지
- /
- 제35권1호
- /
- pp.49-54
- /
- 2016
본 논문에서는 커널 백피팅 알고리즘에 가중 ${\beta}$-지수승 최소평균제곱오차 추정방식(weighted ${\beta}$-order minimum mean square error: WbE)을 적용한 보컬음 분리 방식에 대해 제안한다. 음성 향상 방식에서, WbE는 진폭 성분 기반 MMSE(Minimum Mean Square Error) 추정방식, 로그 스펙트럼 진폭 기반 MMSE 추정방식 등과 같은 기존의 베이지안(Bayesian) 기반의 추정방식들 보다 객관적 및 주관적 측면에서 모두 보다 높은 성능을 나타내는 방식으로 잘 알려져 있다. 이에 본 논문에서는 기본적인 반복적 커널 백피팅 알고리즘에 WbE를 적용하여 음악 신호에서의 보컬음 분리 성능을 향상시키고자 하였다. 실험결과는 본 논문에서 제안한 방식이 기존의 분리 방식보다 분리 성능이 더 뛰어나다는 것을 보인다.
https://doi.org/10.7776/ASK.2016.35.1.049 인용 PDF KSCI

Kang, Kyoung-Ho
- 말소리와 음성과학
- /
- 제2권1호
- /
- pp.3-11
- /
- 2010
The present study confirmed the intelligibility improvement benefit of clear speech by investigating the intelligibility of Korean stops produced in different speaking styles: conversational, citation-form, and clear speech. This finding supports the Hypo- & Hyper-speech theory that speakers adjust vocal effort to accommodate hearers' speech perception difficulty. A progressive intelligibility improvement was found for the three speaking styles investigated: clear speech was more intelligible than citation-form speech citation-form speech was more intelligible than conversational speech and clear speech was also more intelligible than conversational speech. These findings suggest that the manipulations to elicit three distinct speaking styles in a laboratory setting were successful. Korean lenis stops showed the least intelligibility improvement among the three Korean stop types, and this result suggests that lenis stops should be more resistant to intelligibility enhancement efforts in clear speech than aspirated and fortis stops.
PDF

이기용;이주헌;송익호;안수길
- 한국음향학회지
- /
- 제10권1호
- /
- pp.20-29
- /
- 1991
기존의 선형 예측법에 의한 음성 분석의 기본적인 가정은 전극점 성도 필터의 입력은 백색 신호라는 것이다. 그러나, 주기성 입력 신호의 경우 피치 바이오스 오차가 기존 선형 예측 계수에 개입된다. 만일 여기 신호의 추정값을 이용할 수 있다면 멀티 펄스에 의한 선형 예측 분석으로 이러한 바이어스를 제거할 수 있다. 기존의 선형 예측 분석에서의 예측 오차는 멀티 펄스 여기 신호열과 불규칙 잡음 신호열의합으로 나타내어질 수 있으므로 선형 예측 오차로부터 멀티 펄스 신호열을 찾아내는 것은 고전적인 검출 및 추정의 문제로 생각될 수 있다. 본 논문에서는 먼저 LRT 를 이용하여 예측오차로부터 멀티 펄스 신호의 위치와 크기를 찾아낸 다음 이 신호열로부터 피치 바이어스가 제거된 선형 예측 계수를 구하는 알고리즘을 제안한다. 매번 적응된 임계값을 적용하여 반복 수행을 함으로써 성능향상을 입증하였다.
PDF

박찬섭;김기만;강석엽
- 한국정보통신학회논문지
- /
- 제11권10호
- /
- pp.1845-1851
- /
- 2007
배경 잡음과 실내 잔향음은 음성 인식 시스템 성능 저하의 주요 이유이다. 많은 알고리즘이 음성의 잔향음 제거를 위해 개발되었다. 이 논문에서는 실내 환경에서 수정된 선형 예측 잔여(Linear Prediction Residual)를 이용하여 음질 개선을 위한 잔향음 제거 방법을 제안한다. 제안된 잔향음 제거 방법은 음성에서 성문 경계의 순간에 발생한 성도(聲道)시스템의 중요한 여기에 기반한다. 본 논문에서 제안한 방법은 3개의 센서로부터 수집한 반향신호로 각 센서에서의 시간지연 정보를 사용한다. 새로운 선형 예측 잔여신호는 선형 예측 잔여의 가중치와 힐버트 변환으로 얻은, 개선된 선형 예측 잔여 조합을 사용한다. 코히런트하게 더해진 힐버트 포락선의 특징은 잡음과 반사로 인한 큰 진폭 피크를 가지는 것이다. 깨끗한 음성의 잔여는 개선된 음성을 얻는 시변전극 필터를 일으키는데 사용된다. 본 논문에서는 반향 환경에서 성능 분석을 위해 제안된 알고리즘의 시뮬레이션을 수행하였다. 제안된 알고리즘은 실내 잔향환경에서 기존의 알고리즘에 비해 반사된 음성의 품질 향상의 결과를 보였다.
https://doi.org/10.6109/jkiice.2007.11.10.1845 인용 PDF KSCI