• Title/Summary/Keyword: 피치

Search Result 1,320, Processing Time 0.031 seconds

A Improvement Method of the Speech Quality by Pitch Compensation in Transition Region in G.723.1 (전이구간에서의 피치보상에 의한 G.723.1 부호화기의 음질 향상 방법)

  • KIM JongKuk;BAE MyungJin
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • spring
    • /
    • pp.43-46
    • /
    • 2000
  • G.723.1 부호화기는 음성신호의 주기성을 피치와 피치 이득계수로, 스펙트럼 정보를 LSP(Line Spectrum Pair)로 부호화하고 있다. 그런데 주기성을 부호화 할 때 유성음의 피치가 일정한 안정구간과 피치가 변화하는 전이구간의 차이를 두지 않고 처리하여 전이구간에서의 정확한 피치검출이 이루어지지 않는다. 이러한 처리 때문에 전이구간에서의 음질의 열하가 발생하게 된다. 본 논문에서는 전이구간의 피치검출의 정확성을 높여 음질을 향상시킬 수 있는 새로운 알고리즘을 제안한다. 먼저 G.723.1 부호화기에서 검출되는 피치 이득계수를 이용하여 안정구간의 피치 이득계수의 문턱 값을 정한다. 그리고 피치 이득 계수가 문턱 값을 넘는 부분에 한하여 구해진 피치를 전후 10샘플을 조절하여 피치 이득계수를 다시 구하여 문턱 값에 가장 가까운 값을 대표피치 이득계수로 정하고 그때의 피치와 함께 부호화한다. 실험 결과 평균 0.6(dB) segmental SNR(Signal to Noise)과 평균0.12 MOS가 향상되었다.

  • PDF

On a Waveform Coding Technique Using Pitch Searching and 3-Level Clipping (피치검색기법과 3-Level Clipping을 이용한 음성 파형부호화법에 관한 연구)

  • 김규홍
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1998.08a
    • /
    • pp.127-130
    • /
    • 1998
  • 피치검색과 3-level clipping을 이용한 새로운 파형부호화법을 제안하고자 한다. 제안한 방법에서는 우선 피치를 검출하여 기준피치파형과 인근피치파형을 검색한다. 그 후 유사도 측정시 기준피치파형과 인근 피치파형에 대해 3-level clippng을 수행한다. 클리핑된 기준피치파형가 인근피치파형간의 유사도를 측정하여 유사성이 크다면 피치정보와 에너지 정보만을 전송하거나 저장하여 압축을 하고, 유사성이 적다면 인근피치파형을 압축을 하지 않고 저장한다. 그 후에 저장된 ?ㅇ을 기준 피치파형으로 재정의 하여 다시 반복적으로 압축을 수행한다. 압축된 음성신호를 다시 복원할 때에는 수신 또는 저장된 음성신호를 이용하여 PSOLA 방식으로 합성을 수행한다. 평균압축율이 약 65%일 경우에도, MOS 값이 4이상을 유지하였다.

  • PDF

On the Improving the pitch Searching Error of CELP Type Vocoder (CELP형 보코더에서 피치 검색오류의 개선)

  • 배명진;장호성
    • The Journal of the Acoustical Society of Korea
    • /
    • v.12 no.3
    • /
    • pp.62-67
    • /
    • 1993
  • 부호 여기된 선형예측 음성보코더들은 4800bps의 낮은 전송율에서도 좋은 음질을 제공한다. CELP 형 보코더의 피치검색법의 문제점중에 하나는 피치 검출시의 조오류에 의해 예측이득이 저하된다는 점이다. 본 논문에서 우리는 CELP 보코더의 피치 예측이득을 개선하는 한 새로운 피치검색법을 제안하였다. 제안한 방법은 예비피치들을 검출하여 이들중 피치 예측이득이 최대인 값을 선정하는 방법을 적용하였다. 이 방법을 여러 화자의 발성에 대해 적용한 결과 피치 예측이득율 6.1% 정도 개선할 수 있었다.

  • PDF

A Study on Multi-Pulse Speech Coding Method by using Individual Pitch Pulses (개별 피치펄스를 이용한 멀티펄스 음성부호화 방식에 관한 연구)

  • 이시우
    • Journal of the Korea Institute of Information and Communication Engineering
    • /
    • v.8 no.5
    • /
    • pp.977-982
    • /
    • 2004
  • In this paper, I propose a new method of Multi-Pulse Coding(IP-MPC) use individual pitch pulses in order to accommodate the changes in each pitch interval and reduce pitch errors. The extraction rate of individual pitch pulses was 85% for female voice and 96% for male voice respectively. 1 evaluate the MPC by using pitch information of autocorrelation method and the IP-MPC by using individual pitch pulses. As a result, I knew that synthesis speech of the IP-MPC was better in speech quality than synthesis speech of the MPC.

The Pitch detection of 3 Level Clipping Algorithm using by Pre-Post Processing (전.후 처리를 이용한 3 레벨 클리핑 알고리즘의 피치검출)

  • 최승영
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1998.06c
    • /
    • pp.167-170
    • /
    • 1998
  • 음성신호의 특징적인 성분인 피치를 검출하는 알고리즘 중 실시산 구현이 손쉬운 3단계를 클리핑 알고리즘을 PC상에서의 처리를 위하여 구현하였다. 이 알고리즘을 통하여 검출되는 피치의 안정성 및 정확성을 높이기 위해서 적용된 창함수, LPF, 클리핑 자기상관값계산, 비선형 감쇄, 등의 전처리 필터링과, 배수피치 검출 및 정정, 메디언 필터링을 사용하여 피치를 검출하였다. 또한 이 알고리즘을 이용하여 DSP의 도움을 얻지 않고 PC상에서 음성을 분석하여 스펙트로그램, 파형, 에너지, 피치 등을 출력하는 프로그램인 Visual Analysis Tool for sounds(VAT)의 출력화면을 통하여 피치검출을 나타내었다.

  • PDF

A Study on Multi-Pulse Speech Coding Method by Using Individual Pitch Information (개별 피치정보를 이용한 멀티펄스 음성부호화 방식에 관한 연구)

  • Lee, See-Woo
    • The Journal of the Korea Contents Association
    • /
    • v.6 no.2
    • /
    • pp.59-64
    • /
    • 2006
  • In this paper, 1 propose a new method of Multi-Pulse Coding(IP-MPC) use individual pitch pulses in order to accommodate the changes in each pitch interval and reduce pitch errors. The extraction rate of individual pitch pulses was $85\%$ for female voice and $96\%$ for male voice respectively, 1 evaluate the MPC by using pitch information of autocorrelation method and the IP-MPC by using individual pitch pulses. As a result, 1 knew that synthesis speech of the IP-MPC was better in speech quality than synthesis speech of the MPC.

  • PDF

Investigating an Automatic Method for Summarizing and Presenting a Video Speech Using Acoustic Features (음향학적 자질을 활용한 비디오 스피치 요약의 자동 추출과 표현에 관한 연구)

  • Kim, Hyun-Hee
    • Journal of the Korean Society for information Management
    • /
    • v.29 no.4
    • /
    • pp.191-208
    • /
    • 2012
  • Two fundamental aspects of speech summary generation are the extraction of key speech content and the style of presentation of the extracted speech synopses. We first investigated whether acoustic features (speaking rate, pitch pattern, and intensity) are equally important and, if not, which one can be effectively modeled to compute the significance of segments for lecture summarization. As a result, we found that the intensity (that is, difference between max DB and min DB) is the most efficient factor for speech summarization. We evaluated the intensity-based method of using the difference between max-DB and min-DB by comparing it to the keyword-based method in terms of which method produces better speech summaries and of how similar weight values assigned to segments by two methods are. Then, we investigated the way to present speech summaries to the viewers. As such, for speech summarization, we suggested how to extract key segments from a speech video efficiently using acoustic features and then present the extracted segments to the viewers.

A Study on Real Time Pitch Alteration of Speech Signal (음성신호의 실시간 피치변경에 관한 연구)

  • 김종국;박형빈;배명진
    • The Journal of the Acoustical Society of Korea
    • /
    • v.23 no.1
    • /
    • pp.82-89
    • /
    • 2004
  • This paper describes how to reduce the effect of an occupation threshold by that the transform of mixture components of HMM parameters is controlled in hierarchical tree structure to prevent from over-adaptation. To reduce correlations between data elements and to remove elements with less variance, we employ PCA (principal component analysis) and ICA (independent component analysis) that would give as good a representation as possible, and decline the effect of over-adaptation. When we set lower occupation threshold and increase the number of transformation function, ordinary WLLR adaptation algorithm represents lower recognition rate than SI models, whereas the proposed MLLR adaptation algorithm represents the improvement of over 2% for the word recognition rate as compared to performance of SI models.

On a Detection of Pitch Point for Voice Color Conversion (음색변경을 위한 피치시점 검출에 관한 연구)

  • Park HyungBin;Bae MyungJin
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • spring
    • /
    • pp.149-152
    • /
    • 2000
  • 음성신호처리분야에서 피치시점 검출은 음성 합성시에 여기원의 특성을 나타내어 음질의 자연성을 결정한다. 이에 본 논문에서는 음색 변경시에 운율조절에 필요한 피치시점 검출법을 제안한다. 제안한 방법은 시간영역에서 직접 처리하기 때문에 피치동기분석이 용이하고 다른 영역으로의 변환과정이 불필요하다. 또한 기존의 피치시점검출 방법에서는 결정논리를 실험적인 문턱 값이나 무게치를 적용하여 처리하는 반면에 제안한 방법은 분석구간별로 얻어지는 주기적인 성문특성을 적용하여서 정확한 피치시점을 검출할 수 있었다

  • PDF

Reduction of Pitch Searching Range in CELP vocoder (CELP 부호화기에서 피치검색범위의 단축)

  • 임재열;배명진;안수길
    • The Journal of the Acoustical Society of Korea
    • /
    • v.12 no.2E
    • /
    • pp.33-37
    • /
    • 1993
  • 부호여기선형예측 형태의 음성 부호화기에 있어서주된 단점은 요구되는 계산량이많다는 것이다. 본 논문에서는 음질의 저하없이 자기상관에 근거한 피치예측기에서 피치 찾는 시간을 줄이는 간단한 방법을 제안한다. 기본적인 발상은, 피치찾는 과정에서 나타나는 자기상관 함수의 특성에 근거하여, 음의 봉우리의 폭을 이전 양의 봉우리의 폭을 이용하여 추정하여 건너 뜀으로써 피치 찾는 범위를 자기상관함수의 양의 값쪽으로 제한하는 것이다. 이렇게 피치찾는 구간에 제약을 가함으로써 요구되는 계산량은 감소하게 된다. 제안된 방법을 적용한 결과, 평균 약 40%의 계산량 감소를 음질의 저하없이 얻을 수 있다.

  • PDF