• 제목/요약/키워드: Overlap-add

검색결과 52건 처리시간 0.019초

저연산 정현파 합성을 이용한 악기음의 모델링 (Modeling of Instrumental Tone Using Low Computation Sinusoidal Synthesis)

  • 오복환;이동규;송인호;이두수
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1999년도 학술발표대회 논문집 제18권 2호
    • /
    • pp.185-188
    • /
    • 1999
  • 음향 신호의 모델링방법은 크게 분석,해석,합성의 3가지 과정으로 나눌 수 있다. 본 논문에서는 분석과 합성에 가산 합성방법의 한가지인 Analysis-by-synthesis/overlap-Add 방법을 사용한다. 그리고 해석에 해당하는 주파수 영역에서의 피크추출은 제안한 방법에 의한다. 제안한 피크 추출 방법은 고조파 성분이 기본 주파수의 정수배가 된다는 점을 고려하여 적은 연산량으로 음향학적으로 의미있는 순음을 검출하는 방법이다. 음질보다 연산량에 더 주를 두었지만 모의 실험 결과를 통하여 음질 면에서도 원음과 거의 차이가 없음을 알 수 있었다.

  • PDF

포만트 유사도 측정에 의한 PSOLA 음성 부호화에 관한 연구 (On a study on PSOLA coding technique based on the measurement of formant similarity)

  • 나덕수;이희원;김규홍;배명진
    • 대한전자공학회:학술대회논문집
    • /
    • 대한전자공학회 1998년도 하계종합학술대회논문집
    • /
    • pp.607-610
    • /
    • 1998
  • The major objectives of speech coding include high compression ratio for transmission in the band limited channel, high synthesized speech quality in terms of the intelligibility and the naturalness and fast processing speed. In general, speech coding methods are classified into the following three categories: the wavelform coding, the source coding and the hybird coding. In this paper, we proposed a new waveform coding method using PSOLA(pitch-synchronous overlap add) technique. First, we fixed one basic waveform per pitch and measured the formant similarity between basic and neighbor waveform. Second, if the similairy satisfied threshold values, we compress the neighbor waveform per pitch and then store or transmit. When the comparession is about 45%, we obtained about 4 in MOS.

  • PDF

중첩가산방식의 SSB 필터뱅크와 QMF 필터뱅크를 이용한 서브밴드 음향 반향 신호 제거기에 관한 연구 (A Study on the Subband Acoustic Echo Canceller Using Weighted Overlap-Add SSB and QMF Filter Banks)

  • 차경환;심동연;김천덕
    • 전자공학회논문지S
    • /
    • 제36S권4호
    • /
    • pp.93-100
    • /
    • 1999
  • 확성회의 시스템에서 응용되는 반향신호 제거기는 긴 잔향시간을 갖는 실내 공간의 환경변화에 따라 필터 계수의 갱신에 많은 시간이 요구되어 실시간 처리에 문제점으로 지적되고 있다. 본 논문에서는 연산량 저감을 통한 실시간 처리를 위하여 중첩가산방식의 SSB(Single Side Band) 필터뱅크를 사용한 서브밴드 적응 신호처리법을 제안한다. 이 방법은 입력과 출력의 스펙트럼을 몇 개의 주파수 밴드로 분할하여, 각 밴드를 ES-NLMS(Exponential Step-Normalized Least Mean Square) 알고리즘을 이용하여 적응 처리하는 것이다. 시뮬레이션 결과 중첩가산방식의 SSB 필터뱅크가 풀밴드 보다 ERLE(Echo Return Loss Enhancement)가 1∼2㏈ 정도 작을 때 연산량이 풀밴드 보다 약95%, QMF(Quadrature Mirror Filter)필터뱅크보다 약50% 정도 감소하여 우수한 것으로 나타났다.

  • PDF

피치 변환을 사용한 실시간 음성 변환 시스템 (Real-time Voice Change System using Pitch Change)

  • 김원구
    • 한국지능시스템학회:학술대회논문집
    • /
    • 한국퍼지및지능시스템학회 2004년도 춘계학술대회 학술발표 논문집 제14권 제1호
    • /
    • pp.466-469
    • /
    • 2004
  • In this paper, real-time voice change method using pitch change technique is proposed to change one's voice to the other voice. For this purpose, sampling rate change method using DFT (Discrete Fourier Transform) method and time scale modification method using SOLA (Synchronized Overlap and Add) method is combined to change pitch. In order to evaluate the performance of the proposed method, voice transformation experiments were conducted. Experimental results showed that original speech signal is changed to the other speech signal in which original speaker's identity is difficult to find. The system is implemented using TI TMS320C6711DSK board to verify the system runs in real time.

  • PDF

Fast Time-Scale Modification of Speech Using Nonlinear Clipping Methods

  • 정호영;김형순;이성주
    • 대한음성학회지:말소리
    • /
    • 제59호
    • /
    • pp.69-87
    • /
    • 2006
  • Among the conventional time-scale modification (TSM) methods, the synchronized overlap and add (SOLA) method is widely used due to its good performance relative to computational complexity But the SOLA method remains complex due to its synchronization procedure using the normalized cross-correlation function. In this paper, we introduce a computationally efficient SOLA method utilizing 3 level center clipping method, as well as zero-crossing and level-crossing information. The result of subjective preference test indicates that the proposed method can reduce the computational complexity by over 80% compared with the conventional SOLA method without serious degradation of synthesized speech quality.

  • PDF

SWAPPING NATIVE AND NON-NATIVE SPEAKERS' PROSODY USING THE PSOLA ALGORITHM

  • Yoon Kyu-Chul
    • 대한음성학회:학술대회논문집
    • /
    • 대한음성학회 2006년도 춘계 학술대회 발표논문집
    • /
    • pp.77-81
    • /
    • 2006
  • This paper presents a technique of imposing the prosodic features of a native speaker's utterance onto the same sentence uttered by a non-native speaker. Three acoustic aspects of the prosodic features were considered: the fundamental frequency (F0) contour, segmental durations, and the intensity contour. The fundamental frequency contour and the segmental durations of the native speaker's utterance were imposed on the non-native speaker's utterance by using the PSOLA (pitch-synchronous overlap and add) algorithm [1] implemented in Praat[2]. The intensity contour transfer was also done in Praat. The technique of transferring one or more of these prosodic features was elaborated and its implications in the area of language education were discussed.

  • PDF

다중 중첩-합 구조에 기반한 개선된 시간 영역 엘리어싱 제거 필터 뱅크 (Improved Time Domain Aliasing Cancellation Filter Bank Based on the Multiple Overlap-add Structure)

  • 유철재;김형명
    • 한국통신학회논문지
    • /
    • 제26권8B호
    • /
    • pp.1057-1069
    • /
    • 2001
  • 오디오 부호화 시스템에 널리 쓰이는 시간 영역 엘리어싱 제거(TDAC) 필터 뱅크의 성능 개선을 위하여, 다중 중첩-합 구조를 바탕으로 한 개선된 TDAC 필터 뱅크를 제안하였다. 제안된 구조는 필터 뱅크의 분해 부분과 합성 부분 사이에서 발생하는 양자화 잡음의 효과를 줄이도록 제안되었다. 모의 실험을 통해 같은 양자화 비트 수를 사용하는 경우에 제안한 시스템이 SNR 측면에서 보다 나은 성능을 나타냄을 보였으며, 망 전송 데이터 양을 같게 한 경우에도 제안한 시스템이 더 적은 데이터 양의 블록 단위를 가질 수 있으므로 데이터 망의 혼잡 제어에 있어 보다 유리할 수 있음을 보였다.

  • PDF

G.729 음성 보코더를 이용한 가변 전송율 보코더 구현 (Implementation of the Variable Bit Rate Vocoder Using G.729 Vocoder)

  • 함명규;배명진
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 2002년도 하계학술발표대회 논문집 제21권 1호
    • /
    • pp.73-76
    • /
    • 2002
  • 본 논문에서는 8kbps의 전송율을 가진 ITU G.729 보코더와 PSOLA(Pitch Synchronized Overlap -Add) 알고리즘을 적용하여 전송율을 6kbps와 4kbp까지 낮출 수 있는 가변 전송율 보코더를 구현하였다. 제안한 방법은 4kbps일 경우에 G.729의 부호화전에 PSOLA를 적용하여 피치의 주기를 반으로 줄여 부호화한다. 이렇게 부호화된 데이터는 G.729의 복호화를 거치고 다시 PSOLA를 통해 음성의 피치 주기를 2배로 늘려주어 원음성을 합성하게된다. 기존의 Bkbp의 전송율을 갖는 G.729는 음성의 크기가 반으로 줄어 부호화되므로 전송율이 4kpb로 줄어들게 된다. 실험의 평가는 MOS 테스트를 통해 수행되었으며 4kbp에서 MOS값이 3.37정도로 측정되었다. 또한 처리해야할 음성의 길이가 줄어들게 되므로 계산시간도 줄어들게 된다.

  • PDF

Algorithm for Concatenating Multiple Phonemic Units for Small Size Korean TTS Using RE-PSOLA Method

  • Bak, Il-Suh;Jo, Cheol-Woo
    • 음성과학
    • /
    • 제10권1호
    • /
    • pp.85-94
    • /
    • 2003
  • In this paper an algorithm to reduce the size of Text-to-Speech database is proposed. The algorithm is based on the characteristics of Korean phonemic units. From the initial database, a reduced phoneme unit set is induced by articulatory similarity of concatenating phonemes. Speech data is read by one female announcer for 1000 phonetically balanced sentences. All the recorded speech is then segmented by phoneticians. Total size of the original speech data is about 640 MB including laryngograph signal. To synthesize wave, RE-PSOLA (Residual-Excited Pitch Synchronous Overlap and Add Method) was used. The voice quality of synthesized speech was compared with original speech in terms of spectrographic informations and objective tests. The quality of the synthesized speech is not much degraded when the size of synthesis DB was reduced from 320 MB to 82 MB.

  • PDF

웨이블릿 변환을 이용한 음성신호의 AbS/OLA 정현파 모델링 (AbS/OLA Sinusoidal Modeling of Speech Signal Using Wavelet Transform)

  • 김기홍;홍진근;정용익;이상이
    • 한국산학기술학회:학술대회논문집
    • /
    • 한국산학기술학회 2004년도 추계학술대회
    • /
    • pp.114-117
    • /
    • 2004
  • 본 논문에서는 합성에 의한 분석(Analysis-by-Synthesis) 및 가산중첩(Overlap-Add) 방식을 채택하고 있는 음성신호의 AbS/OLA 정현파 모델에 웨이블릿 변환을 적용한 새로운 모델을 제안하였다. 즉, 기존의 모델에 웨이블릿 변환을 적용하여 입력신호를 몇 개의 부대역 신호로 나눈 다음 각각 다른 길이의 분석 윈도우를 적용한다. 이는 기존 모델의 정현파 파라미터 추출 시 고정된 길이의 분석 윈도우를 이용하는 단점을 극복하여 좀 더 정확한 파라미터 추출을 가능하게 한다. 시험결과 제안된 정현파 모델이 기존 모델에 비해 합성음의 스펙트럼 및 위상 특성, 음질 등에서 성능이 개선됨을 확인할 수 있었다.

  • PDF