• 제목/요약/키워드: 음성 변화

검색결과 1,371건 처리시간 0.025초

웨이브렛 변환을 이용한 음성신호의 잡음 제거 (Noise Cancellation of Speech Signal Using Wavelet Transform)

  • 황향자;김종교
    • 대한음성학회:학술대회논문집
    • /
    • 대한음성학회 2003년도 10월 학술대회지
    • /
    • pp.105-108
    • /
    • 2003
  • 본 논문은 잡음 환경에서의 음성인식을 위하여 음성에 부가된 잡음을 제거하는 방법으로 프레임 단위로 웨이브렛 변환 영역의 표준편차를 활용하여 시간 적응적 임계값을 사용하는 새로운 방법을 제안한다. 웨이브렛 변환영역의 cD1과 cA3의 표준편차 값을 이용하여 임계값을 설정함으로써 음성의 변화에 적응할 수 있도록 하였다. 또한 묵음구간의 잔여 잡음을 제거하기 위한 방법을 제안하였다. 실험을 통하여 제안한 방법이 기존의 웨이브렛 변환과 웨이브렛 패킷 변환을 이용한 잡음제거 방법보다 SNR(Signal to Noise Ratio)과 MSE(Mean Squared Error) 측면에서 향상됨을 확인할 수 있었다.

  • PDF

순시적인 신호대 잡음비 예측과 RASTA 기법을 이용한 음성인식 (A Speech Recognition Using Instantaneous SNR Estimation and RASTA Processing)

  • 배현권;오문식;이행세
    • 한국음향학회지
    • /
    • 제17권1호
    • /
    • pp.55-59
    • /
    • 1998
  • 본 논문에서는 잡음에 강한 음성 인식기를 위한 음성의 특징 추출에 관해서 살펴 보았다. 지금까지의 음성 인식기는 조용한 실험실 환경하에서 학습이 이루어지나 실제 테스 트는 여러 가지 환경에서 이루어지므로, 이러한 환경 변화에 따라 음성인식 시스템의 성능 이 감소함을 보여왔다. 이를 보완하기 위해 여러 가지 연구가 진행되고 있으나 본 연구에서 는 음성의 특징 추출 부분에서 순시적인 신호대 잡음비 예측과 잡음에 강한(RASTA)처리를 하므로써 인식율을 향상시켰다.

  • PDF

한국어 문음성 변환기의 음운지속시간 제어에 관한 연구 (A Study on Segmental Duratio Control for the Kroean TTS)

  • 김인영
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 학술발표대회 논문집 제17권 1호
    • /
    • pp.143-146
    • /
    • 1998
  • 자연스러운 한국어의 음성합성을 위해서는 음운의 지속시간의 제어가 매우 중요하다. 본 연구에서는 POW3848 어절에 대한 음성 데이터에 대해 음운 세그먼트, 음운 라벨링, 품사 태깅을 행한 음성 데이터베이스를 구축하여 한국어 음운의 지속시간을 변화시키는 시간 특징을 통계적으로 분석하였다. 이 시간 특징들 중 변화 폭이 큰 요인들을 제어요소로 각 음운의 고유길이를 최대한 배제하고 단지 음운 발성 환경의 영향에 의한 지속시간 변화만을 고려하는 정규화 지속시간에 대한 회귀트리로 한국어 음운 지속시간을 모델화 하였다. 제안된 음운 지속시간 모델을 실시간 제어 알고리즘으로 구현하여 평가한 결과, 음운 지속시간 예측오차의 88% 정도가 25ms이내 이었고 예측치와 관측치 간의 다중 상관관계수는 0.92 정도로 평가되어, 제안된 모델의 타당성이 입증되었다.

  • PDF

PC를 이용한 실시간 음성검출 알고리즘에 관한 연구 (A Study on the Fevelopment of Teal Time Speech Detection in PC)

  • 정훈;정권;정익주
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1994년도 제11회 음성통신 및 신호처리 워크샵 논문집 (SCAS 11권 1호)
    • /
    • pp.129-132
    • /
    • 1994
  • 본 논문에서는 윈도우즈용 음성인식 software "voice access"를 개발하여 연구한 실시간 음성검출 알고리즘에 관해 소개한다. 이 음성검출 알고리즘은 200 sample 단위의 프레임 에너지, 프레임 영교차율, 음성의 길이를 음성검출의 파라메타로 사용한다. 각 파라메타의 문턱값은 신호의 평균값, 잡음의 표준편차, 미디안 표준편차와 한국어의 음성적 특성을 고려하여 설정하였으며 주변의 환경에 적응해 가며 문턱값을 조정하므로 주변 잡음환경의 변화에 대해서도 강인한 음성검출 결과를 보여준다. 또한 실시간으로 음성을 검출하므로 실용성이 높다. 음성의 검출은 일반사운드 카드를 통해 16-bit의 8KHz로 샘플링된 신호를 사용한다. 음성검출을 위한 분석은 200 sample 씩 하고 100 sample 씩 overlap 하면서 수행한다. 음성검출을 위한 모든 분석은 특별한 DSP의 도움없이 486D 이상에서 실시간으로 구현했다.시간으로 구현했다.

  • PDF

가변전송률 음성부호화기 적용을 위한 음성활성도 측정 알고리즘 설계 (Design of Voice Activity Detection Algorithm for Variable Rate Speech Coders)

  • 김재원
    • 한국통신학회논문지
    • /
    • 제26권9A호
    • /
    • pp.1451-1458
    • /
    • 2001
  • 디지털 이동통신 시스템에서 가장 빈번하게 발생하는 음성 서비스의 궁극적인 목표는 양호한 음성 품질과 높은 주파수 효율의 제공에 있다. 음성은 묵음 구간에 의하여 구분되어진 짧고 간헐적인 음성 에너지의 반복으로 표현 가능하며 실제 음성 통화중 활성 음성이 존재하는 구간은 약 40%, 나머지 60% 구간은 묵음 또는 상대방의 음성을 듣는 구간이다. 이 묵음 구간을 효율적으로 활용함에 의해 시스템의 스펙트럼 이득을 얻을 수 있다. 본 논문에서는 디지털 이동통신 시스템과 같이 다양하게 변화하는 주변 잡음 환경에서도 강건하게 동작 가능하여 10msec 프레임 크기를 갖는 음성부호화기에 적용 가능한 음성 활성도 측정 방안을 설계하였다. 설계된 알고리즘은 음성에너지, 스펙트럼 분포, 영교차율, 그리고 LPC 잔여신호의 Peakiness 측정값을 이용하였다.

  • PDF

변형된 이득함수를 이용한 잡음 환경에서의 음성인식 (Speech Recognition in Noisy Environments Using Modified Gain Function)

  • 진호성;이상호;홍재근
    • 한국산학기술학회:학술대회논문집
    • /
    • 한국산학기술학회 2010년도 춘계학술발표논문집 1부
    • /
    • pp.119-123
    • /
    • 2010
  • 본 논문에서는 2단계 잡음제거 방법의 이득함수를 이용한 고조파 복원 잡음제거 방법의 이득함수를 조정하여 기존의 방법보다 음성개선을 향상시켰고, 제안한 방법으로 개선된 음성을 음성인식 기술에 적용하였다. 본 논문에서는 기존 방법으로 음성개선 결과 묵음구간에서 음성구간으로 변화는 구간에서 이전 프레임의 추정된 음성신호로 스펙트럼의 이득함수가 구해져서 음성이 발생하는 구간에서 왜곡이 발생한다. 따라서 본 논문에서는 이러한 현상을 개선시키기 위해 2단계 잡음제거 방법의 이득함수를 추정된 a priori SNR과 비교하여 이득함수를 조정하고, 2단계 잡음제거 방법의 이득함수를 고조파 복원 방법의 이득함수와 비교하여 이득함수를 조정하여 음성을 개선하는 방법을 제안하였다. 그리고 음성인식을 위한 특징벡터 추출을 위해 제안한 방법으로 개선된 음성의 대수 에너지를 정규화 하는 대수 에너지 정규화 방법(Log Energy Normalization)을 음성인식 방법에 적용하였다.

  • PDF

차량내 잡음 환경에서 적응적 경계값을 이용한 가중치 주파수 차감에 관한 연구 (A Study on Weighted Spectral Subtraction Using Adaptive Threshold in Car Noise Environment)

  • 전선도;강철호;김종찬;김순협
    • 한국음향학회지
    • /
    • 제17권8호
    • /
    • pp.73-77
    • /
    • 1998
  • 본 연구는 자동차내 배경 잡음에 의해 손상된 음성에서 배경 잡음을 주파수 차감에 의하여 제거시킨다. 특히 음성정보의 손실이 적은 잡음 추정 방법으로 가중치를 이용하여 잡음을 가중치 주파수 차감법을 이용하였다. 이러한 가중치 주파수 차감법은 잡음의 변화가 완만한 경우에 적당하다. 그러나 실제적인 상황에서 배경잡음신호의 변화가 큰 경우가 존재 한다. 이러한 이유는 본 연구는 잡음 추정시 잡음 추정값을 이용하여 추정 잡음 경계값을 적응적으로 변화시키는 차감법을 제안한다. 이 방법은 추정된 잡음 신호의 변화율을 이용하 여 경계값을 상황에 따라 적응적으로 변화시키는 방법이다. 모의 실험에 의하여 고정적인 경계값을 갖는 가중치 주파수 차감법에 비해 제안한 적응적 경계값을 갖는 가중치 주파수 차감법의 출력 SNR이 증가함을 확인하였고, 음성 인식 시스템에 적용한 인식 실험에서도 성능이 향상됨을 확인하였다.

  • PDF

Evaluation of voice parameters following supracricoid laryngectomy

  • 김민식;조승호;박영학;선동일;김형태;유우정
    • 대한음성언어의학회:학술대회논문집
    • /
    • 대한음성언어의학회 1997년도 제8회 학술대회 심포지움
    • /
    • pp.260-260
    • /
    • 1997
  • 상윤상후두부분적출술은 과거 후두전적출술을 실시하던 환자들에서 선택적으로 사용하여 만족할만한 종양학적 결과 및 후두의 생리적인 기능을 보존 할 수 있어 점차 널리 보급되고. 있다. 이 술식후의 기능변화나 보상기전등에 대하여는 잘 알려지지 않았으나 정상인과 비교하여 음성지표들의 변화가 보고되고 있다. 이 수술은 원발병소의 위치에 따라 CHEP, CHP 방범으로 재건할 수 있으며 종양의 범위에 따라 일측의 피열연골과 윤상연골의 앞부분을 제거하는 extended procedure등이 사용되고 있다. (중략)

  • PDF

Spatio-temporal 방법을 이용한 우리말 모음 인식에 관한 연구 (A Study on the Vowel Recognition of Korean Speech using Spatio-temporal Method)

  • 송도선;김선일;김석동;이행세
    • 한국음향학회지
    • /
    • 제12권4호
    • /
    • pp.57-62
    • /
    • 1993
  • 본 논문은 신경망을 이용한 우리말 모음에 대한 인식 연구이다. 음성을 나누거나. 음소별 인식이나, 시간 신축 방법을 사용하지 않고 모음을 인식하였다. 식나의 변화에 따른 음성의 변화를 정적인 음성으로 취급하였다. 10개로 균등히 나눈 프레임에 각 프레임마다 10차의 PARCOR계수를 추출하였다. 신경망의 구조를 간단히 하기 위해서 단모음과 복모음을 구분하여 학습시켰으며, 출력 노드의 수를 감소시키기 위해 이진 코드 형태로 구성하였다.

  • PDF

시각 형태 정보와 소리 정보가 한자 단어 재인에 미치는 영향 (The Effects of Visual and Phonological Similarity on Hanja Word Recognition)

  • 남기춘
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1995년도 제7회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.244-252
    • /
    • 1995
  • 본 연구는 한자를 이용하여 시각 정보 (Visual Information)와 음성 정보(Phonological Information)가 단어 재인과 단어 명명 과정에 어떻게 영향을 주는 지를 조사하기 위하여 실시되었다. 기존의 영어를 이용한 연구에서는 시각 정보와 음성 정보를 독립적으로 조작할 수 없었기에 두 요소가 단어 재인에 어떤 영향을 주는 지를 살피는데 어려움이 있었다. 그러나 한자단어를 이용하면 시각 정보와 음성 정보를 독립적으로 조작할 수 있기 때문에 영어 단어를 사용하는 것보다 유리하다. 본 실험에서는 한자 단어를 이용하여 점화 단어 (Prime Word)와 목표 단어(Target Word)간의 시간간격(SOA)을 100 ms, 200 ms, 750 ms, 그리고 2000 ms로 변화시키면서 시간이 흐름에 따라 시각적 유사성과 음성적 유사성에 의한 점화 효과(Priming Effect)가 어떻게 변화하는 지를 조사하였다. 이 실험 결과에 의하면, 100 ms 조건에서는 시각적 유사성에 의한 점화 효과만 있었다. 그러나, 200 ms, 750 ms, 2000 ms 조건들에서는 시각적 유사성뿐만 아니라 음성적 유사성에 의해서도 점화효과가 있었다. 이와 같은 실험 결과는 최초의 한자 단어의 어휘 접근 (Lexical Access)이 시각 정보에 의해 결정됨을 보여주고 있다.

  • PDF