• 제목/요약/키워드: 비음성

검색결과 1,996건 처리시간 0.025초

차세대 이동통신을 위한 통신망 기술

  • 권은현;이재용
    • 정보와 통신
    • /
    • 제21권7호
    • /
    • pp.94-116
    • /
    • 2004
  • 1968년 ARPA 네트워크의 출현 이후 음성 서비스 위주의 네트워크와 데이터 서비스 위주의 네트워크는 서로의 서비스를 수용하기 위해 노력해왔다. 음성 기반의 네트워크에서 데이터를 수용하기 위한 노력은 ‘꿈의 망’으로 그친 ISDN(Integrated Services Digital Network)으로 나타났고, 데이터 기반의 네트워크에서 음성을 수용하기 위한 노력은 보편적인 비연결형 데이터 서비스와는 대비되는 B-ISDN(Broadband-ISDN)으로 나타났다. 이후 다시 B-ISDN은 IP 서비스의 수용을 위해 ATM 교환기를 MPLS(Multi Protocol Label Switching) 교환기로 대치하여 보완하고 있지만, VoIP(Voice over IP)등 음성서비스의 제공에는 아직 완전한 해법이 제시되지 못하고 있다.(중략)

경음-연음 분류법에 관한 실험음성학적 연구 (An EMG study of the feature 'tensity' with reference to English and Korean)

  • 김대원
    • 대한음성언어의학회:학술대회논문집
    • /
    • 대한음성언어의학회 1993년도 제1회 학술대회 연제순서 및 초록집
    • /
    • pp.11-11
    • /
    • 1993
  • 현존하는 문헌에 의하면, 입술근육의 수축과 운동시간의 측면에서 영어의 자음을 경음-연음분류를 할 수 있는 음성학적 실증이 없는 것으로 나타나고 있다. 본 연구는 근육운동 측정기를 사용하여 영어와 한국어의 양순 정지음의 발화시 근육(orbicularis oris superior muscle)운동을 측정하였다. 영어의 강세음절에서는 기존의 주장과 같이 /p/와 /b/의 발화시 근육운동에 차이가 없거나 일관성이 없는 것으로 나타났으나, 무강세음절에는 기존 이론과 달리 근육운동수축에 있어서 /p/가 /b/에 비하여 통계학적으로 훨씬 큰 것으로 나타났다.(중략)

  • PDF

다화자 음성 합성 시스템 (Multi speaker speech synthesis system)

  • 이준모;장준혁
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2018년도 춘계학술발표대회
    • /
    • pp.338-339
    • /
    • 2018
  • 본 논문은 스피커 임베딩을 이용한 다화자 음성 합성 시스템을 제안한다. 이 모델은 인공신경망을 기반으로 하는 당일화자 음성 합성 시스템인 타코트론을 기초로 구성된다. [1]. 제안 된 모델은 입력 데이터에 화자 임베딩을 추가 데이터로 항께 넣어주는 간단한 방식으로 구현되며 당일화자 모델에 비해 큰 성능 저하 없이 성공적으로 음성을 생성한다.

전문 음성사용자와 직업적 음성사용자의 주관적 음성증상 비교 (Comparison of subjective voice symptoms in elite vocal performers and professional voice users)

  • 김지성
    • 말소리와 음성과학
    • /
    • 제15권4호
    • /
    • pp.27-34
    • /
    • 2023
  • 본 연구는 임상현장에서 직업에 따라 요구되는 음성문제를 이해하는데 도움이 되는 자료를 제공하기 위해 전문 음성 사용자인 직업배우와 직업적 음성사용자인 언어재활사의 주관적 음성증상을 조사하여 그 빈도를 알아보고, 두 집단 간의 주관적 음성증상에 차이가 있는지 비교하였다. 그 결과, 두 집단은 동일하게 11개의 증상 중 '노래 시 고음발성 곤란', '말할 때 목에 힘이 들어감', '음성피로감'이 고빈도 증상으로 나타났다. 두 집단의 주관적 음성증상을 비교한 결과 직업적 음성사용자 집단은 전문 음성사용자 집단에 비해 '노래 시 저음발성 곤란(p=.049)', '쉰 목소리(p=.021)', '말할 때 힘이 듦(p=.032)', '말할 때 목에 통증이 있음(p=.009)', '음성피로감(p=.018)'의 빈도가 더 빈번한 것으로 나타났다. 이러한 차이는 두 집단의 음성사용 환경이 다르고, 직업활동 시 요구되는 발성의 차이로 인한 것으로 사료된다.

음성인식을 위한 환경잡음의 전처리기법에 관한 검토 (A Study on Front-End Processing Methods of Environmental Noise for Speech Recognition)

  • 김광수
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1997년도 영남지회 학술발표회 논문집 Acoustic Society of Korean Youngnam Chapter Symposium Proceedings
    • /
    • pp.17-22
    • /
    • 1997
  • 본 논문에서는 음성 인식기의 성능을 저하시키는 요인중 부가 잡음과 마이크의 변동에 의한 채널 왜곡을 동시에 감소시키는 방법으로 기존의 전처리에 의한 환경덥음처리기법의 단점을 개선한 Histogram 처리기법을 잡음처리에 도입하고 그 유효성을 확인하였다. 도입한 잡음처리기법의 유효성을 확인하기 위하여 기존의 잡음처리기법으로 잘 알려진 여러 가지 방법과 비교하기 위하여 단어 인식실험을 실시하였다. 실험결과, 부가잡음만이 첨가된 경우에 있어서는 일반적으로 알려진 SS, CMN, RASTA등을 이용한 결과 전처리방법을 이용하지 않은 경우의 기본인식률에 비해 SN비에 따라 25% 이상이 인식률 향상을 볼 수 있었다. 특히 CDCN 처리와 H-RASTA를 사용한 경우, 채널왜곡과 부가잡음이 함께 포함된 음성에 대해 SN비에 관계없이 약 15~30%정도의 인식률의 향상을 볼 수 있어 기존 방법으로서는 이글 방법이 우수함을 확인할 수 있었다. 이 위에 Histogram 에 의한 추정법을 적용한 경우 전처리의 성능을 10~15% 정도 성능향상을 가져와 도입한 방법의 유효성을 확인할 수 있었다.

  • PDF

연결형 합성시스템을 위한 비정형 합성단위 추출 및 F0 모델링에 관한 검토 (Study on the Non-uniform synthesis unit selection and FO modeling for concatenative speech synthesis system)

  • 김영일
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 제15회 음성통신 및 신호처리 워크샵(KSCSP 98 15권1호)
    • /
    • pp.93-98
    • /
    • 1998
  • 자연스러운 한국어 음성을 합성할 수 있는 비정형 합성단위 선택기술 및 접합을 이용한 한국어 합성 시스템의 갭라을 최종 목표로 하고 있다. 이러한 최종 목쵸에 도달하기 위해 본 연구팀에서 검토중인 연구방향과 시스템의 구조 및 이를 토대로 현재까지 진행된 결과를 보고한다. 현재 검토중인 시스템은 입력된 문장으로부터 목적치 패턴을 생성하고, 이에 근사한 임의 길이 합성단위를 대량의 음성DB 로부터 선택하여 접합시키는 방식을 이용하고자 한다. 본 논문에서는 음성의 왜곡을 최소화할 수 있는 비정형 합성단위의 추출법에 관한 검토 결과와 본 연구팀에서 성능평가 중인 F0 자동 생성 알고리즘에 대하여 보고한다.

  • PDF

발화 음성을 기반으로 한 감정분석 시스템 (Context sentiment analysis based on Speech Tone)

  • 정준혁;박수덕;김민승;박소현;한상곤;조우현
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2017년도 추계학술발표대회
    • /
    • pp.1037-1040
    • /
    • 2017
  • 현재 머신러닝과 딥러닝의 기술이 빠른 속도로 발전하면서 수많은 인공지능 음성 비서가 출시되고 있지만, 발화자의 문장 내 존재하는 단어만 분석하여 결과를 반환할 뿐, 비언어적 요소는 인식할 수 없기 때문에 결과의 구조적인 한계가 존재한다. 따라서 본 연구에서는 인간의 의사소통 내 존재하는 비언어적 요소인 말의 빠르기, 성조의 변화 등을 수치 데이터로 변환한 후, "플루칙의 감정 쳇바퀴"를 기초로 지도학습 시키고, 이후 입력되는 음성 데이터를 사전 기계학습 된 데이터를 기초로 kNN 알고리즘을 이용하여 분석한다.

차량내 잡음 환경에서 적응적 경계값을 이용한 가중치 주파수 차감에 관한 연구 (A Study on Weighted Spectral Subtraction Using Adaptive Threshold In Car Noise Environment)

  • 전선도
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 학술발표대회 논문집 제17권 1호
    • /
    • pp.185-188
    • /
    • 1998
  • 실제의 음성 인식 및 음성 통신 등의 음성 처리 시스템에서는 음성 신호를 손상시키는 배경 잡음 신호의 존재로 그 성능이 많이 저하된다. 특히 차량 내와 같은 잡음이 극심한 상황에서는 전처리 부분에서 이러한 잡음을 제거시켜 주어야한다. 본 연구는 자동차 내의 배경 잡음에 의해 손상된 음성에서 배경 잡음을 주파수 차감에 의하여 제거시킨다. 특히 음성 정보의 손실이 적은 잡음 추정 방법으로 가중치를 이용하여 잡음을 추정하는 가중치 주파수 차감법을 이용하였다. 이러한 가중치 주파수 차감법 사용의 전제 조건은 잡음의 변화가 완만한 경우에 적당하다. 그러나 실제적인 상황에서 배경잡음신호의 변화가 큰 경우가 존재한다. 이러한 이유에서 본 연구는 잡은 추정시 잡음 추정값을 이용하여 추정 잡음 경계값을 적응적으로 변화하는 차감법을 제안한다. 이러한 방법은 추정된 잡음 신호의 변화율을 이용하여 경계값을 상황에 따라 적응적으로 변화시키는 방법이다. 모의 실험에 의하여 고정적인 경계값을 갖는 가중치 주파수 차감법에 비해 제안한 적응적 경계값을 갖는 가중치 주파수 차감법의 출력 SNR이 증가함을 확인하였고, 음성 인식 시스템에 정용한 인식 실험에서도 성능이 향상됨을 확인하였다.

  • PDF

방사선요법이 초기 후두암 및 정상후두의 음성지표에 미치는 영향 (Effect of Radiation Therapy on Voice Parameters in Early Layngeal Cancer and Normal Larynx)

  • 박한종;이인자;박영학;김민식;조승호
    • 대한음성언어의학회:학술대회논문집
    • /
    • 대한음성언어의학회 1994년도 제2회 학술대회 연제순서 및 초록집
    • /
    • pp.88-88
    • /
    • 1994
  • 초기후두암에 대한 방사선요법은 수술적 치료에 비하여 정상 후두기능 즉 발성 기능을 최대 한 보존할 수 있는 장점이 있다. 그러나 방사선 치료법은 병적 혹은 정상 후두조직에 섬유화, 점막부종 혹은 점액선 간소등의 변영을 초래할 수 있기 때문에 어느 정도의 음성장애를 유발하게 된다. 방사선요법이 후두의 발성기능에 미치는 영향을 알아보기 위하여 초기후두암 환자와 두경부암으로 인하여 정상후두에 방사선 조사를 받았던 환자 및 정상대조군 각 20명에 대하여 음향 및 공기역학적 음성검사를 시행하여 음성장애의 특성을 비교, 검토하였다. 초기 후두암 환자들에게 사는 방사선 치료 후 음성지표들이 관찰되었고, 정상후두에는 큰 영향을 미치지 않았다. (중략)

  • PDF

C++ 언어와 Standard Library 를 이용한 음성인식기 개발 (Development of a Speech Recognition System uSing e++ Language and Standard library)

  • 황규웅
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 제15회 음성통신 및 신호처리 워크샵(KSCSP 98 15권1호)
    • /
    • pp.74-77
    • /
    • 1998
  • 우리는 C++를 이용하여 음성인식기를 구현하여 기존의 C를 이용한 경우에 비하여 30% 수준의 소스로 표현하였고 인식기의 공동개발, 확장 및 개선, 기술 전수 등이 용이하게 되었으며 이를 음성인식 엔진 및 음성인식 연구를 위한 툴로 사용할 수 있게 되었다. 이 인식기의 특징으로는 연속 음성 및 대화체 음성을 인식할 수 있으며 trigram 언어 모델을 사용하였고 문맥 종속 음소 모델링에서는 기존의 triphone 보다 넓은 문맥을 고려한 n-phone context modeling을 사용하였으며 모델의 선정에는 음성학적 지식을 기반으로 한 질문을 사용한 decision tree를 사용하여 훈련에 나타나지 않은 단어나 문맥인 경우라도 가장 가까운 모델을 선정할 수 있게 하였다. 또, tree lexicon을 사용하여 속도를 개선하였으며 state 단위의 모델 공유를 통해 제한된 데이터를 이용하여 더 많은 모델을 훈련할 수 있어 성능을 개선하였다. 상용화를 염두에 두고 pc에서 구현하였다.

  • PDF