음성의 음향 스펙트로그램 분석

  • 지민제
    • Proceedings of the KSLP Conference
    • /
    • 1995.11a
    • /
    • pp.111-127
    • /
    • 1995
  • 한국어 모음과 자음의 파형, 스펙트로그램을 통해 다음 사항을 중점적으로 다룬다. - 모음과 자음의 조음 및 음향적 특성, - 모음의 좁힙점과 음향적 특성, - /모음+모음/과 /반모음+모음/의 차이, - 자음의 조음 방법 및 조음장소에 따른 음향적 특성, - 음성환경에 따른 음향적 특성, - 유/무성에 따른 음향적 특성, - 연/경성에 따른 음향적 특성, - 동시조음에 따른 음향적 특성, - 소리의 길이 (중략)

A Study on Phoneme-Based PSOLA Speech Synthesis Using LSP (LSP를 이용한 음소단위 PSOLA 음성합성에 관한 연구)

  • 권혁제;조순계;김종교
    • The Journal of the Acoustical Society of Korea
    • /
    • v.17 no.2
    • /
    • pp.3-10
    • /
    • 1998
  • 본 논문에서는 음소단위 PSOLA 한국어 합성을 LSP line의 조절과 자모음 분석을 통해서 실시하였다. 음성합성에서 많이 사용하는 triphone, diphone, demisyllable등과 같은 합성단위들은 자연스러운 합성음을 위해 다양한 음운환경에서 수집된다. 그러나, 이런 방법 은 많은 시간과 메모리가 요구된다. 본 논문에서는 합성단위로서 자음17개, 모음 16개로 총 33개의 음소를 이용하였다. 자음은 후위모음/이/인 CV에서 segment되고, 모음은 단음절의 단모음과 이중모음을 1인의 화자로부터 합성데이터를 수집하였다. 또한, 10명의 화자가 발성 한 CV에서 각 모음에 따라 변하는 자음의 주파수를 분석하였고, CV+VC 또는 CV+CV에서 각 자음에 따라 변하는 모음의 포먼트변화를 분석하였다. 분석결과를 토대로 모음은 LSP line을 조절해서 PSOLA합성을 하고, 자음은 합성하려는 모음과 결합하였다. 그 결과 6개의 합성단어에 대한 청취율은 65%를 보였다.

Korean Speech Recognition using the Phoneme (음소를 이용한 한국어의 인식)

  • 김영일;차일환;조문재
    • The Journal of the Acoustical Society of Korea
    • /
    • v.3 no.2
    • /
    • pp.35-45
    • /
    • 1984
  • 본 연구는 한국어의 발음상의 특징과 구조에 의해서 한국어를 음소별로 분리할 수 있음에 착안 하여, 자음과 모음으로 구성된 한국어 단음을 자음의 음소와 모음의 음소로 각각 분리하여 인식하는 새 로운 방법에 관한 연구이다. 특정 화자 2명에 대하여 한국어 단음 84자를 모음의 음소와 자음의 음소로 각각 분리하여 인삭한 실험결과 모음을 인식한 경우에는 선형 예측 계수를 이용하면 인식률이 95.2%이 고, 편자기 상관계수로 92.5%, 폴만트로 97.6%의 인식률을 얻었고, 자음을 인식한 경우에는 선형 예측 계수로 88.7%, 편자기 상관계수로 92.9%의 인식률을 얻었다. 또, 자음의 음소와 모음의 음소를 결합시킨 단음을 인식한 경우에는 선형 예측 계수로 83.9%, 편자기 상관계수로 86.3%의 인식률을 얻었다. 이 때, 각 음소들의 데이터의 수는 256개이고, 선형 예측 계수와 편자기 상관 계수와의 예측차는 15차이다. 이 와 같이 한국어를 자음의 음소와 모음의 음소로 분리하면 작은 데이터 양으로 처리 시간을 단축 시켜 한국어의 모든 단음, 단어, 연속음, 문장 등을 분석하고 인식할 수 있고, 또한 각 음소들을 원칙적으로 결합시켜 모든 한국어의 합성이 가능함을 알 수 있다.

A study on English vowel duration with respect to the various characteristics of the following consonant (후행하는 자음의 여러 특성에 따른 영어 모음 길이에 관한 연구)

  • Yoo, Hyunbin;Rhee, Seok-Chae
    • Phonetics and Speech Sciences
    • /
    • v.14 no.1
    • /
    • pp.1-11
    • /
    • 2022
  • The purpose of this study is to investigate the difference of vowel duration due to the voicing of word-final consonants in English and its relation to the types of word-final consonants (stops vs. fricatives), (partial) devoicing, and stop releasing. Addtionally, this study attempts to interpret the findings from the functional view that the vowels before voiced consonants are produced with a longer duration in order to enhance the salience of the voicing of word-final consonants. This study conducted a recording experiment with English native speakers, and measured the vowel duration, the degree of (partial) devoicing of word-final voiced consonants and the release of word-final stops. First, the results showed that the ratio of the duration difference was not influenced by the types of word-final consonants. Second, it was revealed that the higher the degree of (partial) devoicing of word-final voiced consonants, the longer vowel duration before word-final voiced consonants, which was compatible with the prediction based on the functional view. Lastly, the ratio of the duration difference was greater when the word-final stops were uttered with the release compared to when uttered without the release, which was not consistent with the functional view. These results suggest that it is not sufficient enough to explain the voicing effect by its function of distinguishing the voicing of word-final consonants.

Segmental and prosodic environments and vowel devoicing in Korean (분절음적, 운율적 환경과 무성모음의 실현)

  • Shin Ji-Young;Chae Eun-Ae
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • spring
    • /
    • pp.309-312
    • /
    • 2002
  • 무성모음화 현상이 어떠한 분절음적, 운율적 환경에서 주로 실현되는가를 알아보기 위하여 선행자음의 분절음적 환경, 후행자음의 분절음적 환경, 해당 강세구의 음절수, 운율 구조상의 위치 등 모두 네 가지를 변수로 실험을 진행하였다. 모두 10명의 화자(남5, 여5)가 발화한 1140개의 자료에 나타난 행당 모음의 길이를 측정하는 방법으로 분석을 실시하였다. 그 결과 선행자음은 [+기식성]과 [+지속성]을 가진 환경이, 후행 자음은 [-지속정]과 [기식성]을 가진 환경이 무성모음화가 잘 일어나는 환경인 것으로 밝혀졌다. 음절수의 증가는 큰 영향을 주지 않는 것으로 보였고, 대체로 두 번째 강세구의 단어초에 위치하는 경우에 모음의 길이가 짧거나 무성모음화되는 경향이 관찰되었다.

    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • autumn
    • /
    • pp.355-360
    • /
    • 1999
  • 이 연구는 폴란드어의 음성. 음운 체계를 조음 음성학에 기초를 두어 살펴보고, 한국어의 음성. 음운과 대조한다 모음은 한국어가 많고, 자음은 폴란드어가 더 많다. 한국인이 구별하기 힘든 모음 /i/와 /y/의 차이점과 슬라브어에서 유일하게 폴란드어에만 있는 비모음을 알아보고, 한국어에 없는 자음 $/\'{3}/$와, 중설연구개음 $/\'{k},\;\'{g},\;\'{s},\;\'{z},\;\'{c},\;\'{3},\;\'{n}/$과 기본적으로 자음에서 일어나는 음운 규칙들을 살펴본다. 모음 변화는 형태론과 연관지어 살펴보아야 하므로 여기에서는 제외한다. 폴란드어와 한국어의 음성. 음운 대조는 첫째, 모음과 자음 분절음의 대조, 둘째, 음운 현상의 대조, 셋째, 음절구조상의 대조로 분류하고, 분절음의 대조에 초점을 두고 조음표상에 대조를 이음과 함께 표시한다.

A study on consonantal voicing-dependent vowel duration in English (영어의 자음 유.무성 대립과 선행모음길이와의 상관관계 연구)

  • 고현주
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1998.06c
    • /
    • pp.399-402
    • /
    • 1998
  • 영어에서 자음의 유.무성 대립이 선행모음에 미치는 영향은 다른 여느 언어에서보다 두드러지게 커서 언어 보편적이기보다는 영어 특유의 음운현상으로 보는 견해가 주류를 이루고 있다. 본 연구에서는 영어를 학습하고 있는 한국어 화자들이 영어특유의 이 현상을 어떻게 인지하여 실현하고 있는지를 발성실험을 통하여 알아보고 더 나아가 모음길이가 후행자음의 유.무성 인지에 어떤 실마리로 작용하는지 인지실험을 통하여 알아보았다.

An spatio-temporal study on Kroean affricates (한국어 파찰음의 조음에 대한 시간적.공간적 연구)

  • 신지영
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • 1998.06c
    • /
    • pp.375-378
    • /
    • 1998
  • 본 연구의 목적은 한국에 존재하는 세 종류 파찰음/ㅈ,ㅊ, ㅉ/의 시간적.공간적 조음 특성을 전자구개도와 스펙트로그램 분석을 통하여 면밀히 검토해 보려는 것이다. 이를 위하여 두 실험이 행해 졌는데, 조음 음성학적인 실험(전자구개도를 이용한 실험)에는 한 명의 피험자가, 그리고 음향 음성학적인 실험(음향 자료의 스펙트로그램 분석)에는 세 명의 피험자가 발화한 자료가 이용되었다. 대상이 되는 세 자음들은 /ㅏ_ㅏ/, /ㅡ_ㅡ/, /ㅣ_ㅣ/ 등 세 모음 사이에서 발화되었으나, 모음이 자음의 조음에 미치는 영향, 즉 모음_자음 동시조음은 본 연구의 범위에서 제외되었다.

Cluster Reduction by Korean EFL Students: Insertion vs. Deletion Strategies (한국 EFL 학생들의 자음군 축약: 삽입 대 탈락 전략)

  • Cho Mi-Hui
    • The Journal of the Korea Contents Association
    • /
    • v.6 no.1
    • /
    • pp.80-84
    • /
    • 2006
  • Motivated by the fact that cluster reduction strategies such as inserting a vowel or deleting a consonant in resolving English complex clusters differ depending on studies, this paper investigates the repair strategies employed by Korean EFL students. A total of 60 college students participated in the present study and the participants' production of English voiceless word-initial and word-final clusters was measured using the materials designed for this study. It has been shown that prosodic positions such as onset and coda and the number of cluster sequences influenced cluster reduction strategies. The error rates of both insertion and deletion were noticeably higher in the coda position than in the onset position and both insertion and deletion error rates were higher in triconsonatal cluster than in biconsonantal cluster sequences. Overall, the insertion rate was higher than the deletion rate. However, the deletion rate was significantly higher than the insertion rate in triconsonantal coda cluster sequences. Because of this, the deletion rate was higher than the insertion rate for triconsonantal cluster sequences across onset and coda. Also, the high deletion rate of triconsonantal coda clusters contributed to the high deletion rate for the coda clusters in general.

A Study on the Korean Grapheme Phonetic Value Classification (한국어 자소 음가 분류에 관한 연구)

  • Yu Seung-Duk;Kim Hack-Jin;Kim Soon-Hyop
    • Proceedings of the Acoustical Society of Korea Conference
    • /
    • autumn
    • /
    • pp.89-92
    • /
    • 2001
  • 본 논문에서는 한국어 대용량 음성인식 시스템의 기초가 되는 자소(grapheme)가 지니는 음가를 분류하였다. 한국어 자소를 음성-음운학적으로 조음 위치와 방법에 따라 분류하여, 그 음가 분석에 관한 연구와 함께 한국어 음성인식에서 앞으로 많이 논의될 청음음성학(auditory phonetics)에 대하여 연구하였다. 한국어는 발음상의 구조와 특성에 따라 음소 분리가 가능하여 초성, 중성, 종성 자소로 나눌 수 있다. 본 논문에서 초성은 자음음소 18개, 중성은 모음 음소(단모음, 이중모음) 17개, 그리고 'ㅅ' 추가 8종성체계의 자음음소로 하였다. 청음음성학적 PLU(Phoneme Like Unit)의 구분 근거는 우리가 맞춤법 표기에서 주로 많이 틀리는 자소(특히, 모음)는 그 음가가 유사한 것으로 판단을 하였으며, 그 유사음소를 기반으로 작성한 PLU는 자음에 'ㅅ' 종성을 추가하였고, 모음에 (ㅔ, ㅐ)를 하나로, (ㅒ, ㅖ)를 하나로, 그리고 모음(ㅚ, ㅙ, ㅞ)를 하나의 자소로 분류하였다. 혀의 위치와 조음 방법과 위치에 따라 분류한 자음과 모음의 자소를 HTK를 이용하여 HMM(Hidden Markov Model)의 자소 Clustering하여 그것의 음가를 찾는 결정트리를 검색하여 고립어인식과 핵심어 검출 시스템에 적용 실험한 결과 시스템의 성능이 향상되었다.

