• 제목/요약/키워드: Voice Training

검색결과 177건 처리시간 0.027초

입술 트릴의 방법에 따른 음향학적 및 전기성문파형검사 측정치 비교 (A comparison of acoustic & electroglottographic measures according to voiced lip trill methods)

  • 이승진;이광용;임재열;최홍식
    • 말소리와 음성과학
    • /
    • 제9권4호
    • /
    • pp.107-114
    • /
    • 2017
  • The purpose of the current study was to compare selected acoustic and electroglottographic measures (closed quotient, pitch, and loudness) among vowel phonation, traditional voiced lip trill ($VLT_T$), modified voiced lip trill methods ($VLT_M$). A total of 21 participants without voice complaints produced 4-second long samples using each phonation method. Results indicated that mean closed quotient of $VLT_M$ was higher than that of vowel phonation and $VLT_T$, while its range and standard deviation measures were higher than those of vowel phonation. Mean, range, standard deviation, maximum of pitch measures of $VLT_M$ were higher than those of vowel phonation. Lastly, mean and maximum loudness of the $VLT_M$ were higher than $VLT_T$. In conclusion, the current data indicate the possibility to use the $VLT_M$ as a training method for singing or a strategy to facilitate generalization effect of voice therapy. Current results also reflect the necessity for further study pertaining to the long-term effect of the $VLT_M$ training method. Clinical implications are discussed.

일반학생과 성악도를 대상으로 Dr. Speech의 음향학적 측정치와 EGG 측정치의 상관관계 비교 연구 (A Correlation Study between Acoustic and EGG Parameters in Ordinary College Students and Classical Singing Students)

  • 안종복;유재연;권도하;정옥란
    • 대한후두음성언어의학회지
    • /
    • 제13권1호
    • /
    • pp.28-32
    • /
    • 2002
  • Background and Objective : Classical singing students who have received in systematic voice training appeared distinctive voice characteristics compared to normal people who have not received in systematic voice training. The purpose of this study was to determine the correlation between acoustic parameters and Electroglottography(EGG) parameters in two groups(ordinary college students vs. classical singing students group). Materials and Methods : The 80 ordinary college students and 65 classical singing students participated in this study by utilizing Dr. speech program to obtain acoustic measurements and physiologic measurements simultaneously. The Pearson correlation coefficient was used to find the correlation between acoustic parameters and EGG parameters in two groups(ordinary college students group and classical singing students group). Results : The results of the study were as follows : First, there was no correlation between Jitter and EGG Jitter in ordinary college students group, but there was strong correlation between Jitter and EGG Jitter in classical singing students group. Second, there was no correlation between Shimmer and EGG Shimmer in ordinary college students group, but there was strong correlation between Shimmer and EGG Shimmer in classical singing students group. Third, there was no correlation between Harmonic to Noise Ratio(HNR) and EGG HNR in ordinary college students group, but there was strong correlation between HNR and EGG HNR in classical singing students group. Finally, there was no correlation between Normalized Noise Energy(NNE) and EGG NNE in two groups.

  • PDF

음성 인식 테크놀로지 기반의 외국어 말하기 훈련 시스템 개발 (Development of a Foreign Language Speaking Training System Based on Speech Recognition Technology)

  • 구덕회
    • 정보교육학회논문지
    • /
    • 제23권5호
    • /
    • pp.491-497
    • /
    • 2019
  • 글로벌 사회로 발전함에 따라 외국어를 능숙하게 말하고 싶어하는 사람들이 많아지고 있다. 능숙하게 말하기 위해서는 말하는 훈련을 충분히 가져야 하는데 이때 대화 상대방을 필요로 한다. 최근에는 음성 인식 정보 기술의 발달로 인하여 대화 상대방의 인간이 없어도 외국어 말하기 훈련을 수행하는 시스템 개발이 가능할 것으로 기대되고 있다. 이에 본 연구에서는 외국어 말하기 훈련 교육을 위한 테스트베드 시스템을 개발하고 초등학교 수업에 적용하였다. 초등학생에게 영어 대화 상황을 제시하고 말하기 훈련을 실시하도록 하였다. 그 후, 시스템에 대한 만족도와 지속적인 활용 가능성을 조사하였다. 본 연구에서 개발한 시스템을 이용하면 외국어 말하기 학습 훈련에 도움이 된다는 점을 확인하였다.

k-clustering 부공간 기법과 판별 공통벡터를 이용한 고립단어 인식 (Isolated Word Recognition Using k-clustering Subspace Method and Discriminant Common Vector)

  • 남명우
    • 대한전자공학회논문지TE
    • /
    • 제42권1호
    • /
    • pp.13-20
    • /
    • 2005
  • 본 논문에서는 M. Bilginer 등이 제안한 CVEM(common vector extraction method)을 이용하여 한국어 화자독립 고립단어 인식실험을 수행하였다. CVEM은 학습용 음성신호들로부터 공통된 특징의 추출이 비교적 간단하고, 많은 계산 량을 필요로 하지 않을 뿐만 아니라 높은 인식 결과를 보여주는 알고리즘이다. 그러나 학습 음성의 개수를 일정 한도 이상으로 늘릴 수 없고, 추출된 공통벡터들 간의 구별정보(discriminant information)를 가지고 있지 않다는 문제점을 가지고 있다. 임의의 음성군으로부터 최적의 공통벡터를 추출하기 위해서는 다양한 음성들을 학습에 사용해야만 하는데 CVEM은 학습용 음성 개수에 제한이 있으므로 지속적인 인식률 향상을 기대하기 어렵다. 또한 공통벡터들 간의 구별정보 부재는 단어 결정에 있어서 치명적인 오류의 원인이 될 수 있다. 본 논문에서는 CVEM이 가지고 있는 이러한 문제점들을 보완하면서 인식률을 향상시킬 수 있는 새로운 방법인 KSCM(k-clustering subspace method)과 DCVEM(discriminant common vector extraction method)을 제안하였고 이 방법을 사용하여 고립단어를 인식하였다. 그리고 제안한 방법들의 우수성을 입증하기 위해 ETRI에서 제작한 음성 데이터베이스를 사용, 다양한 방법으로 실험을 수행하였다. 실험 결과 기존 방법의 문제점들을 모두 극복할 수 있었을 뿐 아니라 기존에 비해 계산량의 큰 증가 없이 향상된 결과를 얻을 수 있었다.

호흡훈련보조기구를 이용한 호흡훈련 전 후의 폐기능 호흡근력과 최대발성지속시간의 변화 (Pulmonary Functionn and the Maximal Inspiratory and Expiratory Pressure, and Maximum Phonation Time Before and After the Specially Programmed Training)

  • 남도현;최홍식;안철민
    • 대한후두음성언어의학회지
    • /
    • 제14권2호
    • /
    • pp.88-93
    • /
    • 2003
  • 성악훈련을 받고있는 여학생들은 호흡훈련과 호흡훈련 보조기구를 이용하여 훈련을 하면서 발성연습을 하면 최대호기압과 최대흡기압이 증가하여 호흡근육의 근력이 증가하였다는 것을 알 수 있었으나 호흡기능에는 변화가 없어 호흡훈련에 의해 폐기능이 증진되지는 않는다는 결론을 얻게 되었다. 최대발성지속시간 역시 크게 증가하여 성악을 공부하는 학생들이 이 방법대로 훈련을 하는 것이 효과적이지 않을까 추정된다.

  • PDF

뇌졸중 환자의 말, 언어장애 선별에 대한 검사자간 신뢰도 및 훈련효과 (Inter-rater Reliability and Training Effect of the Differential Diagnosis of Speech and Language Disorder for Stroke Patients)

  • 김정완
    • 한국콘텐츠학회논문지
    • /
    • 제11권9호
    • /
    • pp.407-413
    • /
    • 2011
  • 뇌졸중 환자의 실어증 유무를 정확히 판별하고 환자의 미세한 언어적 변화를 적절히 관찰하기 위해서는 일차적으로 신뢰로운 검사도구를 사용하여야 하고, 또한 검사자가 해당 도구의 사용에 있어 충분히 숙지하고 있어야 한다. 본 연구에서는 뇌졸중 환자의 실어증 및 말장애 유무의 진단에서 검사자의 전공영역에 따른 관찰자간 신뢰도를 살펴보고 훈련 전과 후의 차이를 비교해보고자 하였다. 이를 위해, 침상에 있는 뇌졸중 환자 46명을 대상으로 언어치료사, 신경과 전공의, 그리고 간호사 각각 4명씩 총 12명이 동시에 실어증 및 말장애 유무를 평가하였다. 연구 결과, 서로 다른 전공 영역의 전문가들 간에 말명료도 과제와/아/모음연장발성 과제의 '음질' 영역에서만 'acceptable'로 나타났고, 나머지 하부검사 영역에서는 'good-excellent'로 나타났다. 관찰자간 신뢰도가 'acceptable'로 나타난 과제들에 대해 3주간의 비디오 훈련 전후의 점수 차이를 비교하였다. 그 결과, 훈련 후 말명료도 과제에서 검사자들 간의 평정 점수의 차이는 유의하게 줄어들었으며, '음질' 평정의 정확성도 유의하게 증가하였다. 임상 경험 정도와 각 하부검사에 대한 평정 정확성 간의 상관관계를 알아본 결과, 언어치료사들은 임상 경험 정도가 증가할수록 그림설명하기 과제와 말명료도 과제에서, 그리고 의사 및 간호사들은 그림설명하기 과제에서 판정 정확도가 높아지는 것으로 나타났다. 결론적으로, 이 연구 결과는 뇌졸중 환자의 의사소통장애 진단에 있어 신경언어장애 환자 중, 특히 말장애환자에 대한 꾸준한 경험과 훈련이 반드시 필요하며, 훈련을 통해 평정 신뢰도를 확보할 수 있음을 시사한다.

Training of Fuzzy-Neural Network for Voice-Controlled Robot Systems by a Particle Swarm Optimization

  • Watanabe, Keigo;Chatterjee, Amitava;Pulasinghe, Koliya;Jin, Sang-Ho;Izumi, Kiyotaka;Kiguchi, Kazuo
    • 제어로봇시스템학회:학술대회논문집
    • /
    • 제어로봇시스템학회 2003년도 ICCAS
    • /
    • pp.1115-1120
    • /
    • 2003
  • The present paper shows the possible development of particle swarm optimization (PSO) based fuzzy-neural networks (FNN) which can be employed as an important building block in real life robot systems, controlled by voice-based commands. The PSO is employed to train the FNNs which can accurately output the crisp control signals for the robot systems, based on fuzzy linguistic spoken language commands, issued by an user. The FNN is also trained to capture the user spoken directive in the context of the present performance of the robot system. Hidden Markov Model (HMM) based automatic speech recognizers are developed, as part of the entire system, so that the system can identify important user directives from the running utterances. The system is successfully employed in a real life situation for motion control of a redundant manipulator.

  • PDF

커널 스펙트럼 모델 backfitting 기반의 로그 스펙트럼 진폭 추정을 적용한 배경음과 보컬음 분리 (Music and Voice Separation Using Log-Spectral Amplitude Estimator Based on Kernel Spectrogram Models Backfitting)

  • 이준용;김형국
    • 한국음향학회지
    • /
    • 제34권3호
    • /
    • pp.227-233
    • /
    • 2015
  • 본 논문은 커널 스펙트럼 모델 backfitting 기반의 로그 스펙트럼 진폭 추정부를 적용한 배경음과 보컬음 분리를 제안한다. 기존의 커널 스펙트럼 모델 기반의 배경음과 보컬음 분리는 추출하고자하는 객체의 모델을 기반으로 위너형태의 평균 제곱의 오차의 이득값을 학습함으로써 배경음과 보컬음을 분리하는 기술이다. 본 논문은 기존의 커널 스펙트럴 모델 기반의 배경음과 보컬음 분리 방식에서 위너형태의 이득값 대신 로그 스펙트럼 진폭 추정을 적용하여 기존 방식 보다 명료한 배경음과 보컬음을 추출한다. 실험결과는 본 논문에서 제안한 방식이 기존의 방식들보다 더 우수하다는 것을 보인다.

성문전도를 이용한 발성훈련 시스템 (Vocal Exercise System Using Electroglottography)

  • 이제현;김지혜;강구태;정동근
    • 센서학회지
    • /
    • 제22권2호
    • /
    • pp.156-161
    • /
    • 2013
  • This study was aimed to implement the electroglottography (EGG) system for analyzing fundamental frequency of the phonation. EGG was recorded from the conductance between ring electrodes attached to the neck skin area near thyroid cartilage with high frequency carrier electric signals during vocalization, and voice signal was recorded with microphone simultaneously. EGG and voice signals were transmitted to the audio port in PC and recorded with stereo sound recording program. From the digitized data, several parameters such as pitch, jitter, shimmer, CQ and SQ were analyzed from the vowel sounds. For the voice training, sound fundamental frequency was displayed during the vocalization and singing a song using pitches analyzed from the EGG. The system implemented in this study could be used for vocal exercise.

화자 적응을 이용한 대용량 음성 다이얼링 (Large Scale Voice Dialling using Speaker Adaptation)

  • 김원구
    • 제어로봇시스템학회논문지
    • /
    • 제16권4호
    • /
    • pp.335-338
    • /
    • 2010
  • A new method that improves the performance of large scale voice dialling system is presented using speaker adaptation. Since SI (Speaker Independent) based speech recognition system with phoneme HMM uses only the phoneme string of the input sentence, the storage space could be reduced greatly. However, the performance of the system is worse than that of the speaker dependent system due to the mismatch between the input utterance and the SI models. A new method that estimates the phonetic string and adaptation vectors iteratively is presented to reduce the mismatch between the training utterances and a set of SI models using speaker adaptation techniques. For speaker adaptation the stochastic matching methods are used to estimate the adaptation vectors. The experiments performed over actual telephone line shows that proposed method shows better performance as compared to the conventional method. with the SI phonetic recognizer.