통합 검색 | Korea Science

음성인식을 위한 청각신경 정보처리 모델링 (Auditory Neural Information Processing Modeling for Speech Recognition)

이희규;이광형
- 한국음향학회지
- /
- 제9권3호
- /
- pp.42-47
- /
- 1990
음성처리 및 인식기기의 기능을 향상시키기 위해서는 생체공학적인 방법을 이용한 인체의 청각신경 정보처리 시스템의 연구가 중요하다. 그래서 본 논문에서는 와우각의 메카니즘을 분석한 기저막의 IIR 디지털 필터 모델링이 연구되었다. 특히 음소검출필터와 측징 추출을 위한 변별기능을 이용한 자음인식의 다층신경 모델을 구성한다. 이 모델은 자음인식에 있어서 90% 이상의 높은 감지율을 나타내고 있다.
PDF

음성파형의 비대칭율을 이용한 음소의 전이구간 검출 (On Detecting the Transition Regions of Phonemes by Using the Asymmetrical Rate of Speech Waveforms)

배명진;이을재;안수길
- 한국음향학회지
- /
- 제9권4호
- /
- pp.55-65
- /
- 1990
연속음 인식을 위해서는 음성신호의 음성학적 경계를 결정짓는 분할과정이 필요하다. 본 논문에서는 음성신호의 전이구간을 결정하기 위한 파라미터로 한 프레임 내의 비대칭율을 제안하였다. 제안된 그 프레임에서 음성진폭의 변화율을 대별하며, 인근 프레임의 비대칭율과 비교하면 현재의 프레임이 정상상태 혹은 전이영역에 있는지를 구별할 수 있게 해 준다.
PDF

HMM 인식기에서 상태별 다중 특징 파라미터 가중 (State-Dependent Weighting of Multiple Feature Parameters in HMM Recognizer)

손종목;배건성
- 한국음향학회지
- /
- 제18권4호
- /
- pp.47-52
- /
- 1999
본 논문에서는 특징 파라미터의 분산과 인식성능에 대한 기여도를 고려하여 각 특징 파라미터를 가중시키는 방법을 제안하였다. 각 특징 파라미터의 인식률에 비례하게 전체 기여도를 설정하고, 각 특징 파라미터의 분산에 따라 가중요인을 설정하였다. 전체 기여도와 분산에 따른 가중요인을 사용하여 각 특징 파라미터의 상태별 가중치를 설정하였다. 제안한 방법의 유효성을 살펴보기 위해 유사음소 단위의 HMM 음성인식시스템을 사용하여 인식실험을 하였다. 인식실험에서 제안한 방법으로 가중치를 설정하였을 경우에 인식률이 7.7% 향상됨을 볼 수 있었다.
PDF

한국어 발음열 자동 생성을 위한 형태소 태그 정보 기반의 텍스트 전처리기 (Text Preprocessor for Generating Korean Automatic Pronunciation Variants Using Morpheme-trg Information)

이경님;정민화
- 한국정보과학회:학술대회논문집
- /
- 한국정보과학회 2001년도 가을 학술발표논문집 Vol.28 No.2 (2)
- /
- pp.199-201
- /
- 2001
일반적으로 발음열 자동 생성기는 음성 인식 및 음성 합성에 사용되며, 그 주된 역할은 입력된 한글 철자에 대해 발음 나는 데로 표기된 음소열로 출력하는 것이다. 그러나 실제 입력되는 문장에는 특수 기호 및 알파벳. 아라비아 숫자, 영어 단어, 알파벳과 숫자가 혼용된 약어, 기호 단위 명사 등이 포함되어 있다. 게다가 아라비아 숫자의 경우 단위 명사의 종류에 따라서 뿐만 아니라, 문맥에 따라 숫자를 읽는 방식이 달라지게 된다. 이러한 모든 현상들을 발음열 생성기 내부에서 처리하게 되면 선행작업이 상대적으로 크게 되어 과부하 문제 가 발생된다. 또한 어절 내의 문맥 정보만으로 정확한 변환 결과를 얻기 힘들기 때문에 형태소 분석 수행 결과 및 예외처리를 위 한 루틴을 포함하여 한글 자소 단위의 입력형식으로 변환하는 전처리 시스템을 구성하였다.
PDF

연속분포 HMM을 이용한 음성인식 시스템에 관한 연구 (A Study on Speech Recognition System Using Continuous HMM)

김상덕;이극
- 한국멀티미디어학회:학술대회논문집
- /
- 한국멀티미디어학회 1998년도 추계학술발표논문집
- /
- pp.221-225
- /
- 1998
본 논문에서는 연속분포(Continuous) HMM(hidden Markov model)을 기반으로 하여 한국어 고립단어인식 시스템을 설계, 구현하였다. 시스템의 학습과 평가를 위해 자동차 항법용 음성 명령어 도메인에서 추출한 10개의 고립단어를 대상으로 음성 데이터 베이스를 구축하였다. 음성 특징 파라미터로는 MFCCs(Mel Frequency Cepstral Coefficients)와 차분(delta) MFCC 그리고 에너지(energy)를 사용하였다. 학습 데이터로부터 추출한 18개의 유사 음소(phoneme-like unit : PLU)를 인식단위로 HMM 모델을 만들었고 조음 결합 현상(채-articulation)을 모델링 하기 위해 트라이폰(triphone) 모델로 확장하였다. 인식기 평가는 학습에 참여한 음성 데이터와 학습에 참여하지 않은 화자가 발성한 음성 데이터를 이용해 수행하였으며 평균적으로 97.5%의 인식성능을 얻었다.
PDF

포르만트를 이용한 한국어 단모음 분류 시스템의 개발에 관한 연구 (A Study on The Development of the Korean Vowel Discrimination System Using Formant)

최윤석;김기석;황희용
- 대한전기학회:학술대회논문집
- /
- 대한전기학회 1987년도 전기.전자공학 학술대회 논문집(II)
- /
- pp.1107-1110
- /
- 1987
한국어 음소 인식 시스템의 구현을 위한 한 단체로써 한국어 모음의 분류를 위한 시스템을 설계하였다. 특징 파라미터로는 에너지, 영교차율 그리고 제 1, 제 2, 제 3 포르만트를 사용하였다. [아, 어, 오, 우, 으, 이, 에, 애]의 8개의 단모음에 해당하는 총 132개의 음성 데이터에 대하여 실험하였다. 각각의 모음에 대한 포르만트의 평균치를 구한 뒤 이들의 값을 표준 패턴으로 갖는 인식 시스템을 구현한다. 구현된 인식 시스템에 의하여 새로운 음성의 모음부가 어떤 모음인지를 인식하며 결정할 때의 거리 측정 방식으로는 선형분류 함수를 사용하였다. 132개의 모음에 대하여 62.9%의 인식율을 나타내었다.
PDF

성문파형이 모음음소합성에 미치는 영향 (Effect of Glottal Wave Shape on the Vowel Phoneme Synthesis)

안점영;김명기
- 한국통신학회논문지
- /
- 제10권4호
- /
- pp.159-167
- /
- 1985
男性話者가 發音한 韓國語母音/아, 에, 이, 오, 우/의 聲門波를 직접 抽出하여 音聲에 따라 성문파가 각각 다르다는 것을 확인하였다. 具現한 5가지의 성문파로 母音을 다시 合成하여 聲門波形이 音聲合成에 미치는 영향을 波形的으로 비교하였다. 상문파의 모양, 개방시간과 폐쇄기간에 따라 合成音聲波形은 變化가 있었으며, 聲門波形이 合成音質向上의 중요 factor로 作用함을 알 수 있었다.
PDF

심볼을 이용한 한국어 숫자음의 광역 음소군 분류에 관한 연구 (A study of broad board classification of korean digits using symbol processing)

이봉규;이극;황희융
- 대한전기학회:학술대회논문집
- /
- 대한전기학회 1989년도 하계종합학술대회 논문집
- /
- pp.481-485
- /
- 1989
The object of this parer is on the design of an broad board classifier for connected. Korean digit. Many approaches have been applied in speech recognition systems: parametric vector quantization, dynamic programming and hiden Markov model. In the 80's the neural network method, which is expected to solve complex speech recognition problems, came bach. We have chosen the rule based system for our model. The phoneme-groups that we wish to classify are vowel_like, plosive_like fricative_like, and stop_like.The data used are 1380 connected digits spoken by three untrained male speakers. We have seen 91.5% classification rate.
PDF

표준 중국어의 구어 명료도와 음소 대조 및 음향 자질의 발달적 상관관계 (Speech Developmental Link between Intelligibility and Phonemic Contrasts, and Acoustic Features in Putonghua-Speaking Children)

한지연
- 대한음성학회지:말소리
- /
- 제59호
- /
- pp.1-11
- /
- 2006
This study was designed to investigate the relationship between intelligibility and phonemic contrasts, and acoustic features in terms of speech development. A total of 212 Putonghua speaking children was participated in the experiment. There were phonemic contrasts significantly related with speech intelligibility: aspirated vs. fricative, retroflex vs. unretroflex, and front vs. back nasal vowel contrast. A regression analysis showed that 88% of the speech intelligibility could be predicted by these phonemic contrasts. Acoustic values were significantly related to the intelligibility of the Putonghua-speaking children's speech: voice onset time of unaspirated stops, and the duration of frication noise in fricatives.
PDF

음소기반 인식 네트워크에서의 단어 검출률을 이용한 문장거부 (Sentence Rejection using Word Spotting Ratio in the Phoneme-based Recognition Network)

김형태;하진영
- 대한음성학회:학술대회논문집
- /
- 대한음성학회 2005년도 춘계 학술대회 발표논문집
- /
- pp.99-102
- /
- 2005
Research efforts have been made for out-of-vocabulary word rejection to improve the confidence of speech recognition systems. However, little attention has been paid to non-recognition sentence rejection. According to the appearance of pronunciation correction systems using speech recognition technology, it is needed to reject non-recognition sentences to provide users with more accurate and robust results. In this paper, we introduce standard phoneme based sentence rejection system with no need of special filler models. Instead we used word spotting ratio to determine whether input sentences would be accepted or rejected. Experimental results show that we can achieve comparable performance using only standard phoneme based recognition network in terms of the average of FRR and FAR.
PDF

검색결과 529건 처리시간 0.019초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)