통합 검색 | Korea Science

모의 음성 모델을 이용한 효과적인 구개인두부전증 환자 음성 인식 (Effective Recognition of Velopharyngeal Insufficiency (VPI) Patient's Speech Using Simulated Speech Model)

성미영;권택균;성명훈;김우일
- 한국정보통신학회논문지
- /
- 제19권5호
- /
- pp.1243-1250
- /
- 2015
본 논문에서는 VPI 환자 음성을 정상인 음성으로 복원하기 위한 기술의 단계로서 효과적인 VPI 음성 인식 기술을 소개한다. 소량의 VPI 환자 음성을 모델 적응에 효과적으로 사용하기 위해 정상인의 모의 음성을 이용하여 화자 적응을 위한 사전 모델로 이용하는 기법을 제안한다. MLLR 기법을 이용한 화자 적응을 통해 평균 83.60%의 인식률을 보이고, 모의 음성 모델을 화자 적응의 사전 모델로 이용함으로써 평균 6.38%의 인식률 향상을 가져온다. 음소 인식 평가 결과는 제안한 화자 적응 방식이 대폭적인 음성 인식 성능 향상을 가져오는 것을 증명한다. 이러한 결과는 본 논문에서 제안하는 모의 음성 모델을 이용한 화자 적응 기법이 대량의 VPI 환자 음성을 취득하기 어려운 조건에서 보다 향상된 성능의 VPI 환자 음성 인식기를 구축하는데 효과적임을 입증한다.
https://doi.org/10.6109/jkiice.2015.19.5.1243 인용 PDF KSCI KPUBS HTML

개조개, Saxidomus purpuratus 소화맹낭의 미세구조 (Ultrastructure of the Digestive Diverticulum of Saxidomus purpuratus (Bivalvia: Veneridae))

주선미;이정식
- 한국패류학회지
- /
- 제27권3호
- /
- pp.159-165
- /
- 2011
개조개 소화맹낭의 해부학적 구조와 미세구조를 광학 및 전자현미경을 이용하여 기재하였다. 개조개는 한국 여수연안에서 2010년 5월에 채집하였다. 소화맹낭은 진한 녹색으로 생식소 위쪽에 위치하며, 일차소관으로 위와 연결되어 있었다. 소화맹낭은 다수의 소화선세관들로 구성되며, 각각의 소화선세관은 단층 상피층으로 호염기성세포와 소화세포들로 이루어져 있었다. 호염기성세포는 원주형으로 소화세포에 비해 전자밀도가 높았다. 세포질에는 잘 발달된 조면소포체, 관상의 미토콘드리아, 골지체 및 전자밀도가 높고 막을 가진 분비과립들을 함유하고 있었다. 소화세포는 원주형이며, 자유면에는 미세융모가 발달되어 있었다. 세포질 상부에서는 음소포, 용해소체 및 미토콘드리아가 관찰되었다. 본 연구에서 이러한 결과는 소화선세관의 호염기성세포와 소화세포는 각각 세포외 소화와 세포내 소화에 적당하게 분화되었음을 의미한다.
https://doi.org/10.9710/kjm.2011.27.3.159 인용 PDF KSCI

윈도우가 적용된 자기상관에 의한 선형예측부호의 개선 (Improvement of the Linear Predictive Coding with Windowed Autocorrelation)

이창영;이채봉
- 한국전자통신학회논문지
- /
- 제6권2호
- /
- pp.186-192
- /
- 2011
본 논문은 선형예측부호의 개선을 위한 새로운 과정을 제안한다. 코딩에 따른 오차를 줄이기 위하여, 신호에 윈도우를 적용하는 과정과 선형예측 과정의 순서를 바꾸었다. 이 처방은 윈도우를 적용한 자기상관을 이용하여 선형예측부호를 추출하는 것에 해당한다. 기존의 방법에서는 보다 적은 파라미터에 대해 레빈슨-더빈의 재귀적 계산법을 적용하는 것이 가능한 반면, 본 논문에서 제안된 방법에서는 더 많은 작업 파라미터에 대한 역행렬 계산이 필요하므로, 보다 긴 계산 시간이 요구된다. 하지만, 여러 음성 음소에 대해 테스트한 결과, 제안된 방법에 의하면 기존의 기술에 비해 약 5 % 적은 파워 왜곡이 얻어짐이 밝혀졌다. 따라서 부호화의 신뢰성에 관한 한, 기존의 기술에 비해 본 논문에서 제안된 방법이 더 나은 것으로 사료된다. 40명에 의해 발성된 50 고립단어에 대한 화자종속 음성인식 시험에서도 제안된 방법이 보다 우수한 성능을 보여주었다.
https://doi.org/10.13067/JKIECS.2011.6.2.186 인용 PDF KSCI

위치기반 유사도 검증을 이용한 도로표지 안내지명 자동인식 개선방안 연구 (A Study on the Improvement of Automatic Text Recognition of Road Signs Using Location-based Similarity Verification)

정규수
- 한국ITS학회 논문지
- /
- 제18권6호
- /
- pp.241-250
- /
- 2019
도로표지는 도로 이용자를 위한 시설물로서 관리 및 유지보수의 편의성 증진을 위해 국토교통부에서는 관리시스템을 구축하여 운영 중에 있다. 향후 자율주행 시대에 도로표지의 역할은 감소하겠지만 그 필요성은 지속되고 있다. 이에 도로표지에 표기된 안내지명의 정확한 기계적 판독을 위해 도로표지 자동인식 장비를 개발하여 영상 기반의 문자 인식 기술을 적용하고 있지만 불규칙적인 규격과 수작업 제조, 조도, 빛반사, 강우 등 외부환경에 의해 오인식되는 경우가 다수 발생하고 있다. 본 연구에서는 영상 분석 등으로 극복할 수 없는 오인식 결과를 개선하기 위해 위치기반의 안내지명 후보를 도출하여 기준으로 하고, 오인식된 지명의 음소 분리를 통한 레벤슈타인 문자 유사도 검증 방법을 이용해 도로표지 안내지명 자동인식율을 개선하고자 하였다.
https://doi.org/10.12815/kits.2019.18.6.241 인용 PDF KSCI

인공신경망을 이용한 한국어 형태음운현상 연구 (A Study of Morphophonemic Processes of Korean using Neural Networks)

이찬도
- 한국정보처리학회논문지
- /
- 제2권2호
- /
- pp.215-228
- /
- 1995
언어에서 단어가 차지하는 중요성은 매우 크다. 그럼에도 불구하고 단어를 구성하 는 음운론적, 형태소론적 요소에 관한 계산적 연구는 그리 많지 않다. 대개의 전통적 언어학 이론은 추상적인 기저구조와 일련의 명시된 규칙들을 가정함으로 해서 형태음 운현상을 설명한다. 그러나 이러한 접근방법은 (1) 기저구조의 가정, (2) 규칙의 발 견, 그리고 (3) 규칙간의 상호관계 등에서 문제점을 내포하고 있다. 본 연구는 인공신 경망이 단어를 구성하는 음소열과 그 단어의 의미를 학습하는 과정에서 규칙은 생겨난 다는 가정에서 시작한다. 다양한 국어의 형태음운현상에 대한 실험결과는 인공신경망 이 규칙이나 기저구조의 도움없이 형태음운현상을 학습할 수 있음을 보여준다.
PDF

음성인식을 위한 잡음하의 음성왜곡제거 (The suppression of noise-induced speech distortions for speech recognition)

지상문;오영환
- 전자공학회논문지S
- /
- 제35S권12호
- /
- pp.93-102
- /
- 1998
본 논문에서는 잡음에 의해 기인된 음성의 왜곡을 제거하여 음성인식기의 성능을 향상시키는 방법을 기술한다. 잡음 환경에서는 음성의 발성 방식이 변이하고(롬바드효과), 잡음이 음성신호에 첨가되므로 음성인식기의 성능을 저하시킨다. 롬바드 효과는 주변 잡음의 크기나 종류, 화자의 특성과 음소 등에 종속적인 비선형적인 변환이므로 측정방법이 알려져 있지 않았다. 본 연구에서는 롬바드 효과의 크기를 측정하는 방법을 제시하고, 롬바드 효과의 크기에 따른 롬바드 효과의 보정방법을 제안한다. 잡음에 의한 음성의 왜곡은 다음의 과정을 통해서 제거한다. 우선, 스펙트럼 차감법을 사용하여 음성에 포함된 잡잡음을 제거하고, 음성의 동적인 특성을 강조하기 위해 대역 통과 필터링을 한다. 두 번째로 에너지 정규화 과정을 통해서 롬바드 효과에 의한 음성의 발성 강도의 변이를 제거한다. 마지막으로 제안한 롬바드 효과의 크기 척도는 롬바드 음성의 켑스트럼에 존재하는 왜곡을 제거하는 변환에 이용한다. 제안한 방법을 음성인식에 적용한 결과, SNR(signal-to-noise ratio) 0, 10, 20 dB에서 46.3%, 75.5%, 87.4%의 인식률을 82.6%, 95.7%, 97.6%로 향상시켰다.
PDF

연속음성인식 후처리를 위한 음절 복원 rule-based 시스템과 형태소분석기법의 적용 (The syllable recovrey rule-based system and the application of a morphological analysis method for the post-processing of a continuous speech recognition)

박미성;김미진;김계성;최재혁;이상조
- 전자공학회논문지C
- /
- 제36C권3호
- /
- pp.47-56
- /
- 1999
한국어를 연속적으로 발음할 때 여러 가지 음은변동이 일어난다. 이러한 음운변동은 한국어 연속 음성 인식을 어렵게 하는 주요 요인 중의 한가지이다. 본 논문에서는 음운변동이 반영된 음성 인식 문자열을 규칙에 의하여 text 기반 문자열로 다시 복원시키는 rule-based 시스템을 제안한다. 그리고 복원 결과들은 형태소 분석되어 올바른 문자열만 생성된다. 복원은 4가지 rule 즉, 음절 경계 종성 초성 복원 rule, 모음처리 복원 rule,끝음절 종성 복원 rule, 한 음절 처리 rule에 의거하여 이루어진다. 규칙 적용 과정 중에 효과적인 복원을 위해 x-clustering정보를 정의하여 사용하고, 형태소 분석기에 입력될 복원 후보수를 제안하기 위해 postfix음절 빈도정보를 구하여 사용한다. 본 시스템은 규칙기반 시스템이므로 대용량의 발음열 사전이나 음소열 사전을 필요로 하지 않고 문서 기반 형태소 분석기를 그대로 이용할 수 있다는 이점이 있다.
PDF

SOM과 LVQ에 의한 자음의 분류 (Classification of Consonants by SOM and LVQ)

이채봉;이창영
- 한국전자통신학회논문지
- /
- 제6권1호
- /
- pp.34-42
- /
- 2011
음성타자기의 구현에 접근하려는 노력의 일환으로서, 우리는 본 논문에서 자음의 분류에 대해 연구한다. 많은 자음들은 시간에 따른 주기적 거동을 보이지 않고 따라서 그들에 대한 푸리에 해석의 타당성에 확신을 갖기 어렵다. 그러므로, 우선 음성 신호로부터 추출되는 MFCC와 LPCC 특징벡터들이 자음에 대해 어느 정도의 의미가 있는지를 파악하기 위하여 LBG 클러스터링을 통한 벡터양자화를 수행한다. VQ의 실험적 결과는 자음에 대한 푸리에 해석의 타당성에 관해 분명한 결론을 내리는 것이 쉽지 않음을 보여주었다. 자음의 분류를 위해 SOM과 LVQ의 두 가지 신경망이 사용되었다. SOM의 결과는 몇 쌍의 자음들이 나뉘어 분류되지 않음을 보여주었다. LVQ에서는 본질적으로 이 문제가 사라지지만 자음의 분류 정확도는 낮은 수준이었다. 이로부터, LVQ에 의한 자음 분류에 있어서는 MFCC 및 다른 특징 벡터들이 함께 사용되어야 함이 사료된다. 하지만 본 연구에서 도입한 MFCC/LVQ의 결합은 기존의 언어모델을 기반으로 하는 음소 분류에 비해 그 결과가 나쁘지 않은 것으로 나타났다. 모든 경우에 LPCC 특징벡터는 MFCC에 비해 그 결과가 좋지 않았다.
https://doi.org/10.13067/JKIECS.2011.6.1.034 인용 PDF KSCI

이동전화를 위한 단어 인식기의 성능평가 (Evaluation of Word Recognition System For Mobile Telephone)

김민정;황철준;정효열;정현열
- 한국음향학회:학술대회논문집
- /
- 한국음향학회 1999년도 학술발표대회 논문집 제18권 1호
- /
- pp.92-95
- /
- 1999
본 논문에서는 음성에 의해 구동되는 이동천화를 구현하기 위한 기초 실험으로서, 이동전화상에서 많이 사용되는 단어 데이터를 직접 채록하여 단어 인식 실험을 수행하여 인식기의 성능을 평가하였다. 인식 실험에 사용된 단어 데이터베이스는 서울 화자 360명(남성화자 180명, 여성화자 180명), 41상도 화자 240명(남성화자 120명, 여성화자 120명)으로 구성된 600명의 발성을 이용하여 구성하였다. 발성 단어는 이동전화에 주로 사용되는 중요 기능과 제어 단어, 그리고 숫자음을 포함한 55개 단어로 구성되었으며, 각 화자가 3회씩 발성하였다. 데이터의 채집환경은 잡음이 다소 있는 사무실환경이며, 샘플링율은 8kHz였다. 인식의 기본단위는 48개의 유사음소단위(Phoneme Like Unit : PLU)를 사용하였으며, 정적 특징으로 멜켑스트럼과 동적 특징으로 회귀계수를 특징 파라미터로 사용하였다. 인식실험에서는 OPDP(One Pass Dynamic Programming)알고리즘을 사용하였다. 인식실험을 위한 모델은 각 지역에 따라 학습을 수행한 모델과, 지역에 상관없이 학습한 모델을 만들었으며, 기존의 16Htz의 초기 모델에 8kHz로 채집된 데이터를 적응화시키는 방법을 이용하여 학습을 수행하였다. 인식실험에 있어서는 각 지역별 모델과 지역에 관계없이 학습한 모델에 대하여, 각 지역별로, 그리고 지역에 관계없이 평가용 데이터로 인식실험을 수행하였다 인식실험 결과, $90\%$이상의 비교적 높은 인식률을 얻어 인식시스템 성능의 유효성을 확인할 수 있었다.
PDF

에너지 라벨링 그룹화를 이용한 고속 음성인식시스템 (Fast Speech Recognition System using Classification of Energy Labeling)

한수영;김홍렬;이기희
- 한국컴퓨터정보학회논문지
- /
- 제9권4호
- /
- pp.77-83
- /
- 2004
본 논문에서는 입력된 음성의 음소단위로 추출된 에너지 파라미터를 이용하여 에너지를 라벨링(energy labeling)하고 라벨링된 값에 따라 입력 음성을 그룹화하였다. 그리고 동적패턴정합 수행 시 입력된 실험음성에서 검출된 에너지의 크기에 따라 선택된 라벨의 그룹 내에서 DTW를 수행시켜 처리시간을 단축시켜 저가형 프로세서에서도 고속으로 동작할 수 있게 하고자 하였다. 본 논문의 음성 라벨링 단계는 음성의 구간 검출 및 에너지 파라미터의 추출 단계에서 정확한 파라미터의 검출을 전제로 하기 때문에 이를 보완하기 위해 피치의 주기에 따른 가변윈도우를 사용하였다. 피치주기를 먼저 구하고 그 주기에 200 프레임에서 300프레임 사이에서 윈도우의 크기를 결정함으로써 윈도우의 영향이 제거된 에너지를 구하는 방법을 제안하였다. 실험결과 제안된 방법이 약 $25\%$ 정도의 연산량을 감소시켰다.
PDF

검색결과 529건 처리시간 0.033초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)