• 제목/요약/키워드: 화자 파악

검색결과 59건 처리시간 0.023초

적응 정합 필터 마이크로폰 어레이를 이용한 음질 향상 (Speech Enhancement using Adaptive Matched Filter Microphone Array)

  • 이외형;최영근;김기만;박규식
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 2002년도 하계학술발표대회 논문집 제21권 1호
    • /
    • pp.205-208
    • /
    • 2002
  • 최근 영상 회의 시스템에서 화자 위치 추정 및 음질 향상 기술이 연구되고 있다. 이 시스템에서는 마이크로폰 어레이를 이용하여, 화자의 위치를 파악하여 화자의 방향으로 카메라를 자동으로 조정해 주고 그 방향으로부터 입사되는 신호만을 수신할 수 있도록 한다. 이를 위해 마이크로폰 어레이가 연구되어져 왔다. 덜 연구에서는 시간에 따라 변화하는 음향 환경에 적응하는 적응 정합 필터 마이크로폰 어레이를 제안하고, 실험을 통해 그 성능을 고찰하였다.

  • PDF

Matched filter Array를 이용한 음질 향상 시스템 구현 (Implementation of Speech Enhancement System using Matched Filter Array)

  • 오승수;김기만
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국해양정보통신학회 1999년도 추계종합학술대회
    • /
    • pp.173-176
    • /
    • 1999
  • 최근 화상 회의 시스템에서 화자 위치 추정 및 음질 향상 기술이 연구되고 있다. 이 시스템에서는 마이크로폰 어레이를 이용, 화자의 위치를 파악하여 화자의 방향으로 카메라를 자동으로 조정해 주게 된다. 본 연구에서는 마이크로폰 어레이를 통해 수신된 신호를 이용하여 Matched Filter Array를 구성하고 음질을 향상시켰다. 이때 역변환 필터로써 IIR필터를 사용하여 계산량을 줄였으며, 범용DSP 프로세서를 이용한 하드웨어를 제작하여 그 성능을 확인하였다.

  • PDF

문장의 화행을 반영한 한-영 대화체 기계번역 (A Korean to English Dialogue Machine Translation System Using Speech Acts)

  • 이현정;서정연
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1997년도 제9회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.271-276
    • /
    • 1997
  • 대화체는 문어체와는 달리 화자와 청자 사이의 질의/응답으로 이루어진 형태의 문장들을 가지며, 생략과 대용어가 빈번히 발생하는 특징을 갖는다. 이러한 대화 형태에서 어떠한 한 문장에는 화자가 전달하고자 하는 의도를 포함하고 있다. 이러한 대화체 문장들을 번역하는 것은 단순한 언어적 분석에 의한 번역으로서는 많은 번역상의 오류가 발생하게 된다. 따라서 대화체 문장들의 올바른 번역을 위해서는 대화의 상황을 반영하는 문맥 정보가 부가적으로 요구된다. 본 연구에서는 이러한 문맥 정보로서 화행을 사용하여 대화체 기계번역을 수행하고자 한다. 화행(Speech Act)이란 화자에 의해 의도되어 발화 속에 포함된 언어적 행위를 나타내며, 이러한 화행을 분석함으로써 화자의 의도를 파악하고 이를 통해 올바른 번역을 수행할 수 있게 된다. 본 기계번역 시스템에 포함된 화행 분석 과정에서는 대화를 화행으로 모델링한 담화 문법과 유사한 형태의 재귀적 대화 전이망(Recursive Dialog Transition Network)을 사용하게 된다. 본 논문에서는 호텔 예약 영역에서의 기계번역 시스템에 대한 간단한 소개와 화행의 종류 및 분석 방법과 이를 통한 기계번역 방식에 대해 살펴보도록 하겠다.

  • PDF

Voxceleb과 한국어를 결합한 새로운 데이터셋으로 학습된 ECAPA-TDNN을 활용한 화자 검증 (Speaker verification with ECAPA-TDNN trained on new dataset combined with Voxceleb and Korean)

  • 윤금재;박소영
    • 응용통계연구
    • /
    • 제37권2호
    • /
    • pp.209-224
    • /
    • 2024
  • 화자검증(speaker verification)이란 두개의 음성 데이터로부터 같은 화자의 목소리 인지 아닌지를 판단하는것을 말한다. 범죄현장에서 범인의 목소리만이 증거로 남는경우, 두개의 목소리를 객관적이고 정확하게 비교할 수 있는 화자 검증 시스템 또는 화자 매칭 시스템의 구축이 시급하다. 본 연구에서는 한국어에 대한 화자검증 딥러닝 모형을 새롭게 구축하고, 학습에 필요한 적절한 형태의 학습데이터셋에 대해 연구한다. 음성데이터는 고차원이면서 백그라운드 노이즈를 포함하는 등의 변동성이 큰 특징이 있다. 따라서 화자 검증 시스템을 구축하기위해 딥러닝 기반의 방법 선택하는경우가 많다. 본 연구에서는 ECAPA-TDNN 모형을 선택하여 화자 매칭 알고리즘을 구축하였다. 구축한 모형을 학습시키는데 사용한 Voxceleb은 대용량의 목소리 데이터로 다양한 국적을 가진 사람들로부터 음성데이터를 포함하지만 한국어에 대한 정보는 포함하지 않는 다. 본 연구에서는 한국어 음성데이터를 학습에 포함시켰을때와 포함시키지 않았을때 학습 데이터 내 해당언어의 존재 유무가 모델의 성능에 미치는 영향에 대해 파악하였다. Voxceleb으로만 학습한 모델과 언어와 화자의 다양성을 최대로 하기 위해 Voxceleb과 한국어 데이터셋을 결합한 데이터셋으로 학습한 모델을 비교하였을 때, 모든 테스트 셋에 대해 한국어를 포함한 학습데이터의 성능이 개선됨을 보인다.

얼굴 인식 및 화자 정보를 이용한 오프라인 회의 기록 지원 시스템 (Recording Support System for Off-Line Conference using Face and Speaker Recognition)

  • 손윤식;정진우;박한무;계승철;윤종혁;정낙천;오세만
    • 한국지능시스템학회논문지
    • /
    • 제18권1호
    • /
    • pp.66-71
    • /
    • 2008
  • 최근 멀티미디어 서비스는 동영상 압축 기술 및 네트워크의 발달을 기반으로 하여 다양한 응용 서비스를 제공하고 있으며, 이 중 화상 회의 시스템은 이 두 가지 기술이 효과적으로 사용된 대표적인 예이다. 원격 사용자간의 원활한 의사전달을 위해 고려된 화상회의 시스템은 효과적인 응용 서비스로 분류되고 있지만, 이러한 서비스 제공을 위한 기술을 이용하여 빈도가 훨씬 많은 일반적인 회의를 지원하는 응용서비스는 드문 편이다. 본 논문에서는 얼굴 정보와 화자 정보를 기반으로 오프라인 회의를 보조하는 시스템을 제안한다. 제안된 시스템은 3개의 마이크와 웹캠을 이용하여 화자의 위치를 파악하고 웹캠에서 얻어진 정보를 이용하여 얼굴 영역 정보를 분석하고 인식한 후 화자 정보를 추출하여 발언자들을 추적하여 기록하는 기능을 제공한다.

감성적 인간 로봇 상호작용을 위한 음성감정 인식 (Speech emotion recognition for affective human robot interaction)

  • 장광동;권오욱
    • 한국HCI학회:학술대회논문집
    • /
    • 한국HCI학회 2006년도 학술대회 1부
    • /
    • pp.555-558
    • /
    • 2006
  • 감정을 포함하고 있는 음성은 청자로 하여금 화자의 심리상태를 파악할 수 있게 하는 요소 중에 하나이다. 음성신호에 포함되어 있는 감정을 인식하여 사람과 로봇과의 원활한 감성적 상호작용을 위하여 특징을 추출하고 감정을 분류한 방법을 제시한다. 음성신호로부터 음향정보 및 운율정보인 기본 특징들을 추출하고 이로부터 계산된 통계치를 갖는 특징벡터를 입력으로 support vector machine (SVM) 기반의 패턴분류기를 사용하여 6가지의 감정- 화남(angry), 지루함(bored), 기쁨(happy), 중립(neutral), 슬픔(sad) 그리고 놀람(surprised)으로 분류한다. SVM에 의한 인식실험을 한 경우 51.4%의 인식률을 보였고 사람의 판단에 의한 경우는 60.4%의 인식률을 보였다. 또한 화자가 판단한 감정 데이터베이스의 감정들을 다수의 청자가 판단한 감정 상태로 변경한 입력을 SVM에 의해서 감정을 분류한 결과가 51.2% 정확도로 감정인식하기 위해 사용한 기본 특징들이 유효함을 알 수 있다.

  • PDF

남성과 여성의 음성 특징 비교 및 성별 음성인식에 의한 인식 성능의 향상 (Comparison of Male/Female Speech Features and Improvement of Recognition Performance by Gender-Specific Speech Recognition)

  • 이창영
    • 한국전자통신학회논문지
    • /
    • 제5권6호
    • /
    • pp.568-574
    • /
    • 2010
  • 음성인식에서의 인식률 향상을 위한 노력의 일환으로서, 본 논문에서는 성별을 구분하지 않는 일반적 화자독립 음성인식과 성별에 따른 음성인식의 성능을 비교하는 연구를 수행하였다. 실험을 위해 남녀 각 20명의 화자로 하여금 각각 300단어를 발성하게 하고, 그 음성 데이터를 여성/남성/혼성A/혼성B의 네 그룹으로 나누었다. 우선, 성별 음성인식에 대한 근거의 타당성을 파악하기 위하여 음성 신호의 주파수 분석 및 MFCC 특징벡터들의 성별 차이를 조사하였다. 그 결과, 성별 음성인식의 동기를 뒷받침할 정도의 두드러진 성별 차이가 확인되었다. 음성인식을 수행한 결과, 성을 구분하지 않는 일반적인 화자독립의 경우에 비해 성별 음성인식에서의 오류율이 절반 이하로 떨어지는 것으로 나타났다. 이로부터, 성 인식과 성별 음성인식을 계층적으로 수행함으로써 화자독립의 인식률을 높일 수 있을 것으로 사료된다.

정상성인 여성 화자와 음성장애 성인 여성 화자의 문단 낭독 시 휴지 및 호흡단락 특성의 비교 (A comparison study of the characteristics of pauses and breath groups during paragraph reading for normal female adults with and without voice disorders)

  • 표화영
    • 말소리와 음성과학
    • /
    • 제11권4호
    • /
    • pp.109-116
    • /
    • 2019
  • 본 연구는 정상군과 음성장애 환자군의 문단낭독 시 휴지 및 호흡단락 특성을 파악해보고자 시행되었다. 정상군 40명과 기능적 음성장애 환자군 40명을 대상으로 PAS(Phonatory Aerodynamic System) 중 Running Speech를 이용하여 '가을' 문단을 낭독하게 하였다. 이를 통해 흡기 동반 및 미동반, 어절간 및 어절내 휴지와 호흡단락을 구분하고 이에 대한 기술통계 및 집단간 통계적 유의성을 검증하였다. 그 결과 흡기를 동반한 휴지횟수는 환자군이 더 높았으나 흡기를 동반하지 않은 휴지횟수는 정상군이 더 높은 수치를 보였다. 어절경계 중 휴지가 동반된 비율은 환자군이 더 높았고 호흡단락당 음절수는 정상군이 유의하게 더 높았다. 음성장애 화자군은 성대폐쇄부전으로 인한 호흡지지가 정상군보다 부족하므로 휴지 시 흡기를 동반하는 경우나 호흡단락의 수가 더 많은 것으로 사료된다. 이는 일상대화의 자연스러움을 저해할 수 있으므로 음성장애 화자의 중재 시 휴지와 호흡단락의 빈도를 적절히 조절하는 것도 평가 및 중재에 포함해야 할 것이다.

학술적 글쓰기에서의 객관화 전략 사용 양상 연구 - 한국어 학습자와 한국어 모어 화자 간의 비교를 중심으로 - (Study on the Use of Objectification Strategy in Academic Writing)

  • 김한샘;배미연
    • 비교문화연구
    • /
    • 제49권
    • /
    • pp.95-126
    • /
    • 2017
  • 이 논문은 학습자의 학술적 텍스트와 모어 화자의 학술 텍스트를 비교해 구체적으로 학습자들의 객관화 전략의 사용 양상을 살펴보는 것을 목적으로 한다. 객관화 전략은 학문적 탐구의 결과를 보편성과 타당성을 갖추어 과학적으로 기술하기 위해 적용하는 담화 기제로서의 객관성을 갖추기 위해 필자가 사용하는 전략이다. 이 연구에서는 객관화 전략의 언어적 표지를 관련된 의도성, 정확성, 완화 등과 비교하여 분석하였다. 그 결과 객관화 표지가 관련 기제들을 나타내는 표지와 일부 겹치기는 하지만 개념은 변별될 수 있음을 알 수 있었다. 객관화 표지는 크게 연구 결과의 상태성을 강조하는 것과 연구 주체를 연구 결과와 분리하는 것, 연구 내용을 일반화하는 것으로 나누어 볼 수 있다. 지속 표현과 명사화 구문은 상태성을 강조하는 역할을 하고, 비인칭 표현, 피동 표현, 자기인용 등은 주장하는 바와 필자의 거리를 유지하게 하며, 1인칭 대명사와 접미사 등을 통한 복수화는 연구 내용을 일반화 하는 데에 기여한다. 모어 화자 말뭉치와 비교하여 학습자 말뭉치를 분석한 결과 연구 결과의 상태성을 강조하기 위해서 학습자들이 모어 화자에 비해 '-고 있다'는 더 많이 사용하는 반면, '-(으) ㄴ/는 것이다' 등의 문법적 연어는 적게 사용하는 것으로 나타났다. 연구 주체의 분리를 위한 비인칭 표현의 사용이 학습자 말뭉치에서는 '본 연구'와 '본고'에만 집중된 반면 모어 화자는 '본고, 본 연구, 본 논문, 본장 등'과 '이 연구, 이 논문, 이 장 등'이 고른 분포로 나타났다. 복수화를 통한 연구 내용의 일반화는 모어 화자 말뭉치에서 활발하게 구현되었다. 이 연구는 객관성 구현의 관점에서 한국어 학술 텍스트의 특성을 파악하고 학문 목적 학습자의 담화 표현 교육을 위한 기초 자료를 마련하였다는 데에 의의가 있다.

시청각 기반 HRI 컴포넌트 상용화 서비스 현장 성능 평가 및 환경분석

  • 지수영;김혜진;김도형;윤호섭
    • 정보와 통신
    • /
    • 제25권4호
    • /
    • pp.16-21
    • /
    • 2008
  • 본고에서는 지능형 서비스 로봇의 상용화 단계에서 가장 현실적으로 적용 가능한 대표적인 HRI기술(얼굴검출, 화자 성별구별, 음원추적)에 대하여 상용화 서비스 현장에서의 성능평가 결과를 제공하고, 현장을 분석하여 사용자에게 가이드라인을 제공함과 동시에 최적의 상용화 서비스 제공을 위한 사용자와 로봇간 HRI 기준 및, 공공로봇 플랫폼 적용을 통한 로봇 서비스의 Needs 파악과 상품기획력의 극대화를 목적으로 성능평가에 따른 환경분석을 제안한다.