• 제목/요약/키워드: 음합성

검색결과 333건 처리시간 0.023초

피아노 망치의 타격위치 변화에 따른 단일음과 화음의 음색 분석

  • 오상준;김재현;정민
    • EDISON SW 활용 경진대회 논문집
    • /
    • 제5회(2016년)
    • /
    • pp.381-383
    • /
    • 2016
  • 본 연구에서는 기존의 피아노와 다른 음색을 갖는 피아노를 기획하고자 하였다. 이를 위해서 피아노 현의 1/2지점, 1/3지점, 1/17지점을 타격했을 때의 배음의 구성을 EDISON의 pianostring 프로그램을 통해 분석하였다. 440Hz의 진동수를 갖는 A4음을 기음으로 하여 각 지점을 타격했을때의 음을 합성하였다. 또한 기음과 첫 두 배음으로 구성된 화음을 합성하였다. 음색을 분석하기 위해 설문조사를 통해 7개의 항목에 대해 평가하였다. 결과적으로 망치의 타격 지점을 변화시킴으로서 원하는 음색을 얻을 수 있을 것이라 기대한다. 일례로 1/2지점을 타격할 때 단일음과 화음의 음색 차이가 확연하게 드러나 효과적인 감정표현을 할 수 있을 것으로 예상된다.

  • PDF

피치 변화음의 합성을 위한 도파관 모델 (Pitch-shifted sound synthesis using digital waveguide model)

  • 조상진;강명수;정의필
    • 융합신호처리학회논문지
    • /
    • 제10권2호
    • /
    • pp.127-131
    • /
    • 2009
  • 디지털 도파관 모델은 파동 방정식의 일반해를 이용하여 진행파를 표현하고 이 진행파의 파동이동을 지연 라인으로 나타낸다. 일반적인 도파관 모델에서의 단일 지연은 샘플링 시간 간격을 의미하지만, 공간 기준 도파관 모델의 단일 지연은 샘플링된 공간의 거리를 의미한다. 이러한 차이점으로 인해 파동의 이동 거리를 직접적으로 조절할 수 있는 공간기준 도파관 모델이 비브라토 음과 같이 피치가 변하는 음을 합성할 수 있다고 알려져 있다. 본 논문에서는 지연라인의 길이의 비로서 피치가 변하는 음을 합성할 수 있는 시간 기준 디지털 도파관 모델을 제안하고 기존의 공간 기준 도파관 모델과의 성능을 비교하였다.

  • PDF

반음절단위를 이용한 한국어 음성합성에 관한 연구 (A Study on the Korean Text-to-Speech Using Demisyllable Units)

  • 윤기선;박성한
    • 대한전자공학회논문지
    • /
    • 제27권10호
    • /
    • pp.138-145
    • /
    • 1990
  • 본 논문에서는 합성단위를 반음절로 하여 적은 데이터 베이스를 차지하면서도, 합성음의 자연스러움을 향상 시키기 위한 한국어 규칙 합성법을 제시한다. 반음절 음성신호를 분석하기 위해 12차 선형 예측법을 사용하며, 합성음의 자연성과 명료성을 위해 음절간 접속 규칙, 모음부의 연결규칙을 개발한다. 또한 신경망 모델을 이용한 음운 변동 규칙과 운율규칙을 적용한다.

  • PDF

충돌음 합성에 의한 가상환경의 청각적 인터랙션 디자인 (Auditory Interaction Design By Impact Sound Synthesis for Virtual Environment)

  • 남양희
    • 한국콘텐츠학회논문지
    • /
    • 제13권5호
    • /
    • pp.1-8
    • /
    • 2013
  • 본 논문에서는 객체 간 충돌음과 같이 가상환경의 발생 상황을 전달할 수 있는 중요한 감각 채널 중 하나인 소리를 통해 청각적 인터랙션을 디자인할 수 있는 방법을 제시하였다. 철, 고무, 유리 등 물질별 기본음 샘플에 대해 각각의 고유음을 특징짓는 모드 게인 값의 스케일 변경을 허용함으로써 디자인적 변형이 가능하도록 하고, 충돌 상황에 대한 인지적 속성인 충돌체의 크기, 딱딱한 정도, 접촉면적, 충돌 속도 차이에 의한 충돌음의 변화를 실시간에 재현할 수 있게 하는 계산적 알고리즘을 사용한 방법이다. 소리를 통한 충돌물체의 물질 및 충돌 상황 인지 실험을 통해 제안된 방법이 가상환경 청각적 인터랙션 디자인에 사용될 수 있음을 보였다.

물리적 모델링 합성법에 기반을 둔 줄 없는 기타 구현 (Implementation of Non-Stringed Guitar Based on Physical Modeling Synthesis)

  • 강명수;조상진;정의필
    • 한국음향학회지
    • /
    • 제28권2호
    • /
    • pp.119-126
    • /
    • 2009
  • 본 논문에서 제안한 줄 없는 기타는 크게 레이저 현과 프렛, 음 합성 알고리듬과 프로세서로 구성된다. 레이저 현은 레이저 모듈과 포토다이오드를 이용하여 스트로크와 아르페지오를 표현할 수 있도록 하였고, 프렛은 전압 분배기를 이용하여 구현하였다. 몸통은 물리적 모델링 합성법을 이용하였기 때문에 줄 없는 기차에는 울림통의 역학을 하는 물리적인 몸통이 없다. 제안한 기타의 프렛은 실제 프렛을 동일하게 표현할 수 있어 기존의 코드 글러브를 이용한 로드 표현뿐 아니라 실제 기타와 같은 솔로 연주도 가능하다. 해머링 온, 풀링 오프, 슬라이딩과 같이 프렛 변화가 있는 연주음은 전압 분배기로부터 받은 프렛의 정보를 파라미터로 사용하여 합성한다. 연구법에 따른 음의 피치 변화는 디지털 도파관 모델에서 파동의 전파 속도 변화로 표현하였다. 이 합성 모델은 동일 프렛에서 현의 장력을 변화시켜 연주하는 비브라토 음도 합성 할 수 있다. 레이저 현과 프렛으로부터 받아들인 정보를 합성 알고리듬의 파라미터로 변환하여 기타 음을 생성하고 이를 실시간으로 출력할 수 있도록 TMS320F2812를 사용하였다. 웹에 공개한 동영상에는 제안한 알고리듬과 인터페이스를 이용하여 실시간으로 합성한 '아리랑' 연주를 볼 수 있다. 제안한 알고리듬이 피치 변화를 표현하는 기타 솔로 연주법에 효과적이고 줄 없는 기타로 실시간 연주가 가능함을 확인할 수 있다.

합성곱 신경망과 장단기 메모리를 이용한 사격음 분석 기법 (Shooting sound analysis using convolutional neural networks and long short-term memory)

  • 강세혁;조지웅
    • 한국음향학회지
    • /
    • 제41권3호
    • /
    • pp.312-318
    • /
    • 2022
  • 본 논문은 딥러닝기법 중 하나인 합성곱 신경망과 순환 신경망 중 하나인 장단기 메모리를 이용하여 사격시 발생하는 소음(이하 사격음)만으로 화기의 종류, 사격음 발생지점에 관한 정보(거리와 방향)을 추정하는 모델을 다루었다. 이를 위해 미국 법무부 산하 연구소의 지원하에 생성된 Gunshot Audio Forensic Dataset을 이용하였으며, 음향신호를 멜 스펙트로그램(Mel-Spectrogram)으로 변환한 후, 4종의 합성곱 신경망과 1종의 장단기 메모리 레이어로 구성된 딥러닝 모델에 학습 및 검증 데이터로 제공하였다. 제안 모델의 성능을 확인하기 위해 합성곱 신경망으로만 구성된 대조 모델과 비교·분석하였으며, 제안 모델의 정확도가 90 % 이상으로 대조모델보다 우수한 성능을 보였다.

PC용 Text-to-Speech 시스템 개발 (Development of Text-to-Speech System for PC)

  • 최무열;황철규;김순태;김정곤;이서배;장석복;표경란;안혜선;김형순
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1999년도 학술발표대회 논문집 제18권 2호
    • /
    • pp.41-44
    • /
    • 1999
  • 본 논문에서는 PC 응용을 위한 고음질의 한국어 text-to-speech(TTS) 합성 시스템을 개발하였다. 개발된 시스템의 합성방식으로는 음의 고저 조절, 인접음 사이의 연결 처리 및 음색제어 등에서 기존의 PSOLA 방식에 비해 장점을 가지는 정현파 모델 기반의 방식을 채택하였고, 자연스러운 운율 모델링을 위하여 통계적 기법중의 하나인 Classification and regression tree(CART) 방법을 사용하였다. 또한 음소 경계의 불연속성 문제를 줄이기 위한 합성단위로 초성-중성 및 종성 단위를 사용하였고, 다양한 음색표현이 가능하도록 음색제어 기능을 갖추었다. 그리고, 표준 Speech Application Program Interface(SAPI)를 준용한 TTS engine 형태로 구현함으로써 PC 상에서의 응용 프로그램 개발 편의성을 높였다. 합성음의 청취평가 결과 음질의 우수성 및 음색제어 기능의 유효성을 확인할 수 있었다.

  • PDF

개선된 산조 가야금의 물리적 모델링을 이용한 오른손 주법의 음 합성 (Sound Synthesis of Right-Hand Playing Styles Using Improved Physical Modeling of Sanjo Gayageum)

  • 조상진;정의필
    • 한국음향학회지
    • /
    • 제25권8호
    • /
    • pp.362-369
    • /
    • 2006
  • 본 논문에서는 기존의 산조 가야금의 물리적 모델링을 개선하여 오른손 주법에 따른 음을 합성하였다. 가야금 현의 모델에 사용된 루프 필터의 파라미터를 녹음된 단위음의 감쇠 영역으로부터 추정하여 정확도를 향상시키고 계산량을 줄였다. 몸통은 임펄스 응답으로부터 주 공명 주파수를 추출하여 설계한 공명기로 대체되었으며, 주 공명 주파수가 제거 된 임펄스 응답은 크기가 줄어든 여기신호로 사용되었다 안족의 주파수 응답은 15차 all-pole 필터로 근사화 하였다. 가야금의 오른손 연주법 중 연퉁기기는 피드포워드 콤 필터로 구현하였으며 필터의 파라미터는 녹음된 단위음으로부터 추출하였다. 개선된 산조 가야금의 물리적 모델을 이용한 뜯기와 퉁기기, 연퉁기기의 합성음은 원래 음과 매우 유사하였다.

가변 Break를 이용한 코퍼스 기반 일본어 음성 합성기의 성능 향상 방법 (A Performance Improvement Method using Variable Break in Corpus Based Japanese Text-to-Speech System)

  • 나덕수;민소연;이종석;배명진
    • 한국음향학회지
    • /
    • 제28권2호
    • /
    • pp.155-163
    • /
    • 2009
  • Text-to-speech 시스템에서 입력 텍스트로부터 운율 정보를 생성하기 위해서는 운율구 경계, 음소 지속시간, 기본주파수 포락선 설정의 3가지 기본적인 모듈이 필요하다. Break 인덱스 (BI; Break Index)는 합성기에서 운율구의 경계를 나타내고, 자연스러운 합성음을 생성하기 위해서는 BI를 정확히 예측하여야 한다. 그러나 BI는 문장의 의미나 화자의 읽기 습관(reading style)에 따라 임의적으로 결정되는 경우가 많아 정확한 예측이 매우 어렵다. 특히 일본어 합성기에서는 악센트 구 경계 (APB; Accentual Phrase Boundary)와 major phrase 경계 (MPB; Major Phrase Boundary)의 정확한 예측이 어렵다. 따라서 본 논문에서는 APB와 MPB 예측 오류를 보완할 수 있는 방법을 제안한다. BI를 고정 break (FB; Fixed Break)와 가변 break (VB; Variable Break)로 분류하여 합성단위 선택을 수행한다. 일반적으로 BI는 한번 생성되면 변하지 않는다. 따라서 BI가 잘못 생성된 경우 최적의 합성음을 생성할 수 없게 되는데, VB는 생성된 BI와 그것과 유사한 BI를 함께 이용하여 합성단위 선택을 수행함으로써 합성음의 BI가 생성된 BI와 다를 수 있는 것을 의미한다. APB와 MPB에 해당하는 BI에 대하여 VB인지 FB인지 CART(Classification and Regression Tree)를 이용하여 예측하고, VB인 경우 기본 주파수와 음소 지속시간에 대해 다중 운율 모델을 생성하여 합성단위 선택을 수행하였다. MOS 테스트 결과 원음이 4.99, 제안한 방법을 4.25, 기존의 방법은 4.01로 합성음의 자연성을 향상시킬 수 있었다.

한소리 : 무제한 음성합성시스팀 (HanSoRi : an Unlimited Synthesis System)

  • 김응인
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1994년도 제11회 음성통신 및 신호처리 워크샵 논문집 (SCAS 11권 1호)
    • /
    • pp.342-345
    • /
    • 1994
  • 본 논문에서는 무제한단어 음성합성 시스템인 한소리에 대해서 간략히 기술하고 청취실험을 통한 성능평가에 대해 논한다. 음성합성시스템의 음질을 결정하는 주요 요소들은 합성의 기본단위, 합성방법, 음운학적 전처리방법 및 운율조절방법이다. 한소리 합성시스템은 반음소를 음성합성의 기본단위로 하고, 형식형태소를 이용 음성학적 전처리를 실행하며, 개선된 한국어 운율조절방법이 적용되고, 음성단편조합방식을 합성방식을 사용한다. 청취실험결과 매우 한소리 합성시스템의 합성음이 자연스러움을 알 수 있다.

  • PDF