• 제목/요약/키워드: 녹음

검색결과 672건 처리시간 0.021초

발명 & 경제

  • (사)한국여성발명협회
    • 발명하는 사람들
    • /
    • 28호
    • /
    • pp.7-7
    • /
    • 2004
  • 브리얼리의 스테인리스 - 바이츠만의 아세톤 - 우에사카의 아이스크림 제조기 - 녹음과 재생이 가능한 엽서

  • PDF

고 음질 입체 음향 재생 시스템 구현 (Implementation for High Quality 3-D Sound Reproduction System)

  • 이신렬;성굉모
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 2000년도 하계학술발표대회 논문집 제19권 1호
    • /
    • pp.219-222
    • /
    • 2000
  • 입체음향 생성을 위한 기존의 방법은 크게 바이노럴 녹음기법과 머리전달함수(HRTF)를 이용한 바이노럴 합성 기법으로 크게 나눌 수 있다. 바이노럴 기법으로 생성된 이러한 입체음향은 재생을 위해 역 필터와 Equalization 곡선을 선택하게 되는데 이것은 음질에 중요한 영향을 주게 된다 본 논문은 재생시 음질의 향상을 위해 적합한 역 필터 설계와 Equalization 곡선의 선택방법을 제시하고 트랜스오럴 시스템 설계 시 신호처리로 인한 음질의 저하를 최소화하기 위해 스피커의 위치를 청취자의 머리 뒤에 놓는 방법을 제안하고자 한다. 그리고 청취자의 정면에 스피커를 한 개 추가하여 정면의 음상을 강화하고 3 채널 바이노럴 녹음기법(1)으로 만들어진 음원에 대한 호환성을 갖게 한다. 마지막으로 이 제안된 모든 방법들을 실시간으로 재생하는 시스템을 구현한다.

  • PDF

ARS와 신경회로망을 이용한 장애음성의 수집, 분석 및 식별에 관한 연구 (Collection, Analysis and Classification of Pathological Voice from ARS using Neural Network)

  • 김광인;조철우;김대현;왕수건;전계록;안시훈;김기련;김용주
    • 대한전자공학회:학술대회논문집
    • /
    • 대한전자공학회 2000년도 제13회 신호처리 합동 학술대회 논문집
    • /
    • pp.955-958
    • /
    • 2000
  • 본 논문은 음성신호를 이용해 성대의 질환이 있는 환자를 진단하고 병명을 판별하게끔 유도하는 자동 진단 시스템을 개발하기 위한 연구의 일부로, 그중 ARS를 이용하여 환자의 음성을 수집, 분석, 식별의 실험에 대한 연구이다. 본 연구 팀에서는 이미 CSL을 이용한 장애음성 데이터의 수집과 식별에 관한 연구 결과를 발표한바 있다. 하지만 선행연구에서는 방음실에서 디지털 녹음기를 이용하여 수집한 음성을 사용했기 때문에, ARS를 통하여 녹음한 음성과는 샘플링 주파수나 대역폭, 잡음성분등의 데이터의 특성이 상당한 차이가 있다. 이러한 이유로 ARS를 통하여 녹음한 음성에 보다 적합한 파라미터 분석프로그램을 작성하여 파라미터를 구하였다. 이 파라미터들은 Kay사의 MDVP를 기초로하여 작성하였고, 대부분 80%정도의 신뢰성을 가졌다. 수집한 음성의 식별은 정상음성과 양성음성의 두가지 경우로 분리하였다. 식별기법으로는 신경망을 이용하였고, 식별파라미터는 구한 파라미터중 6개의 파라미터를 선별하여 식별한 결과 약 90%정도의 식별율을 가졌다.

  • PDF

음성과 인상의 관계: 예비 연구

  • 문승재
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 학술발표대회 논문집 제17권 1호
    • /
    • pp.387-389
    • /
    • 1998
  • 사람의 음성을 들으면, 사람은 물론이지만 처음 듣는 목소리에 대해서도 그 목소리의 주인공에 대한 막연한 이상이 그려지게 된다. 본 논문은 이러한 현상이 얼마나 신빙성이 있는지, 즉, 음성만을 듣고 짐작한 그 음성의 주인공의 모습과 실제의 모습이 과연 얼마나 관계가 있는지를 알아보고자 하는 연구의 초기 단계에 대한 보고이다. 본 연구에서는 이처럼 음성이 전달하는 시각적 정보의 신빙성을 확인하기 위하여 남녀 각 8명의 사진을 찍고, 같은 내용의 짧은 문장을 녹취한 후, 100명 이상의 피실험자들에게 개별적으로 녹음을 듣고 가장 잘 어울릴 듯한 사진을 고르도록 할 것이다. 우선적으로 여성 8명의 녹음을 약간명(48명)의 피실험자에게 들려주어 실험한 결과, 목소리의 주인공을 바로 찾는 경우는 드물었지만, 흥미로운 것은 비록 틀린 경우라도 어떤 특정한 목소리는 어느 특정한 사진과 집중적으로 연결되었다는 것이다. 이 결과를 source-filter theory와 연관시켜 생각해보고, 이를 바탕으로 좀 더 구체적인 앞으로의 연구방향을 제시한다.

  • PDF

출입자 판별을 위한 문맥 제시형 화자인식 (The Text-Prompt Speaker Recognition for Customer Discrimination)

  • 서광석
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 학술발표대회 논문집 제17권 1호
    • /
    • pp.127-130
    • /
    • 1998
  • 본 연구에서는 문맥 종속 또는 문맥 독립형 화자 인식에서의 단점을 개선하는 방법으로 문맥 제시형 화자 인식을 수행하였다. 문맥 종속형 화자 인식은 제한된 문장이나 단어를 발성하여 출입 판별을 하는 방식으로 구현하기는 쉬우나 사칭자가 사용자의 목소리를 흉내낼 수 있으며[1], 문맥 독립형 화자 인식은 임의의 대화 문장이나 대화를 사용에게 유도하여 일정 시간 동안 녹음한 후에 이를 이용하여 사칭자가 접근을 허가 받을 수 있다는 단번이 있다. 또한 문맥 독립형 화자 인식에서는 접근 허가를 받기까지 많은 학습 시간이 필요하며 학습 시간이 적을 경우에 상당한 인식률의 저하가 발생된다. 문맥 제시형 화자 인식은 랜덤하게 제시된 단어만을 화자가 발성함으로써 특정한 문장이나 단어의 배열을 미리 녹음했다가 재생하는 방법을 배제할 수 있을 뿐만 아니라 동시에 학습을 위한 많은 시간을 소모하지 않는다는 장점이 있다. 본 논문에서는 화자로 하여금 랜덤하게 제시된 여러 개의 단어들을 순서적으로 발성하도록 하여, 발성 단어를 인식한 후에 인식된 단어를 통하여 화자를 판별하는 방법을 사용하였다.

  • PDF

이어폰 주관 평가 기법 : 보정 필터 및 평가 결과 (Subjective Assessment Method for Earphone : Compensation Filter and Assessment Results)

  • 전상배;성굉모
    • 대한전자공학회논문지SP
    • /
    • 제47권5호
    • /
    • pp.56-61
    • /
    • 2010
  • 본 논문에서는 이어폰의 주관 평가 기법에 대해서 소개한다. 음질의 주관 평가는 동시비교를 위한 평가 자극간의 즉각적인 스위칭을 제공하도록 설계되어야 한다. 그럼에도 불구하고 이어폰의 음질 평가의 경우에 있어서는, 물리적으로 평가 자극간의 즉각적인 스위칭이 불가능하여 직접적인 주관 평가에 어려운 점이 있다. 이에, 본 논문에서는 각 이어폰으로부터의 자극을 녹음하여 녹음된 자극간의 동시 비교를 통하여 이어폰을 평가하는 방법을 제안하고, 이에 필요한 선처리들과 평가 결과에 대하여 소개한다.

최대 사후 추정 화자 적응을 이용한 가변어휘 고립단어 음성인식기의 사무실 환경에서의 성능 평가 (Performance Evaluation of Variable-Vocabulary Isolated Word Speech Recognizers with Maximum a Posteriori (MAP) Estimation-Based Speaker Adaptation in an Office Environment)

  • 권오욱
    • 한국음향학회지
    • /
    • 제17권2호
    • /
    • pp.84-89
    • /
    • 1998
  • 본 논문에서는 임의의 단어를 인식하기 위하여 음성학적으로 최적화된 (phonetically-optimized word) 음성 데이터베이스를 사용하여 훈련된 가변어휘 고립단위 음 성인식기의 실제 인식기 사용 환경에서의 성능을 평가하였다. 이를 위하여, 훈련 데이터베이 스에서와 상이한 환경에서 수집된 음성학적으로 균형 잡힌(phonetically-balanced word) 고 립 단어 음성을 테스트 데이터로 사용하였다. 테스트 데이터는 일반적인 사무실에서 작동하 는 노트북 PC에서 내장 마이크를 사용하여 녹음되었다. 이렇게 녹음된 음성을 사용하여 고 립단어 인식기의 인식률을 측정하였다. 이 인식기는 최대 사후(maximum a posteriori) 추정 알고리듬을 사용하여 화자의 변화에 적응하였다. 컴퓨터 모의실험 결과에 의하면 화자 적응 을 하지 않은 기본 시스템은 깨끗한 음성에 대하여 81.3%에서 사무실 환경 음성에 대하여 69.8%로 인식률이 저하되었다. 사무실 환경 음성에 대하여, 비교사 점진(unsupervised incremental) 모드에서 최대 사후 추정 화자 적응 알고리듬을 적용하였을 경우에는 화자적 응을 하지 않은 경우에 비하여 9%의 에러를 감소시키며, 50단어의 적응 단어를 사용하여 교사 묶음(supervised batch) 모드에서 최대 사후 추정 화자 적응 알고리듬을 적용하였을 경우에는 16%의 에러를 감소시켰다.

  • PDF

입체방송을 위한 입체음향 제작기법 연구 (A study on 3-D sound design for 3-D broadcast)

  • 이신렬;이준수;성굉모
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 2001년도 추계학술발표대회 논문집 제20권 2호
    • /
    • pp.259-262
    • /
    • 2001
  • 인간이 실제 생활에서 느끼는 입체음향을 녹음해서 재생기를 통해 듣고자하는 시도는 역사적으로 이미 한 세기가 지났으나 아직도 실감 있는 입체음향 녹음 및 재생기법 연구는 계속진행 중에 있다. 스피커 혹은 헤드폰으로 전후, 좌우, 상하의 모든 방향 및 거리감까지도 재생시킬 수 있는 있어야 진정한 입체음향이라 말할 수 있겠지만 많은 오디오 기기 제조업체들이 홍보효과를 위해 입체음향을 부적절하게 사용함으로써 일반 사용자들은 입체음향에 대해 많이 혼돈하고 있는 실정이다. 정확한 의미로 오늘날 대부분의 오디오 기기를 차지하고 있는 스테레오 사운드는 1차원(좌우 축)사운드라고 말할 수 있으며, 극장 사운드는 2차원(좌우, 전후 축)사운드이며 상용화된 3차원 사운드 제품은 아직 존재하지 않는다고 말할 수 있다 본 논문에서는 현재 연구 중인 "방송을 위한 입체음향 생성 및 재생 기법" 중 대표적인 바이노럴 기법과 Ambisonic 기법 및 문제점에 대해 알아보았다

  • PDF

피아노 연주 평가 프로그램을 위한 타격 시간 검출 (Detection of Attack Time in Developing the Scoring Program for Piano Music)

  • 이준수;한기영;백성준;성굉모
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 2001년도 추계학술발표대회 논문집 제20권 2호
    • /
    • pp.175-178
    • /
    • 2001
  • 실제 피아노 연주 녹음에서 연주된 음표를 검출하는 과정은 녹음된 데이터만으로 원래의 악보를 복원하거나 같은 악보로 연주한 서로 다른 연주를 비교 평가하는데 있어 필수적인 과정이다. 본 논문에서는 피아노 연주 평가프로그램에 적용될 알고리듬 구상의 첫 단계로서 타격 시간을 찾는 알고리듬을 제안하고, 실제의 연주 sample을 이용한 analysis와 기존의 다른 방법과의 비교를 통하여 그 성능과 효용성을 점검하였다 또한, 이 알고리듬을 실제 연주 평가 프로그램에 적용시켜 완성된 프로그램에 대해서도 간략히 소개하였다

  • PDF

음성합성시 에너지 정규화가 음질에 미치는 영향 (Effect of Energy Normalization on the Quality of Synthetic Speech)

  • 정은석;최의선;이철희
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송공학회 1998년도 학술대회
    • /
    • pp.95-98
    • /
    • 1998
  • 본 논문에서는 코퍼스 기반 음성합성시 각 음성 세그머트의 에너지 정규화가 합성된 음성의 음질에 미치는 영향에 대하여 연구한다. 음성합성에 사용되는 음성 세그먼트를 실제 자연 음성 데이터로부터 추출된 것으로 다양한 발음세기를 가진다. 따라서 이들을 조합하여 만든 합성음성의 음질은 일반적으로 음량이 고르지 못하고 듣기에 부자연스럽다. 이러한 문제를 해결하기 위해 음성합성시 음성 세그먼트의 에너지를 정규화하는 방법을 제안하고 정규화방법으로 최대진폭 정규화방식을 사용하였다. 녹음환경이 비교적 일정한 코퍼스와 그렇지 않은 환경에서 녹음된 코퍼스를 사용하여 정규화 없이 합성한 음성의 음질과 정규화를 거쳐서 합성한 음성의 음질을 비교한다. 실험결과 음성 세그먼트의 에너지를 정규화한 경우 합성음성의 음질이 개선되었다.

  • PDF