• Title/Summary/Keyword: 음향심리

검색결과 201건 처리시간 0.021초

스테레오 시스템을 위한 머리전달함수의 개선 (HRTF Enhancement Algorithm for Stereo ground Systems)

  • 구교식;차형태
    • 한국음향학회지
    • /
    • 제27권4호
    • /
    • pp.207-214
    • /
    • 2008
  • 입체음향을 구현하는 방법으로는 다수의 스피커를 사용하는 다채널 음향재생 시스템과 2개의 스피커나 스테레오 헤드폰을 이용하는 2채널 음향재생 바이노럴 시스템이 있다. 그 중에서 공간 및 비용 상의 문제로 인하여 2채널을 이용한 음향재생시스템이 주목을 받고 있다. 일반적으로 2채널로 입체음향을 재생하기 위해서는 소리가 음원으로부터 청자의 두 귀에 이르는 경로를 모델링한 머리전달함수 (HRTF : Head Related Transfer Function)를 이용하지만 혼돈원추 상에서 음상정위의 혼돈을 주게 되므로 입체감을 저하시킨다는 단점이 있다. 본 논문에서는 2채널 입체음향 시스템을 효과적으로 구현하기 위하여 머리전달함수를 개선하는 알고리즘을 제안한다. HRTF 그룹화 및 심리음향을 이용하여 각 방향에 해당하는 주파수 스펙트럼 특성을 부각시키는 방법을 적용하였으며 시뮬레이션을 통하여 제안한 알고리즘이 정확한 방향감을 생성할 수 있음을 확인하였다.

심층신경망 기반 오디오 부호화기를 위한 Multi-time Scale 손실함수의 최적화 (Optimization of Multi-time Scale Loss Function Suitable for DNN-based Audio Coder)

  • 신승민;변준;박영철;백승권;성종모
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송∙미디어공학회 2022년도 하계학술대회
    • /
    • pp.1315-1317
    • /
    • 2022
  • 최근, 심층신경망 기반 오디오 부호화기가 활발히 연구되고 있다. 심층신경망 기반 오디오 부호화기는 기존의 전통적인 오디오 부호화기보다 구조적으로 간단하지만, 네트워크의 복잡도를 증가시키지 않고 인지적 성능향상을 기대하는 것은 어렵다. 이 문제를 해결하기 위하여 인간의 청각적 특성을 활용한 심리음향모델 기반 손실함수를 사용한 기법들이 소개되었다. 심리음향 모델 기반 손실함수를 사용한 오디오 부호화기는 양자화 잡음을 잘 제어하였지만, 여전히 지각적인 향상이 필요하다. 본 논문에서는 심층신경망 기반 오디오 부호화기를 위한 Multi-time Scale 손실함수의 지역 손실함수 윈도우 크기의 최적화 제안한다. Multi-time Scale 손실함수의 지역 손실함수 계산을 위한 윈도우 크기를 조절하며, 이를 통하여 오디오 부호화에 적합한 윈도우 사이즈를 결정한다. 실험을 통해 얻은 최적의 Multi-time Scale 손실함수를 사용하여 네트워크를 훈련하였고, 주관적 평가를 통해 기존의 심리음향모델 기반 손실함수보다 좋은 음성 품질을 보여주는 것을 확인하였다.

  • PDF

입체 음향 구현을 위한 방법론의 비교 분석 (Comparative Analysis of Methods for Implementing 3D Sound)

  • 이희종;김기홍;김풍민;김현빈
    • 한국감성과학회:학술대회논문집
    • /
    • 한국감성과학회 1998년도 춘계학술발표 논문집
    • /
    • pp.212-216
    • /
    • 1998
  • 청취자가 음원의 위치와 방향을 감지할 수 있도록 원하는 지점에 음상을 정위시키는 일과 특정 공간내에서 방사되는 음원의 반사와 확산효과를 모델링하여 가상 공간 음향을 실현하는 일을 효과적으로 접목시키기 위한 3가지 유형의 입체음향 생성방법을 제시한다. 그리고 각 방법의 유효성 및 적합성을 검토하기 위해 실시한 심리음향 평가방법과 그에 대한 결과를 토대로 생성발법들간의 성능을 비교 평가한다.

  • PDF

감성 의류 소재 개발을 위한 직물 마찰 소리의 심리생리학적 연구 (Psychophysiological Study for the Development of Sensible Textiles)

  • 조자영;이은주;조길수;손진훈
    • 한국감성과학회:학술대회논문집
    • /
    • 한국감성과학회 2001년도 춘계학술대회 논문집
    • /
    • pp.54-59
    • /
    • 2001
  • 본 연구는 청각적 감성을 만족시키는 의류소재의 개발을 위해, 직물 마찰음에 대한 인간의 감서을 생리반응측정과 심리적·주관적 평가를 통해 파악하고, 직물 마찰음이 갖는 음향특성과의 관련성을 고찰하였다. 이를 위해 직물 마찰음의 음향특성을 분석하고, 직물 마찰음에 대한 감각·감성 표현어(부드러움, 시끄러움, 유쾌함, 날카로움, 맑음, 거침, 높음)를 이용하여 주관적 평가를 실시하였으며, 생리적 반응으로서의 뇌파 및 혈류량, 심박변화율, 피부전도수준 등을 측정하였다. 주관적 감각·감성은 대부분 직물 소리의 크기와 관련이 깊은 것으로 나타나, loudness(Z)와 총음압 LPT가 증가할수록 시끄럽고 거칠며 딱딱하고 불쾌하며 탁하다고 지각하였다. 생리적 반응과 관련하여서는, 부드럽고 조용하며 맑다고 지각할수록 slow alpha파가 증가하였고, 유쾌하고 매끄럽다고 평가할수록 혈류량은 증가하였다. 또한, 높다고 지각하는 소리에 대한 LF/HF는 증가하였다. 마찰음의 음향특성이 생리적 반응에 미치는 영향으로서, LPT가 혈류량의 감소에, Loudness(Z)가 피부전도수준의 증가에 각각 영향을 미치며, sharpness(Z)가 높고 ΔL이 작을수록 LF/HF는 증가하는 것으로 나타났다.

  • PDF

MPEG-2 AAC Encoder의 심리음향 모델 최적화 (An Optimization on the Psychoacoustic Model for MPEG-2 AAC Encoder)

  • 박종태;문규성;이강현
    • 전자공학회논문지CI
    • /
    • 제38권2호
    • /
    • pp.33-41
    • /
    • 2001
  • 최근 멀티미디어 분야 중에서 가장 중요한 기술 중의 하나가 압축이다. 오디오 파일들은 인터넷을 중심으로 급속히 전파되어가고 있으며, 그 중에서 가장 유명한 것이 MP-3(MPEC-1 Layer3)인데, MP-3는 128Kbps에서 CD음질을 얻을 수 있지만 64Kbps 이하에서는 음질이 급속히 떨어진다. 반면에 MPEG-2 AAC(Advanced Audio Coding)는 MPEG-1과 호환성을 무시하지만 MP 3보다 1.4배의 높은 압축 율을 갖으며, 최대 7.1채널과 96KHz의 샘플 율을 갖는다. 본 논문에서는 MPEG-2 AAC 인코더 부분에서 막대한 연산 량을 갖는 심리음향 모델을 최적화하여 AAC 인코딩 연산 량을 감소시키며 처리속도를 증가하는 알고리즘을 제안한다. 심리음향 모델 최적화 응용 프로그램은 C++언어를 이용하여 구현하였으며, 실험결과 심리음향 모델은 SMR(Signal to Masking Ratio)을 위하여 44.1KHz의 샘플 율을 갖고 2048포인트의 FFT(Fast Fourier Transform)연산을 수행하며, 인코더 블록의 제어를 위하여 서브밴드 필터에 각각의 엔트로피 값들이 입력된다. 제안된 심리음향 모델은 비 예측성 값의 최적화로 인하여 빠른 속도로 수행되었다. 또한 비 예측성 값을 순음지수로 변화 시, 고 주파수 영역의 순음지수 값의 최적화로 연산처리 속도가 증가하였다.

  • PDF

음성압축 방식의 변화가 한국어 단음절 숫자 인지기능에 미치는 영향의 비교 연구 (Comparative Studies of Perceiving Korean Monosyllabic Digit Words under Different Speech Compression Schemes)

  • 임덕환;원유경
    • 한국음향학회지
    • /
    • 제32권3호
    • /
    • pp.262-268
    • /
    • 2013
  • 다양한 음성 압축방식이 여러 분야에서 광범위하게 사용되고 있으며 그 심리음향적 인지결과는 대상 언어의 특성과 압축 방식에 따라서 다를 수가 있다. 한국어에서도 이러한 인지 결과를 비교하는 정량적인 자료가 관련된 임상이나 응용 분야에서 필요하지만 구체적인 내용이 확인되어 있지 않다. 본 연구에서는 통제된 언어적 특성을 갖는 0에서 9까지 한국어 단음절 숫자 들이 무작위로 조합되는 다섯 쌍 조합(quintet set)을 대상으로 하여 자주 사용되는 세가지 대표적인 음성 압축방식의 특성을 비교 분석하였다. 비교 기준으로는 기존의 연구에서 분석 정리된 시간과 주파수 정보가 모두 일정하게 변화되는 PNT (Preserving No Trait) 압축에서 얻은 자료를 비교 근거로 선정하였다. 이를 기준으로 하여 동일한 조건의 정상인 그룹에서 심리음향적 피치(pitch) 정보가 주로 보전되는 PPT (Preserving Pitch Trait), 시간 정보가 주로 보전되는 PTT (Preserving Time Trait) 압축방식의 인지 결과를 기록하고 분석하였다(N=20). 본 연구 결과에서 얻어진 자료를 보면, 정보의 압축비율이 높을 수록 심리음향학적으로 중요한 주파수 정보(피치)를 보전하는 것이 인지도 측면에서 가장 유리한 것으로 나타났다(PPT>PTT>PNT). 또한, 세가지 압축방법에서 50% 인지율을 보이는 압축률의 역치도 PPT가 20%, PTT가 42%, PNT가 44% 순으로 나타났다. 따라서 인지도 측면에서만 살펴보면 본 조건에서는 PPT 압축 방식이 가장 우수한 것으로 추정되었다. 이러한 숫자 자극을 이용한 평가 방법은 향후 새로운 압축 방식의 효율성과 인지도 측면을 비교 가능하게 하며, 이를 이용하면, 청각정보처리기능을 진단하거나 압축 관련 특수 보청기 적합 재활에서 정량적인 지표를 제공하는 도구로도 사용될 수 있을 것으로 판단된다.

지각적으로 가중된 매칭 퍼슈잇을 이용한 오디오 신호의 정현파 모델링 (Sinusoidal Modeling of Audio Signals Using Perceptually Weighted Matching Pursuit)

  • 김연지;이인성
    • 한국음향학회지
    • /
    • 제22권2호
    • /
    • pp.96-103
    • /
    • 2003
  • 본 논문은 매칭 퍼슈잇 (Matching Pursuit)에 인지적인 가중치를 사용하여 오디오 신호를 정현파 모델링하는 것에 대해 기술한다. 매칭 퍼슈잇은 입력 신호에서 에너지가 가장 큰 성분들을 반복적으로 추출해 원 신호와 재생 신호의 차이가 영에 도달될 때까지 계속된다. 본 논문에서는 매칭 퍼슈잇에 심리음향모델을 사용한 인지적인 매칭 퍼슈잇으로 입력 신호로부터 인지적으로 중요한 성분을 차례대로 추출하였다 인지적인 매칭 퍼슈잇의 성능을 평가하기 위해 인지적인 가중치를 주지 않은 정현파 매칭 퍼슈잇과 비교 평가하였다. 여러 가지 입력 신호에 대한 실험 결과 정현파 매칭 퍼슈잇보다 인지적인 매칭 퍼슈잇의 성능이 좋았고, 특히 시간축 변화율이 큰 신호일 경우에 인지적인 매칭 퍼슈잇을 통해 원래 신호의 음질을 더 잘 복원할 수 있었음을 확인하였다.

심리음향모델과 SOLA 알고리즘을 이용한 코러스 칩 설계 (The Design of Chorus DSP Chip Using Psychoacoustic Model and SOLA Algorithm)

  • 김태훈;박주성
    • 한국음향학회지
    • /
    • 제19권3호
    • /
    • pp.11-19
    • /
    • 2000
  • 본 논문에서는 가요 반주기의 육성 코러스 기능을 구현하는데 핵심적인 기능을 하는 반도체 칩 설계에 관한 내용을 다룬다. 육성 데이터는 많은 저장 용량을 필요로 하고 있으므로 압축이 필요하고, 반주기의 키 및 템포 변화에 따라 육성 데이터의 키와 템포를 변화시키는 것이 필요하다. 본 연구에서는 압축을 위해서는 MPEG-1 오디오 계층1, 키 및 템포 변환을 위해서는 SOLA(Synchronized Overlap and Add) 알고리즘을 적절하게 변형하였다. 변형된 알고리즘을 구현할 수 있는 ASIC(Application Specific Integrated Circuit)을 설계하고 FPGA로 검증한 후 칩으로 제작하였다. 제작된 칩은 실제 시스템에 응용되어 정상적으로 동작하는 것을 확인하였다.

  • PDF