통합 검색 | Korea Science

엔트로피 모델을 활용한 심층 신경망 기반 오디오 압축 모델 최적화 (DNN-based Audio Compression Model Optimization Utilizing Entropy Model)

임형섭;강홍구;장인선
- 한국방송∙미디어공학회:학술대회논문집
- /
- 한국방송∙미디어공학회 2022년도 하계학술대회
- /
- pp.54-57
- /
- 2022
본 논문에서는 심층 신경망 기반 점진적 다계층 오디오 코덱의 비트 전송률 효율 향상을 위한 엔트로피 모델 기반 양자화 방식을 제안한다. 최근 심층 신경망을 이용하여 전통적인 신호 처리 이론 기반의 상용 오디오 코덱들을 대체하기 위한 오디오 압축 및 복원 시스템에 관한 연구가 활발하게 이루어지고 있다. 그러나 아직은 기존 상용 코덱의 성능에 도달하지 못하고 있으며 특히 종단 간 오디오 압축 모델의 경우, 적은 정보량으로 높은 품질을 얻기 위해서는 부호화기의 양자화 구조를 개선하는 것이 필수적이다. 본 연구에서는 기존에 제안된 종단 간 오디오 압축 모델 중 하나인 점진적 다계층 오디오 코덱의 벡터 양자화기를 엔트로피 모델 기반 양자화기로 대체하고 전송률-왜곡 트레이드오프 관계를 활용하여 전송률을 다양한 형태로 조절할 수 있음을 보임으로써 엔트로피 모델 기반 양자화기 도입의 타당성을 검증한다.
PDF

개선된 QIM과 SVM을 이용한 공격에 강인한 다중 오디오 워터마킹 알고리즘 개발 (Development of a Robust Multiple Audio Watermarking Using Improved Quantization Index Modulation and Support Vector Machine)

서예진;조상진;정의필
- 융합신호처리학회논문지
- /
- 제16권2호
- /
- pp.63-68
- /
- 2015
본 논문에서는 신호의 파워에 따라 적응적 스텝 사이즈를 갖는 개선된 QIM(Quantization index modulation)과 SVM(Support vector machine) 디코딩 모델을 이용한 다중 오디오 워터마킹 알고리즘을 제안한다. 워터마크는 주파수 크기 응답과 주파수 위상 응답에 QIM을 이용하여 삽입한다. 이는 주파수 크기 응답과 위상 응답에 강인한 공격이 다르기 때문에 양쪽 모두 삽입하여 강인성을 보완하기 위해서이다. 검출시에는 SVM 디코딩 모델을 사용하여 검출된 워터마크가 워터마크로서의 기능이 애매모호한 경우를 개선하여 검출 비율을 향상시킨다. 강인성 검증을 위해 11개의 공격을 사용하였고 그 결과 SVM 디코딩 모델을 사용하지 않은 기존의 다중 오디오 워터마킹 방법보다 훨씬 우수한 성능을 보였다. 특히 PSNR은 최대 7dB의 개선 효과를, BER은 10%의 개선 효과를 보인 것은 주목할 만한 결과이다.
PDF KSCI

음질 열화를 줄이고 공격에 강인한 오디오 워터마킹 알고리듬 (Robust Audio Watermarking Algorithm with Less Deteriorated Sound)

강명수;조상진;정의필
- 한국음향학회지
- /
- 제28권7호
- /
- pp.653-660
- /
- 2009
본 논문에서는 오디오 신호의 저작권 보호와 효과적인 음질 개선을 위한 새로운 워터마킹 알고리듬을 제안한다. 제안한 방법은 원 신호에 푸리에 변환을 하여 주파수 영역으로 변환하고 n개의 서브밴드로 균등 분할한다. 각 밴드별 에너지를 계산하여 에너지가 큰 것부터 k개를 선택하고 해당 밴드에서 p개의 주요 피크 성분을 검출하여 길이 m의 워터마크를 삽입한다. 워터마크된 오디오 신호를 청자에게 들려주었을 때 워터마크 삽입으로 인한 오디오 신호의 왜곡을 느끼지 못하였다. 또한, 제안한 방법은 Cox 방법만큼 MP3 압축, 잘라내기 (cropping),주파수 변환 (FFT), 반향 (echo)과 같은 워터마크 공격에 강인하였고 신호 대 잡음비 측면에서는 10 dB이상 우수함을 실험을 통해 확인할 수 있었다.
https://doi.org/10.7776/ASK.2009.28.7.653 인용 PDF KSCI

향상된 잡음 추정을 이용한 적응 지각필터의 연산량 개선 알고리즘 (Reduction of Computation Algorithm for Adaptive Perceptual Filter Using Enhanced Noise Estimation)

서보국;차형태;유일현;구교식
- 융합신호처리학회 학술대회논문집
- /
- 한국신호처리시스템학회 2005년도 추계학술대회 논문집
- /
- pp.264-267
- /
- 2005
본 논문에서는 매 프레임 단위로 노이즈를 추정하는 방법을 적용하는 전처리 기법을 이용하여 적응 지각필터의 연산량을 개선하는 알고리즘을 제안한다. 제안된 전처리 잡음 주정 알고리즘은 잡음에 열화 된 대역으로부터 잡음을 추정하여 적응 지각필터에 적용함으로써 연산량 개선과 동시에 오디오 신호의 음질을 개선하는 알고리즘이다. 이는 처리되는 신호 구간에 따라 잡음에 열화 된 대역으로부터 잡음을 추정함으로써 초기 추정 잡음에 보다 가까운 추정 잡음을 얻을 수 있다. 결과적으로 적응 지각필터의 연산량을 효과적으로 줄일 수 있다. 성능 평가를 위하여 지각필터의 적용 결과와 제안한 알고리즘의 적용 결과로 얻어진 개선 신호의 SSNR, NMR의 비교와 적응 지각필터 적용 횟수, 동작 시간 등을 이용하여 성능의 개선을 확인하다.
PDF

자동 이득 제어기를 적용한 5-밴드 디지털 오디오 그래픽 이퀄라이저 설계 (Design of the 5-band Digital Audio Graphic Equalizer adopted Automatic Gain Controller)

김태형;김환용
- 한국컴퓨터산업학회논문지
- /
- 제3권1호
- /
- pp.27-34
- /
- 2002
네트워크와 IT산업의 급속한 발전과 더불어 정보통신에 대한 관심이 매우 커지고 있다. 정보통신 분야에서는 주로 디지털 신호가 사용되므로 아날로그 신호를 디지털 신호로 변환하여야 한다. 그러나 음성이나 영상과 같은 자연상태의 아날로그 신호가 디지털 신호로 변환될 때 발생하는 왜곡을 제거하는 것은 매우 어려운 과정이다. 원음 또는 각자 취향에 맞는 음질을 발생시키기 위해서 기존의 오디오 그래픽 이퀄라이저는 매우 복잡한 과정을 통하여 고차의 필터 계수 및 이득을 계산하였다. 그러므로 이러한 요구사항을 만족시키기 위해서 는 시스템이 복잡하여 경제성이 떨어지고 타 시스템 내부에 장착할 수가 없었다. 본 논문에서는 오디오 음질의 개선과 시스템 성능향상 및 내부 장착이 가능한 새로운 디지털 오디오 그래픽 이퀄라이저를 설계하였다. 또한 필터 계수 및 이득을 자동으로 처리함으로써 실시간 처리가 가능하고 음질이 향상되도록 하였다.
PDF

TMS320C6413 DSP프로세서를 이용한 적응 음질개선 시스템의 구현에 관한 연구 (Implementation of adaptive speech enhancement system using TMS320C6413 DSP processor)

이영일;이순려;신윤기;최홍섭
- 한국음향학회:학술대회논문집
- /
- 한국음향학회 2004년도 추계학술발표대회논문집 제23권 2호
- /
- pp.101-104
- /
- 2004
본 논문에서는 보상기를 채용하여 안정성을 확보한 적응순환필터인 ACHARF(Adaptive Compensated Hyperstable Adaptive Recursive Filter)를 사용하여 잡음제거를 통한 음성의 음질개선을 DSP 프로세서를 통하여 구현하였다. 실험에서는 TI사의 최신 DSP 프로세서인 TMS320C6413와 스테레오 오디오 코덱인 TLV320AIC23을 탑재한 Evaluation board를 사용하였다. 2개의 입력마이크를 이용하여 음성신호와 기준 잡음신호를 별도로 수집하여 알고리즘을 수행하였으며, 실험 결과로 음질개선 효과를 확인할 수 있었다. 본 연구를 통해서 시스템의 성능개선의 핵심은 입력으로 들어오는 음성신호와의 상관도가 가능한 적은 잡음신호를 수집하는 방법이라 생각되며 앞으로 이에 대한 연구가 필요하겠다.
PDF

ADRess 알고리즘 기반 새로운 분리음원 합성 기법 (New Separated Sound Source Synthesis based on ADRess Algorithm)

정영호;장대영;이태진
- 한국방송∙미디어공학회:학술대회논문집
- /
- 한국방송공학회 2015년도 추계학술대회
- /
- pp.56-59
- /
- 2015
본 논문에서는 스테레오 오디오 신호를 이용하여 음원을 분리하는 ADRess 알고리즘을 기반으로, 추정된 음원 방위각에 대한 신호 강도비를 이용하여 분리음원을 생성하는 새로운 분리음원 합성 기법을 제안한다. 입력된 스테레오 채널 신호 간 강도 차(IID) 특성을 이용하여 신호 분석 프레임별로 개선된 신호 강도비 함수에 따른 frequency-azimuth 평면을 구성하고, 이를 통해 추정된 방위각에 상응하는 신호 강도비로 표현되는 확률밀도함수를 좌/우 신호 중 하나의 주 입력 신호에 취함으로써 분리음원을 합성한다. 제안된 기법의 성능을 검증하기 위하여 SASSEC 에서 제공하는 테스트 음원 및 객관적 평가 지표를 이용하여 측정한 결과, 기존 ADRess 알고리즘에서 제시된 방법에 비해 개선된 품질의 분리음원을 합성하는 것으로 평가되었다.
PDF

저비트율로 압축된 오디오의 음질 개선 방법 (Audio Quality Enhancement at a Low-bit Rate Perceptual Audio Coding)

서정일;서진수;홍진우;강경옥
- 한국음향학회지
- /
- 제21권6호
- /
- pp.566-575
- /
- 2002
이동통신망과 같이 제한된 대역폭에서 실시간 멀티미디어 스트리밍 서비스를 제공하기 위해서는 보다 낮은 비트율로 비디오와 오디오 데이터를 압축하여야 한다. 또한 대부분의 대역이 비디오 데이터를 위해 할당되어 있으므로 제한된 대역폭만이 오디오에 할당되게 된다. 오디오 데이터를 낮은 비트율로 압축하기 위해서는 압축율이 높은 알고리즘을 사용하거나, 표본화 주파수 (sampling frequency)를 낮춤으로써 데이터 양을 줄여 낮은 비트율로 부호화하여야 한다. 본 논문에서는 이러한 문제점을 극복하기 위해서 낮은 표본화 주파수로 오디오 신호를 압축하고, 낮은 표본화주파수를 사용함으로서 발생하는 대역폭의 손실은 소량의 부가정보를 이용하여 복원해 줌으로써 음질을 향상시키는 알고리즘을 제안한다. 높은 주파수의 스펙트럼을 복원하기 위하여 부호화단에서 낮은 주파수 대역과 다운 샘플링 과정 중에 손실되는 높은 주파수 대역간의 에너지비를 바크밴드에 구한 후 이를 부호화하여 복호화 단으로 전달하고 이를 이용하여 높은 주파수 성분을 복원하는 방법을 제안하였다. 제안된 방법을 이용하면 10%∼20% 정도의 추가적인 비트를 사용하면서 기존의 방식보다 세그멘탈 신호대 잡음비는 1㏈∼3㏈의 성능 개선을 보였으며, 주관적인 MOS 듣기 평가를 수행한 결과 기존의 방식보다 음질이 향상됨을 확인하였다. 또한 본 논문에서 제안한 방법은 주파수 영역에서 압축을 수행하는 모든 오디오 부호화 방식에도 적용이 가능하다.
PDF KSCI

차량환경에서 DMB용 음성명령어기 사용을 위한 음성개선방법 (Speech Enhancement for DMB Voice commander in Car environment)

백승권;한민수;남승현;강경옥
- 한국방송∙미디어공학회:학술대회논문집
- /
- 한국방송공학회 2003년도 정기총회 및 학술대회
- /
- pp.233-236
- /
- 2003
본 논문에서는 차량용 음성명령어기의 사용을 위한 전처리 과정으로 음성개선 방법을 다룬다. 특히 DMB 사용환경에서 보다 주위 소음에 자유롭고 단말 조작에 있어 안정성을 보장하기 위하여 일반적 단인 마이크로폰으로 처리되는 잡음뿐만 아니라 음성명령어를 제외한 오디오 신호 등 비정적 통계적 특성을 갖는 소음들도 제거 될 수 있도록 음성개선 방법을 제안한다. 우리는 2개의 마이크로폰을 가지고 BSS 알고리즘을 적용하여 비정적 신호들을 분리하고, 분리된 신호에 대하여 Kalman Filter를 이용하여 시간상 단구간 정적 잡음을 제거한다. 본 논문의 인식 실험 결과를 통하여 공간적, 시간적 음성개선 방법이 순차적으로 적용될 때, 실제 차량 환경에서 음성 개선 알고리즘으로 적용될 수 있음을 보였다
PDF

오디오 부호화기를 위한 스펙트럼 변화 및 MFCC 기반 음성/음악 신호 분류 (Speech/Music Signal Classification Based on Spectrum Flux and MFCC For Audio Coder)

이상길;이인성
- 한국정보전자통신기술학회논문지
- /
- 제16권5호
- /
- pp.239-246
- /
- 2023
본 논문에서는 오디오 부호화기를 위한 스펙트럼 변화 파라미터와 Mel Frequency Cepstral Coefficients(MFCC) 파라미터를 이용하여 음성과 음악 신호를 분류하는 개루프 방식의 알고리즘을 제안한다. 반응성을 높이기 위해 단구간 특징 파라미터로 MFCC를 사용하고 정확도를 높이기 위해 장구간 특징 파라미터로 스펙트럼 변화를 사용하였다. 전체적인 음성/음악 신호 분류 결정은 단구간 분류와 장구간 분류를 결합하여 이루어진다. 패턴인식을 위해 Gaussian Mixed Model(GMM)을 사용하였고, Expectation Maximization(EM) 알고리즘을 사용하여 최적의 GMM 파라미터를 추출하였다. 제안된 장단구간 결합 음성/음악 신호 분류 방법은 다양한 오디오 음원에서 평균적으로 1.5% 분류 오류율을 보였고 단구간 단독 분류 방법 보다 0.9%, 장구간 단독 분류 방법보다 0.6%의 분류 오류율의 성능 개선을 이룰 수 있었다. 제안된 장단구간 결합 음성/음악 신호 분류 방법은 USAC 오디오 분류 방법보다 타악기 음악 신호에서 9.1% 분류 오류율, 음성신호에서 5.8% 분류 오류율의 성능 개선을 이룰 수 있었다.
https://doi.org/10.17661/jkiiect.2023.16.5.239 인용 PDF HTML

검색결과 72건 처리시간 0.02초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)