통합 검색 | Korea Science

광역 스펙트로그램과 심층신경망에 기반한 중첩된 소리의 인식과 영향 분석 (Recognition of Overlapped Sound and Influence Analysis Based on Wideband Spectrogram and Deep Neural Networks)

김영언;박구만
- 방송공학회논문지
- /
- 제23권3호
- /
- pp.421-430
- /
- 2018
많은 음성인식 시스템들은 MFCC와 HMM등의 분류 기법을 사용하여 사람의 음성을 인식한다. 그러나 이러한 음성인식 시스템은 단일 음성신호를 인식하는 것을 목적으로 설계되어, 인간과 기계사이의 일대일 음성 인식에는 적합하나, 애완동물 소리와 실내 소리같은 음성보다 다양하고 넓은 주파수의 소리 군으로 중첩된 음향 속에서 설정된 소리를 인식하기에는 제한이 있다. 중첩된 소리들의 주파수는 사람의 목소리보다 높은 최대 20 kHz까지 넓은 주파수 범위로 구성된다. 본 논문에서는 광역 사운드 스펙트로그램과 DNN에 기반한 케라스 시?셜 모델 기법을 활용하여 인지 주파수 범위를 넓게 확대하는 새로운 인식방법을 제안한다. 광역 사운드 스펙트로그램이 본 논문에서 설계된 특징 추출 및 분류 시스템과 같이 넓은 주파수 범위의 다양한 소리를 분석하고 실험하도록 채택되었다. 소리 인식률을 개선하기 위하여, 케라스 시?셜 모델이 사운드 스펙트로그램에 의하여 생성되어 추출된 특징을 사용하여 패턴인식을 수행하기 위한 방법으로 채용되었다. 제안된 특징 추출 및 분류 시스템이 광역 사운드 스펙트로그램과 케라스 시?셜 모델을 채용하여 애완동물 소리와 실내 소리같은 다양한 주파수들로 구성되어 중첩된 음향 속에서 설정된 소리를 우수하게 분류하는 것을 확인하였다. 그리고 중첩된 소리의 크기에 비례하여 인식에 미치는 특성과 영향을 단계별로 비교 분석하였다.
https://doi.org/10.5909/JBE.2018.23.3.421 인용 PDF KSCI KPUBS

음성의 음향 스펙트로그램 분석

지민제
- 대한음성언어의학회:학술대회논문집
- /
- 대한음성언어의학회 1995년도 제4회 학술대회 심포지움 및 워크샵
- /
- pp.111-127
- /
- 1995
한국어 모음과 자음의 파형, 스펙트로그램을 통해 다음 사항을 중점적으로 다룬다. - 모음과 자음의 조음 및 음향적 특성, - 모음의 좁힙점과 음향적 특성, - /모음＋모음/과 /반모음＋모음/의 차이, - 자음의 조음 방법 및 조음장소에 따른 음향적 특성, - 음성환경에 따른 음향적 특성, - 유/무성에 따른 음향적 특성, - 연/경성에 따른 음향적 특성, - 동시조음에 따른 음향적 특성, - 소리의 길이 (중략)
PDF

음성 분리를 위한 스펙트로그램의 마루와 골을 이용한 시간-주파수 공간에서 소리 분할 기법 (A Method of Sound Segmentation in Time-Frequency Domain Using Peaks and Valleys in Spectrogram for Speech Separation)

임성길;이현수
- 한국음향학회지
- /
- 제27권8호
- /
- pp.418-426
- /
- 2008
본 논문에서는 스펙트로그램에서 마루와 골을 이용한 주파수 채널 분할 알고리즘을 제안한다. 주파수 채널 분할 문제는 동일한 음원으로부터 발생한 음성이 포함된 주파수 채널들을 하나의 그룹으로 묶는 것을 의미한다. 제안된 알고리즘은 입력 신호의 평탄화된 스펙트럼에 기반한 알고리즘이다. 평탄화된 스펙트럼에서 마루와 골은 각각 세그먼트의 중심과 경계를 판단하기 위해 사용된다. 각 세그먼트를 하나의 소리로 묶는 그룹핑 단계 이전에 제안된 알고리즘에 의한 세그멘테이션 결과가 유용함을 평가하기 위하여 이상적인 마스크에 의한 세그멘테이션 결과와 제안된 방법을 비교한다. 제안된 방법을 협대역 잡음, 광대역 잡음, 다른 음성신호와 혼합된 음성신호에 대하여 실험하였다.
https://doi.org/10.7776/ASK.2008.27.8.418 인용 PDF KSCI

선택적 노이즈 캔슬링을 위한 딥 러닝 기반의 환경 인지 기술 (Deep learning based environmental sound classification for selective noise canceling)

최현국;김상민;한석현;신성현;박호종
- 한국방송∙미디어공학회:학술대회논문집
- /
- 한국방송∙미디어공학회 2020년도 하계학술대회
- /
- pp.343-345
- /
- 2020
본 논문에서는 선택적 노이즈 캔슬링을 위한 환경 인지 기술을 제안한다. 기존의 노이즈 캔슬링은 모든 소리를 구분 없이 차단하여 여러 가지 문제를 유발할 수 있으며 공통된 노이즈 캔슬링 동작으로 각 소음에 최적화된 성능을 보장할 수 없다. 이러한 문제를 해결하기 위해 제안하는 방법은 대표적 오디오 특성인 멜-스펙트로그램과 스펙트로그램 기반의 시간적 특성 벡터를 사용하여 환경 인지를 진행한다. 본 논문에서는 attack, rotation, sawing으로 구성된 3가지 소음과 speech, tonal로 구성된 2가지 비 소음으로 총 5가지 클래스를 분류한다. 제안하는 방법에서 특성 벡터로 멜-스펙트로그램만을 사용했을 때 87.5%의 분류 성능을 보였으며, 스펙트로그램 기반의 시간적 특성을 추가했을 때 분류 성능이 91.2%로 향상되었다.
PDF

스펙트로그램 이미지를 이용한 CNN 기반 자동화 기계 고장 진단 기법 (CNN-based Automatic Machine Fault Diagnosis Method Using Spectrogram Images)

강경원;이경민
- 융합신호처리학회논문지
- /
- 제21권3호
- /
- pp.121-126
- /
- 2020
소리 기반 기계 고장 진단은 기계의 음향 방출 신호에서 비정상적인 소리를 자동으로 감지하는 것이다. 수학적 모델을 사용하는 기존의 방법은 기계 시스템의 복잡성과 잡음과 같은 비선형 요인이 존재하기 때문에 기계 고장 진단이 어려웠다. 따라서 기계 고장 진단의 문제를 딥러닝 기반 이미지 분류 문제로 해결하고자 한다. 본 논문에서 스펙트로그램 이미지를 이용한 CNN 기반 자동화 기계 고장 진단 기법을 제안한다. 제안한 방법은 기계의 결함 시 발생하는 주파수상의 특징 벡터를 효과적으로 추출하기 위해 STFT를 사용하였으며, STFT에 의해 검출된 특징 벡터들은 스펙트로그램 이미지로 변환하여 CNN을 이용해 기계의 상태별로 분류한다. 그 결과는 제안한 방법은 효과적으로 결함을 탐지할 뿐만 아니라 소리 기반의 다양한 자동 진단 시스템에도 효과적으로 활용될 수 있다.
PDF KSCI

경량 딥러닝 기반의 돼지 호흡기 질병 탐지 (Porcine Wasting Diseases Detection using Light Weight Deep Learning)

홍민기;안한세;이종욱;박대희;정용화
- 한국정보처리학회:학술대회논문집
- /
- 한국정보처리학회 2020년도 추계학술발표대회
- /
- pp.964-966
- /
- 2020
전염성이 매우 강한 돼지 호흡기 질병을 빠른 시간 내에 정확하게 탐지하지 못한다면 해당 돈사는 물론 타지역으로 전파되어 심각한 경제적 손실이 발생한다. 본 논문은 이와 같은 돼지 호흡기 질병을 저가격의 임베디드 보드에서도 탐지가 가능한 시스템을 제안한다. 해당 시스템은 돈사에 설치한 소리센서로부터 돼지의 이상 소리를 자동으로 탐지한 후, 탐지한 소리 시그널을 스펙트로그램으로 변환한다. 마지막으로, 스펙트로그램은 딥러닝 알고리즘에 적용되어 돼지 호흡기 질병을 탐지 및 식별한다. 이 때, 일반 컴퓨터 환경에 비해 비용 부담이 적은 임베디드 환경에서 실행되기 위하여 경량 딥러닝 모델인 MnasNet 을 사용하였으며, 임베디드 보드인 NVIDIA TX-2 에서 해당 시스템의 호흡기 질병 식별 성능을 확인한 결과 높은 탐지 성능과 실시간 탐지가 가능함을 확인하였다.
https://doi.org/10.3745/PKIPS.y2020m11a.964 인용 PDF

모듈레이션 기법을 이용한 잡음에 강인한 선로 전환기의 이상 상황 탐지 (Noise-Robust Anomaly Detection of Railway Point Machine using Modulation Technique)

이종욱;김아용;박대희;정용화
- 스마트미디어저널
- /
- 제6권4호
- /
- pp.9-16
- /
- 2017
열차의 방향을 기존 방향에서 다른 방향으로 이동시키기 위한 변환 장치인 선로 전환기의 고장은 열차의 탈선 등을 유발시킬 수 있다. 따라서 열차운행의 안전 측면에서 해당 장비에 대한 모니터링은 필수 요소이다. 본 논문에서는 선로 전환기의 구동시 발생하는 소리 정보를 기반으로 잡음에도 강인한 선로 전환기의 이상 상황 탐지시스템을 제안한다. 먼저 제안한 시스템은 소리 센서에서 실시간으로 취득하는 소리 신호에 STFT(Short-Time Fourier Transform)를 적용하여 스펙트로그램을 취득한다. 실제 환경에서 발생하는 잡음의 영향에도 강인한 성능을 보장하기 위하여, 해당 스펙트로그램에 대한 전처리 과정을 수행 후 모듈화 한다. 각각의 모듈에서 평균값과 표준편차를 계산 및 조합하여 특징 벡터로 생성한 후 이진 분류에 뛰어난 성능이 확인된 SVM(Support Vector Machine)에 적용하여 이상 상황을 탐지한다. 실제 선로 전환기의 전환 시 발생하는 소리 데이터를 이용하여 모의실험을 수행한 결과, 제안한 시스템은 잡음이 발생하는 상황에서도 효과적으로 이상 상황을 탐지함을 확인하였다.
PDF KSCI

산업현장에서의 선택적 소음 제거를 위한 환경 사운드 분류 기술 (Environmental Sound Classification for Selective Noise Cancellation in Industrial Sites)

최현국;김상민;박호종
- 방송공학회논문지
- /
- 제25권6호
- /
- pp.845-853
- /
- 2020
본 논문에서는 산업현장에서의 선택적 소음 제거를 위한 환경 사운드 분류 기술을 제안한다. 산업현장에서의 소음은 작업자의 청력 손실의 주요 원인이 되며, 소음 문제를 해결하기 위한 소음 제거 기술이 널리 연구되고 있다. 그러나 기존 소음 제거 기술은 모든 소리를 구분 없이 차단하는 문제를 가지며, 모든 소음에 공통된 제거 방법을 적용하여 각 소음에 최적화된 소음 제거 성능을 보장할 수 없다. 이러한 문제를 해결하기 위해 사운드 종류에 따라 선택적 동작을 하는 소음 제거가 필요하고, 본 논문에서는 이를 위해 딥 러닝 기반의 환경 사운드 분류 기술을 제안한다. 제안 방법은 기존 오디오 특성인 멜-스펙트로그램의 한계를 극복하기 위해 새로운 특성으로서 멜-스펙트로그램 기반의 시간 변화 특성과 통계적 주파수 특성을 사용하며, 합성곱 신경망을 이용하여 특성을 모델링 한다. 제안하는 분류기를 사용하여 3가지 소음과 2가지 비소음으로 구성된 총 5가지 클래스로 사운드를 분류하였고, 제안하는 오디오 특성을 사용하여 기존 멜-스펙트로그램 특성을 사용할 때에 비하여 분류 정확도가 6.6% 포인트 향상되는 것을 확인하였다.
https://doi.org/10.5909/JBE.2020.25.6.845 인용 PDF KSCI KPUBS

멀티로터 UAV 환경에서의 CNN 기반 복소 스펙트로그램 향상 기법 (CNN based Complex Spectrogram Enhancement in Multi-Rotor UAV Environments)

김영진;김은경
- 한국정보통신학회논문지
- /
- 제24권4호
- /
- pp.459-466
- /
- 2020
멀티로터 UAV(Unmanned Aerial Vehicle)를 이용해서 수집한 음향 데이터는 모터나 프로펠러에서 발생하는 자체 소음이나 비행 중 발생하는 바람 소리 등으로 인해 음향 품질이 크게 손상되는 문제가 발생한다. 멀티로터 UAV 환경에서는 목표 음향의 크기뿐만 아니라 위상도 크게 손상되기 때문에 크기와 위상을 모두 고려해서 음향을 향상시킬 필요가 있다. 하지만 위상은 크기와 달리 구조적인 특징이 잘 나타나지 않으므로 향상시키는 것이 쉽지 않다. 따라서 본 연구에서는 크기와 위상을 모두 표현할 수 있는 복소 스펙트로그램을 기초로 잡음을 제거해서 목표 음향의 품질을 향상시키는 CNN 기반 복소 스펙트로그램 향상 방법을 제안한다.
https://doi.org/10.6109/jkiice.2020.24.4.459 인용 PDF KSCI

반려묘 울음소리를 이용한 감정 분류 시스템 (Cat Emotion Classification System using Cat Meowing)

채희찬;이종욱;최윤아;박대희;정용화
- 한국정보처리학회:학술대회논문집
- /
- 한국정보처리학회 2018년도 추계학술발표대회
- /
- pp.666-668
- /
- 2018
최근 반려동물을 키우는 가구 수의 증가와 함께, 반려묘에 대한 관심도 상당히 증가하고 있다. 특히 반려인은 반려묘와의 원활한 의사소통과 교감을 바라지만 반려묘의 세세한 감정 상태를 24시간 내내 파악하는 것은 어려운 일이다. 본 논문에서는 반려묘의 울음소리에 많은 감정 및 상태 정보가 담겨있는 것에 착안하여, 반려묘의 울음소리를 기반으로 감정을 분류하는 시스템을 제안한다. 제안된 시스템은 먼저, 이미 수집된 소리 데이터를 데이터 증폭 방법론을 이용하여 데이터를 확장 한 후, 해당 소리들의 멜 스펙트로그램 정보를 추출한다. 이를 시계열 정보 처리에 효과적인 LSTM에 적용하여 반려묘의 감정 상황을 식별할 수 있도록 학습을 수행한다. 실험 결과, 반려묘의 감정 상태 분류의 가능성을 확인하였다.
https://doi.org/10.3745/PKIPS.y2018m10a.666 인용 PDF

검색결과 25건 처리시간 0.024초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)