• 제목/요약/키워드: performance enhancement

검색결과 2,937건 처리시간 0.026초

복소 라플라시안 확률 밀도 함수에 기반한 음성 향상 기법 (Noisy Speech Enhancement Based on Complex Laplacian Probability Density Function)

  • 박윤식;조규행;장준혁
    • 대한전자공학회논문지SP
    • /
    • 제44권6호
    • /
    • pp.111-117
    • /
    • 2007
  • 본 논문에서는 복소 라플라시안 확률밀도함수 (PDF, Probability Density Function)에 기반한 새로운 음성 향상 기법을 제시한다. 적용된 복소 라플라시안 PDF가 기존의 가우시안 PDF보다 오염된 음성 분포를 정확하게 표현한다는 것을 Goodness-of-Fit (GOF) 테스트로 확인하였고, 음성 향상 알고리즘의 음성부재확률을 위해 우도비 (LR, Likelihood Ratio)를 적용하였다. 제시된 알고리즘의 성능은 객관적 테스트에 의해 평가하였고 기존의 가우시안 PDF보다 개선된 음성 향상 결과를 나타내었다.

Push-to-talk 통신을 위한 진폭 및 위상 복원 기반의 단일 채널 음성 향상 방식 (A single-channel speech enhancement method based on restoration of both spectral amplitudes and phases for push-to-talk communication)

  • 조혜승;김형국
    • 한국음향학회지
    • /
    • 제36권1호
    • /
    • pp.64-69
    • /
    • 2017
  • 본 논문에서는 PTT(Push-To-Talk) 기반의 무선 통신을 위한 진폭 및 위상 복원 기반의 단일 채널 음성 향상 방식을 제안한다. 제안한 방식은 신호의 진폭만을 대상으로 음성 향상을 진행했던 기존의 방식들과 달리, 음성 신호의 진폭과 위상을 분리하여 각각 향상시켜 다시 결합함으로써 더욱 양질의 음성을 제공한다. 본 논문에서 제안하는 방식의 성능을 평가하기 위해 동적 잡음 환경에서의 단계별 비교 실험을 실시하였으며, 실험 결과를 통해 제안한 방식이 다양한 잡음 환경에서 양질의 음성을 제공하는 것을 확인할 수 있다.

Salient Region Extraction based on Global Contrast Enhancement and Saliency Cut for Image Information Recognition of the Visually Impaired

  • Yoon, Hongchan;Kim, Baek-Hyun;Mukhriddin, Mukhiddinov;Cho, Jinsoo
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제12권5호
    • /
    • pp.2287-2312
    • /
    • 2018
  • Extracting key visual information from images containing natural scene is a challenging task and an important step for the visually impaired to recognize information based on tactile graphics. In this study, a novel method is proposed for extracting salient regions based on global contrast enhancement and saliency cuts in order to improve the process of recognizing images for the visually impaired. To accomplish this, an image enhancement technique is applied to natural scene images, and a saliency map is acquired to measure the color contrast of homogeneous regions against other areas of the image. The saliency maps also help automatic salient region extraction, referred to as saliency cuts, and assist in obtaining a binary mask of high quality. Finally, outer boundaries and inner edges are detected in images with natural scene to identify edges that are visually significant. Experimental results indicate that the method we propose in this paper extracts salient objects effectively and achieves remarkable performance compared to conventional methods. Our method offers benefits in extracting salient objects and generating simple but important edges from images containing natural scene and for providing information to the visually impaired.

Contrast-enhanced Bias-corrected Distance-regularized Level Set Method Applied to Hippocampus Segmentation

  • Selma, Tisa;Madusanka, Nuwan;Kim, Tae-Hyung;Kim, Young-Hoon;Mun, Chi-Woong;Choi, Heung-Kook
    • 한국멀티미디어학회논문지
    • /
    • 제19권8호
    • /
    • pp.1236-1247
    • /
    • 2016
  • Recently, the level set has become a popular method in many research fields. The main reason is that it can be modified into many variants. One such case is our proposed method. We describe a contrast-enhancement method to segment the hippocampal region from the background. However, the hippocampus region has quite similar intensities to the neighboring pixel intensities. In addition, to handle the inhomogeneous intensities of the hippocampus, we used a bias correction before hippocampal segmentation. Thus, we developed a contrast-enhanced bias-corrected distance-regularized level set (CBDLS) to segment the hippocampus in magnetic resonance imaging (MRI). It shows better performance than the distance-regularized level set evolution (DLS) and bias-corrected distance-regularized level set (BDLS) methods in 33 MRI images of one normal patient. Segmentation after contrast enhancement and bias correction can be done more accurately than segmentation while not using a bias-correction method and without contrast enhancement.

테라헤르츠 신호를 이용한 영상의 글자 추출을 위한 화질 개선처리에 대한 연구 (A Study of Image Enhancement Processing for Letter Extraction of Image Using Terahertz Signal)

  • 김성윤;최현근;박인호;김영섭;이용환
    • 반도체디스플레이기술학회지
    • /
    • 제16권3호
    • /
    • pp.111-115
    • /
    • 2017
  • Terahertz waves are superior to conventional X-ray or Magnetic Resonance Tomography(MRI), and the amount of information that can be transmitted is as large as thousands of times that conventional X-ray or MRI. In addition, Terahertz waves have great performance in analyzing an object which have some layered structure. By using this advantage, we can extract the letters of a page by analyzing information such as absorption amount and reflection amount by irradiating a closed book with pulses of various frequencies within gap of a terahertz wave. However, in the image of each page using the Terahertz wave might be obtained various kinds of noise and the different character occlusion region. So, to extract letters from the terahertz image, we must take the noise and occlusion region away. We have been working to enhancement the image quality in various ways, and keep on studying de-noising processing for enhancement about the image quality and high resolution. Finally, we also keep on studying about OCR(Optical Character Recognition) technology, which based on pattern matching technique, to read letters.

  • PDF

지문이미지 인증률 향상을 위한 전처리 알고리즘 (Preprocessing Algorithm for Enhancement of Fingerprint Identification)

  • 정승민
    • 대한전자공학회논문지SP
    • /
    • 제44권3호
    • /
    • pp.61-69
    • /
    • 2007
  • 본 논문에서는 지문 인식에 있어서 정확한 특징점 추출이 가능하도록 지문 이미지의 전처리를 개선하는 새로운 방법을 제안하였다. 지문 이미지는 자동 지문인증 시스템의 인증률 향상에 가장 중요한 요소이다. 본 논문에서는 방향지향성 필터에 기초한 새로운 전처리 알고리즘을 적용하여 지문 이미지의 유효 융선 벡터와 융선 확률을 이용하여 품질이 낮은 지문 이미지를 지문인식에 더 적합하도록 품질을 항상시켰다. 품질이 좋지 않은 지문 이미지는 융선 구조가 불명확하고, 융선 사이에 잡음 점들이 많이 포함되어 있기 때문에 제안된 지문 이미지 향상 알고리즘을 통해서 그 잡음이 제거되고 융선이 더 선명하게 추정되었다. 이로 인하여 융선의 지역적 방향과 주파수를 더 정확히 추출 할 수 있다. 이 결과는 지문인식의 후처리 알고리즘에서 특징점을 정확하게 추출 할 수 있게해준다. 아울러 가짜 특징점이 생길 확률이 낮아지므로 이를 제거 할 때 함께 없어지는 진짜 특징점 수도 감소 시켜 준다. 두 가지 방법으로 이루어진 실험에서는 반도체 지문센서로부터 얻어진 이미지를 이용한 인증률 테스트의 향상도 측정방법과, IEEE 공인인증 데이터베이스인 FVC2002 DB3 지문이미지 데이터를 이용하여 기존의 알고리즘과 제안된 알고리즘의 인증률을 측정하였다.

임베디드 연산을 위한 잡음에서 음성추출 U-Net 설계 (Design of Speech Enhancement U-Net for Embedded Computing)

  • 김현돈
    • 대한임베디드공학회논문지
    • /
    • 제15권5호
    • /
    • pp.227-234
    • /
    • 2020
  • In this paper, we propose wav-U-Net to improve speech enhancement in heavy noisy environments, and it has implemented three principal techniques. First, as input data, we use 128 modified Mel-scale filter banks which can reduce computational burden instead of 512 frequency bins. Mel-scale aims to mimic the non-linear human ear perception of sound by being more discriminative at lower frequencies and less discriminative at higher frequencies. Therefore, Mel-scale is the suitable feature considering both performance and computing power because our proposed network focuses on speech signals. Second, we add a simple ResNet as pre-processing that helps our proposed network make estimated speech signals clear and suppress high-frequency noises. Finally, the proposed U-Net model shows significant performance regardless of the kinds of noise. Especially, despite using a single channel, we confirmed that it can well deal with non-stationary noises whose frequency properties are dynamically changed, and it is possible to estimate speech signals from noisy speech signals even in extremely noisy environments where noises are much lauder than speech (less than SNR 0dB). The performance on our proposed wav-U-Net was improved by about 200% on SDR and 460% on NSDR compared to the conventional Jansson's wav-U-Net. Also, it was confirmed that the processing time of out wav-U-Net with 128 modified Mel-scale filter banks was about 2.7 times faster than the common wav-U-Net with 512 frequency bins as input values.

잡음 에너지 제어를 통한 지각 필터 성능 개선 (Performance Improvement of Perceptual Filter Using Noise Energy Control)

  • 서정국;차형태
    • 한국음향학회지
    • /
    • 제24권1호
    • /
    • pp.43-51
    • /
    • 2005
  • 본 논문에서는 잡음 에너지 제어를 통한 지각 필터의 성능을 향상시킴으로써 잡음에 의해 열화 된 오디오 신호의 음질을 개선하는 알고리즘을 제안한다. 기존의 방식에서는 묵음 구간에서 획득한 잡음 에너지를 사용하여 필터를 구성하여 사용하지만, 신호 구간마다 달라지는 신호의 세기 및 잡음의 환경 정도에 많은 영향을 받아 잡음의 에너지가 급격하게 변화한다면 음질의 개선률이 감소함을 알 수 있다. 그러나 제안하는 방식에서는 묵음 구간에서 추정한 잡음의 에너지 제어를 통해 초기 추정 잡음보다 가까운 추정 잡음을 얻음으로써 잡음 에너지가 급격하게 변화하여도 음질 개선률에는 변화가 적음을 알 수 있었다. 또한 저 대역에 영향을 미치는 잡음의 경우에도 다른 방법들과는 달리 음질의 개선이 뚜렷하였다. 기존 방식과의 비교를 위해 다양한 신호 대 잡음 비 (signal-to-noise ratio, SNR)에서 열화 된 오디오 신호를 입력으로 사용하였다. 입력 SNR이 5dB, l0dE, 15dB와 20dB의 각각의 경우에 대하여 SSNR (Segmental SNR)과 잡음 대 마스킹 비 (Noise-to-mask ratio, NMR), 음질 테스트를 수행한 결과, 청감 테스트 (Mean Opinion Score, MOS Test)결과의 향상과 음질의 개선을 확인할 수 있었다.

잡음 데이터를 활용한 음성 기저 행렬과 NMF 기반 음성 향상 기법 (Speech Basis Matrix Using Noise Data and NMF-Based Speech Enhancement Scheme)

  • 권기수;김형용;김남수
    • 한국통신학회논문지
    • /
    • 제40권4호
    • /
    • pp.619-627
    • /
    • 2015
  • 본 논문은 비음수 행렬 인수분해(NMF)를 이용한 음성향상 기법을 다루고 있다. 음성과 잡음에서 적절한 훈련을 통해 각각의 기저(basis) 행렬을 구하고 이 행렬들을 이용하여 두 음원을 분리 하는 것이다. 그 중에서도 음성향상의 성능은 사용하게 되는 기저 행렬에 따라 크게 달라짐을 보인다. 기존의 독립적으로 구한 음성 기저 행렬에 비해서, 잡음 데이터를 복원하는데 부적합한 방향으로 최적화시킨 음성 기저 행렬을 사용하였을 때 더 높은 음성향상 성능을 보임을 실험으로 확인하였다. 이 때 잡음 데이터의 복원 오차 자체를 크게 해주는 방향과 해당 인코딩 행렬(encoding matrix) 원소의 값을 작게 해주는 두 가지 방법을 적용하여 비교하였다. 좀 더 음성 복원에만 특화된 기저 행렬을 구함으로서 음성 기저 행렬이 잡음 데이터 복원에 사용되는 것을 최소화 하였다. 실험 결과에서는 perceptual evaluation speech quality값과 signal to distortion ratio를 지표로 사용하였고, 기존 기법에서 사용하는 기저 행렬 보다 더 높은 성능을 보임을 확인 하였다.

이성분 나노유체($NH_3/H_2O$+나노입자)의 흡수성능 촉진실험 (Experimental of Absorption Performance Enhancement for Binary Nanofluids($NH_3/H_2O$ + Nano Particles))

  • 이진기;정청우;구준모;강용태
    • 대한설비공학회:학술대회논문집
    • /
    • 대한설비공학회 2008년도 하계학술발표대회 논문집
    • /
    • pp.124-129
    • /
    • 2008
  • The objectives of this paper are to examine the effect of nano-particles on the pool type absorption heat transfer enhancement and to find the optimal conditions to design a highly effective compact absorber for $NH_3/H_2O$ absorption system. The effect of $Al_2O_3$ and CNT particles on the absorption performance is studied experimentally. The experimental ranges of the key parameters are 20% of $NH_3$ concentration, $0{\sim}0.08%$ (volume fraction) of CNT particles, and $0{\sim}0.06%$ (volume fraction) of $Al_2O_3$ nano-particles. For the $NH_3/H_2O$ nanofluids, the heat transfer rate and absorption rate with 0.02 vol% $Al_2O_3$ nano-particles were found to be 28.9% and 17.8% higher than those without nano-particles, respectively. It is recommended that the concentration of 0.02 vol% of $Al_2O_3$ nano-particles be the best candidate for $NH_3/H_2O$ absorption performance enhancement.

  • PDF