• 제목/요약/키워드: 인식단위

검색결과 1,047건 처리시간 0.031초

오인식 형태소 추정에 의한 한국어 문자 인식 후처리 기법 (A Postprocessing Method of Korean Character Recognition by Mis-recognized Morphology Presumption)

  • 김영훈;이영화;이상조
    • 전자공학회논문지C
    • /
    • 제36C권7호
    • /
    • pp.46-55
    • /
    • 1999
  • 본 논문에서는 형태소 분석을 이용한 후처리에서 속도 개선을 위해 사전 탐색 횟수를 줄이는 새로운 방법을 제안한다. 본 논문에서 제안하는 방법은, 오인식 어절 검출을 위한 형태소 분석 과정에서 분석되는 일부의 형태소 정보를 최대한 이용하여 오인식 어절의 형태소 구성을 추정한 후, 형태소 단위의 교정을 한다. 형태소 단위의 교정은 어절보다 길이가 짧으므로 최악의 경우라도 생성되는 후보의 수가 어절 단위의 교정보다 적다. 특히, 생성된 후보가 형태소 단위이므로 사전 탐색만으로 올바른 후보를 선택할 수 있으므로 형태소 분석으로 인한 사전 탐색 횟수를 줄일 수 있다. 본 논문에서 제안한 형태소 정보를 이용한 후처리는 기존의 어절 단위 후처리에 비해 생성된 후보의 형태소 분석이 필요 없다. 생성된 후보가 형태소이므로 사전 탐색에 의해 올바른 후보를 선택할 수 있었다. 이로 인해 사전 탐색 횟수는 어절 단위 후처리와 비교하였을 때 60%나 감소되었으며 후처리 결과 문자 인식기의 음절 인식률이 94%에서 97%로 향상되었다.

  • PDF

분할기반 은닉 마르코프 모델과 다층 퍼셉트론 결합 영문수표필기단어 인식시스템 (A Segmentation-Based HMM and MLP Hybrid Classifier for English Legal Word Recognition)

  • 김계경;김진호;박희주
    • 한국지능시스템학회논문지
    • /
    • 제11권3호
    • /
    • pp.200-207
    • /
    • 2001
  • 본 논문에서는 분할기반 은닉 마르코프 모델(segmentation based hidden Markov model)과 다층 퍼셉트론 (multi-layer perceptron)을 결합한 영문수표 필기단어 (legal word) 인식시스템을 제안하였다. 가변길이의 필기체 영문 단어 분할결과를 인식할 수 있도록 은닉 마르코프 모델을 이용하여 명확한 분할기반 (explicit segmentation-based) 단어단위 (word level) 인식기를 구현하고 다층 퍼셉트론을 이용하여 내재적 분할기반 (implicit segmentation-based) 단어단위 인식기를 구현하였다. 그리고 이종(heterogeneous)의 두 인식기를 새로운 결합 확률추정방식에 따라 결합함으로서 상호 보완 능력을 극대화시킬 수 있는 영문수표 필기단어 인식시스템을 구현하였다. 제안한 시스템을 캐나다 콘코디아 대학의 CENPARMI 영문 수표 데이터베이스에 적용하여 실험해 본 결과 기존의 연구결과에 비해 비교적 우수한 인식성능을 얻을 수 있었다.

  • PDF

확률 발음사전을 이용한 대어휘 연속음성인식 (Stochastic Pronunciation Lexicon Modeling for Large Vocabulary Continous Speech Recognition)

  • 윤성진;최환진;오영환
    • 한국음향학회지
    • /
    • 제16권2호
    • /
    • pp.49-57
    • /
    • 1997
  • 본 논문에서는 대어휘 연속음성인식을 위한 확률 발음사전 모델에 대해서 제안하였다. 확률 발음 사전은 HMM과 같이 단위음소 상태의 Markov chain으로 이루어져 있으며, 각 음소 상태들은 음소들에 대한 확률 분포 함수로 표현된다. 확률 발음 사전의 생성은 음성자료와 음소 모델을 이용하여 음소 단위의 분할과 인식을 통해서 자동으로 생성되게 된다. 제안된 확률 발음 사전은 단어내 변이와 단어간 변이를 모두 효과적으로 표현할 수 있었으며, 인식 모델과 인식기의 특성을 반영함으로써 전체 인식 시스템의 성능을 보다 높일 수 있었다. 3000 단어 연속음성인식 실험 결과 확률 발음 사전을 사용함으로써 표준 발음 표기를 사용하는 인식 시스템에 비해 단어 오류율은 23.6%, 문장 오류율은 10% 정도를 감소시킬 수 있었다.

  • PDF

음성인식을 위한 화자적응화 기법에 관한 연구 (A Study on Methods of Speacker Adaptation for Speech Recognition)

  • 이종연
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1998년도 학술발표대회 논문집 제17권 2호
    • /
    • pp.309.2-314
    • /
    • 1998
  • 본 연구에서는 음성인식을 위한 화자적응화 기법에 대해 연구하였다. 첫째로 적응화에 포함되지 않은 카테고리 음절에 대해 적응화 효과를 줄 수 있는 보간적응화 방법에 대해 연구하였다. 표준모델과 소량의 음성 데이터만으로 적응화가 가능한 MAPE(최대사후확률추정)으로 적응화한 모델의 평균벡터 변화정도를 적응화 발화에 포함되지 않은 모델에 보간적응하는 방법이다. 둘째로 음절단위 모델을 구축한 후 적응화 하고자 하는 화자의 데이터를 연결학습법과 Viterbi 알고리즘으로 음절단위의 추출을 자동화 한 후 MAPE으로 적응화하는 방법에 대해 각각 실험을 하였다.

  • PDF

단위벡터를 이용한 한글 인식에 관한 연구 (A study on Korean character recognition using the sun of unit vector)

  • 천수연;조동섭
    • 대한전기학회:학술대회논문집
    • /
    • 대한전기학회 1987년도 전기.전자공학 학술대회 논문집(II)
    • /
    • pp.1104-1106
    • /
    • 1987
  • 본 논문은 한글 자모 인식에 관한 새로운 방법을 제시한다. 본 연구는 한글패턴을 독립된 자소의 부분패턴으로 나누어서 특정점들(끝점, 7굴곡점, T굴곡점)을 추출하여 각 굴곡점에서 연결되는 점과의 벡터를 글자의 크기에 관계없도록 하기 위해 크기가 1인 단위벡터를 구한 후 이들의 합성벡터를 생성한다. 생성된 합성벡터들의 수, 벡터들이 지준축과 이루는 각, 그리고 특정점들의 수로부터 한글의 기본 자모를 분류하는 과정을 연구하였다. 입력된 한글패턴은 이미 세선화가 된 자모패턴으로 하였다.

  • PDF

실시간 FM 방송중 음악/음성 검출에 관한 연구 (A Study on Real-time Discrimination of FM Radio Broadcast Speech/Music)

  • 황진만;강동욱;김기두
    • 대한전자공학회:학술대회논문집
    • /
    • 대한전자공학회 2003년도 하계종합학술대회 논문집 Ⅳ
    • /
    • pp.2136-2139
    • /
    • 2003
  • 본 논문은 FM 라디오 방송중의 오디오 신호를 블록단위로 음악 및 음성을 검출하는 알고리즘에 대한 것으로, 이를 기반으로 방송중의 노래(가요, 팝, 클래식‥‥)만을 자동으로 인식하여 녹음하는 알고리즘을 개발한다. 본 논문에서는 기존에 제안되었던 것[1-4]과 같이 단지 음악과 음성을 구분함과 동시에 음악구간의 논리적 조합으로 이루어진 노래를 자동으로 인식하여 녹음하는 것을 알고리즘의 최종 목표로 한다. 알고리즘의 접근 역시 기존의 음소단위의 모델링을 거치는 GMM 기반의 접근이 아니기 때문에 모델링에 대한 훈련과정이 필요 없고, 시간영역에서의 오디오신호가 가지고 있는 직관적인 특징을 분석함으로써 비교적 적은 연산으로 실시간 구현이 가능하다.

  • PDF

진동의 표현과 진동기준

  • 김문겸
    • 전산구조공학
    • /
    • 제9권1호
    • /
    • pp.4-7
    • /
    • 1996
  • 진동을 정량화하기 위해서는 진동변위, 진동속도, 진동가속도 등의 척도를 사용하여 진동의 크기를 나타내고 있다. 또한 각 국가별로 지반조건 및 사회적 특성에 따라 진동척도의 단위가 통일되지 않았고, 각 단위에 대한 진동기준도 다양하게 설정되어 있는 실정이다. 본 기사에서는 진동변위, 진동속도, 진동가속도로 표현된 진동기준을 국외에서 연구 제시된 자료를 중심으로 고찰하였으며 각기 다른 척도 및 단위로 표현된 기준들을 통일된 단위인 진동수준으로 표현하였다. 국내에서도 점차 진동문제에 대한 인식이 늘어감에 따라 진동기준에 대한 필요성이 증가하고 있는 시점에서 국내 실정에 적합하게 진동문제를 효과적으로 표현할 수 있으며, 현장에서 계측하고 평가하기에 편리한 진동 표현방법의 기준설정에 대한 기초적인 준비가 필요하다고 사료된다.

  • PDF

소표본 통계단위에서의 집세 변동률 추정

  • 박원란
    • 한국통계학회:학술대회논문집
    • /
    • 한국통계학회 2003년도 춘계 학술발표회 논문집
    • /
    • pp.63-68
    • /
    • 2003
  • 도시가구의 지출 중 집세가 차지하는 비율이 높으며 그 변동에 따라 도시가구의 생활에 미치는 영향도 커서 중요한 통계자료로 인식되고 있다. 집세 계약기간이 통상 2년 단위이기 때문에 집세변동의 발생빈도가 적어서 이러한 소표본 군의 통계단위로 일반적인 집세지수를 작성하는데는 많은 어려움이 따른다. 그렇다고 해서 소표본 군의 표본을 확대하는 것도 어렵기 때문에 이러한 산술적인 표본확대가 어려운 소표본 군의 문제점을 해결하기 위해 소지역 추정법을 도입하였다. 이러한 소표본 통계단위에서의 집세 변동률 추정방법을 경기도 지역의 6개 도시에서의 집세변동을 추정하는데 적용하였으며 검토해 보았다.

  • PDF

비트맵 인덱싱 기반 유사한 XML 문서 검색 기법 (A Search Method of Similar XML Documents based on Bitmap Indexing)

  • 이재민;황병연
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2004년도 춘계학술발표대회
    • /
    • pp.15-18
    • /
    • 2004
  • XML 검색을 위한 기존의 비트맵 인덱싱은 XML을 문서, 경로, 단어로 구성된 3차원 비트맵 인덱스에 매핑하고 이를 이용해 정보를 추출함으로써 뛰어난 성능을 입증하였다. 그러나 이것은 유사 문서를 수집하고 검색하기 위해 경로 전체를 인덱스 구성의 단위로 사용함으로써 유사 경로를 인식하지 못하는 문제를 초래하였으며 유사 경로를 인식하지 못함으로 인해 유사 문서 검색의 치명적인 성능 저하가 발생하게 되었다. 이에 따라 본 논문에서는 기존의 XML 검색을 위한 비트맵 인덱싱이 유사 경로를 인식하지 못하는 문제점을 해결하기 위해 유사 경로 탐색을 위한 새로운 비트맵 인덱스를 설계하고 이를 통해 효과적으로 유사 문서를 검색할 수 있는 기법을 제안한다. 제안된 기법은 노드들을 단위로 하는 새로운 비트맵 인덱스를 구성하고 구성된 인덱스의 중심을 통해 유사 경로 탐색을 위한 클러스터들을 선별적으로 검색한다. 그리고 유사 경로 탐색을 통해 추출된 경로들을 유사 문서 검색에 활용함으로써 비트맵 인덱싱의 빠른 성능을 그대로 유지하면서 기존의 XML 검색을 위한 비트맵 인덱싱이 유사 경로를 인식하지 못함으로써 발생하는 유사 문서 탐색의 성능 저하를 효과적으로 해결한다.

  • PDF

도시주변 면단위 행정구역의 지역 변화 -전라북도 조촌면을 사례로- (Regional Transformation in 'Myeon' Administrative District adjacent to Urban Area)

  • 조성욱
    • 한국지역지리학회지
    • /
    • 제12권1호
    • /
    • pp.59-71
    • /
    • 2006
  • 행정구역으로서 '면(面)'은 자연적인 마을 단위와 가장 가까이에 접하고 있는 인위적인 행정구역이다. 시와 군단위의 행정구역명이 역사성이나 인식 측면에서 훨씬 광범위하지만, 면단위는 그 지역에 사는 사람에 한정되는 인식규모가 매우 적은 지리적 단위(범위)이며, 존속여부나 행정구역명의 변화가 가장 심한 행정구역 단위이다. 면단위에서의 지역 중심지가 확립된 것은 1917년 면사무소의 설치와 직접적으로 관련된다. 본 연구에서는 전라북도 전주시 조촌면(동)지역을 사례로 면단위 지역에서의 지리적 범위 변화와 지명(면명)의 변화 유형 및 의미하는 지역과 관계된 정체성, 면단위 지역규모에서 나타나는 지역 중심지의 형성과 그 요인을 살펴봤다. 조촌면의 지역 변화는 첫째, 전주시와 근접한 관계로 전주시의 팽창에 따른 편입 및 통합이 지리적 범위 변화에 많은 영향을 미쳤다. 둘째, 조촌면은 지명(면명)을 유지하고는 있지만, 그 지명이 의미하는 지리적 범위는 달라졌다. 셋째, 신작로와 철도역의 개설, 일본인의 농장 개설, 면사무소의 설치, 정기시장 개장의 과정을 통해서 면의 중심지가 형성되었다.

  • PDF