• 제목/요약/키워드: 필기 문자열 처리

검색결과 7건 처리시간 0.02초

과다 분리 및 사전 후처리 기법을 이용한 한글이 포함된 무제약 필기 문자열의 오프라인 인식 (Off-Line Recognition of Unconstrained Handwritten Korean Words using Over-Segementation and Lexicon Driven Post-Processing Techniques)

  • 정선화;김수형
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제26권5호
    • /
    • pp.647-656
    • /
    • 1999
  • 본 논문에서는 오프라인 무제약 필기 한글 단어를 인식하기 위한 시스템을 제안한다. 제안된 단어 인식 시스템은 크게 다석가지 모듈-문자 분리,조합행렬생성, 특징 추출, 문자인식, 사전 후처리 -로 구성되어 있다. 문자 분리 모듈은 입력된 단어 영상을 하나의 문자보다 더 작은 이미지 조각으로 과다 분리하며 , 조합 행렬 생성모듈에서는 동적 프로그래밍 기법을 이용하여 분리된 이미지 조각들로부터 사전상의 모든 단어들과 대응되는 가능한 모든 조합을 생성한다. 문자인식모듈은 각 그룹에 대하여 일괄적으로 얻어진 특징과 유니그램을 이용하여 문자인식을 수행한다. 마지막으로 사전 후처리 모듈에서는 각 그룹에 대한 문자인식 결과와 단어 사전을 사용하여 입력단어에 대한 최종 인식 결과를 도출한다. 본 문에서 제안한 방법은 문자 분리, 문자 인식 및 후처리를 상호 보완적으로 결합함으로써 한글이 포함된 무제약 필기 문자열을 효과적으로 인식할 수 있다. 제안된 시스템의 성능을 평가하기 위하여 실제 우편 봉투 상에 쓰여진 필기 한글 단어 200개를 대상으로 실험을 하였다. 실험 결과 200개의 단어중 172개의 단어를 정인식하여 86%의 정확도를 얻을 수 있었으며 나머지 28개의 오인식된 단어들을 분석한 결과 대부분의 오류는 문자 인식기의 낮은 신뢰도 때문임을 알 수 있었다. 또한, 하나의 단어를 인식하기 위하여 약 2초가 소요되었다.

필기체 한글 문자 인식을 위한 획 추출에 관한 연구 (A Study on Stroke Extraction for Handwritten Korean Character Recognition)

  • 최영규;이상범
    • 정보처리학회논문지B
    • /
    • 제9B권3호
    • /
    • pp.375-382
    • /
    • 2002
  • 필기체 문자 인식은 온라인 필기체 문자 인식과 오프라인 필기체 문자 인식으로 나누어진다. 온라인 필기체 문자 인식은 타블렛과 같은 펜 기반의 전자식 입력 장치를 이용하여 필기의 순서와 획의 위치와 같은 동적인 필기 정보를 문자의 입력 시 획득할 수 있어 오프라인 필기체 문자 인식에 비해 큰 연구 성과를 이루었다. 그러나 오프라인 필기체 문자 인식은 온라인 필기체 문자 인식에서와 같이 동적인 정보를 입력받을 수 없고, 다양한 필기와 자소의 겹침이 심하며 획 사이의 잡영을 많이 가지고 있어 인식의 전처리 결과에 따라 인식 성능이 크게 달라진다. 본 논문에서는 오프라인 필기체 한글 문자 인식을 위해 문자의 동적인 정보를 포함하는 획을 효과적으로 추출하는 방법을 제안한다. 제안된 방법은 전처리 과정으로 먼저 Watershed 알고리즘을 이용하여 입력된 필기체 문자 영상의 향상 및 이진화를 수행한다. 이진화된 문자부를 변형된 Lu와 Wang의 세선화 알고리즘을 사용하여 세선화를 수행한 후 문자에서의 특징점을 추출하여 세그먼트 화소열을 추출하고, 최대 허용 오차법을 이용하여 벡터화한다. 벡터화의 수행으로 몇 개의 획이 하나의 세그먼트로 묶인 경우, 하나의 세그먼트 화소열은 2 또는 그 이상의 세그먼트 벡터로 분리된다. 추출된 세그먼트 벡터들을 완전한 획으로 재구성하기 위해서 오른손 필기 좌표계 시스템을 이용하여 벡터의 방향적인 성분을 인간의 필기 획의 방향에 알맞게 수정하고, 수정된 세그먼트 벡터의 방향성과 분기 정보를 이용하여 인접한 결합 가능한 세그먼트 벡터를 결합함으로써 문자 인식에 적합한 완전한 획으로 재구성한다. 실험 결과 제안된 방법이 필기체 한글 문자 인식에 적합함을 알 수 있었다.

한글필기체의 구조적 특징을 이용한 효율적 기울기 보정 (An Efficient Slant Correction for Handwritten Hangul Strings using Structural Properties)

  • 유대근;김경환
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제30권1_2호
    • /
    • pp.93-102
    • /
    • 2003
  • 본 논문에서는 한글의 구조적 특징이 반영된 획들의 통계적인 분포에 근거한 필기 문자열의 기울기 보정 방법을 제안한다. 기존의 기울기 보정 방법들은 대부분 영문위주의 보정 방법으로, 영문과 달리 2차원적 구조를 갖는 한글에 적용하는데는 많은 문제가 있다. 일반적인 보정 방법을 적용할 경우 한글에 내재하는 강한 대각선획의 영향으로 인한 역보정의 문제가 가장 많이 나타나며. 기울어진 문자열을 제대로 보정하지 못하는 경우도 빈번하다. 제안하는 방법에서는 추출된 획들의 기울기 분포를 K-평균 군집법을 적용하여 수직획과 대각선획의 두 개의 군집으로 분류하고, 가우시안 분포로의 모델링을 통해 대각선획을 제외하고 수직획만을 이용하여 기울기 보정을 수행하였다. 임의의 필기자에 의해 필기된 우편봉투 주소 문자열 1,300개에 대해 제안하는 방법과 기존의 방법들을 적용하여 실험한 결과 제안하는 방법이 기존방법들에 비해 역보정률을 크게 낮추고, 기울어진 문자열에 대해 완벽한 보정 성능을 보여 그 우수성이 입증되었다.

Substroke HMM 기반 온라인 필기체 문자인식 (On-line Handwriting Recognition Based on Substroke HMM)

  • 김춘영;석수영;정호열;정현열
    • 융합신호처리학회 학술대회논문집
    • /
    • 한국신호처리시스템학회 2003년도 하계학술대회 논문집
    • /
    • pp.74-77
    • /
    • 2003
  • 본 논문에서는 자연스러운 온라인 필기체 문자 인식을 위하여 획 기반 HMM(Substroke HMM)을 기반으로 한 인식 방법을 채택하고, 획 분류의 정확도 향상을 위한 전처리 과정에 대해 재샘플링 간격 조정을 통한 획 분류실험을 통해 인식률 제고에 관한 실험을 수행하였다 필기체 문자인식을 위한 방법으로 한 문자 전체를 HMM으로 구성하는 Whole-character HMM과 자소단위를 HMM으로 구성하는 character HMM을 주로 이용하였으나, 이러한 방법은 문자의 수에 비례하여 비교적 큰 메모리 용량과 계산량이 요구되는 단점이 있다. 이러한 단점을 개선하기 위한 획 기반 HMM은 문자를 획 단위로 분류한 후 이를 HMM 모델로 구성하므로 소수의 획 기반 HMM 모델만으로 문자를 모두 표현할 수 있는 장점을 가지고 있어, 인식률의 큰 저하 없이 계산량 및 메모리 용량을 크게 줄일 수 있다. PDA상에서 수집한 완성형 한글 데이터베이스를 사용하여 획 분류 실험을 수행한 결과 평활화와 7/100 길이의 재샘플링을 수행한 경우 평활화 과정을 추가하지 않은 기존의 재샘플링 5/100 길이의 경우에 비해 정확도가 평균 3.7% 향상을 나타내었으며, 특히 첨가 에러율이 감소함을 확인할 수 있다.

  • PDF

필기문자열의 품질평가를 통한 언어학습시스템 (Language Learning System Evaluating the Quality of a Handwriting String)

  • 김계영
    • 정보처리학회논문지D
    • /
    • 제12D권1호
    • /
    • pp.159-164
    • /
    • 2005
  • 본 논문에서는 전자펜과 그 인터페이스를 장착한 정보통신장치와 서버가 인터넷으로 연결된 환경에서 패턴인식 기술을 사용하여 글씨의 품질을 향상시키는 훈련을 수행한 수 있는 언어학습시스템을 제안한다. 본 논문에서는 참조자료를 획득하는 방법 및 전역특징과 지역특징을 통한 글씨품질을 평가하는 방법에 관하여 기술한다. 제안하는 시스템은 문자 뿐 아니라 문자열에 대해서도 글씨품질을 평가할 수 있으며, 제시어와 입력어가 같은 경우 뿐 아니라 다른 경우에도 글씨품질을 평가한 수 있는 특징을 가진다. 따라서 제안하는 시스템은 글씨연습 뿐 아니라 언어 훈련에 매우 유용한 것으로 기대된다.

서장 우편물 자동처리를 위한 우편영상 인식 시스템 (Postal Envelope Image Recognition System for Postal Automation)

  • 김호연;임길택;김두식;남윤석
    • 정보처리학회논문지B
    • /
    • 제10B권4호
    • /
    • pp.429-442
    • /
    • 2003
  • 본 논문에서는 우편물 자동처리론 위한 우편영상 인식 시스템을 소개한다. 우편영상 인식 시스템은 서장 우편물을 집배원이 배달하는 순서에 따라 자동으로 구분할 수 있도록 우편영상을 입력으로 받아 수신인 주소를 출력하는 인식 시스템을 말한다. 이 시스템은 수신인 주소영역 추출, 문자열 분리, 문자분할, 문자인식, 그리고 주소해석 모듈로 구성되어 있다. 주소영역 추출을 위해서는 우편물 주소 기입 위치에 대한 경험적 지식을 이용하였으며, 문자열 분리와 문자분한을 위해서는 연결요소 분석과 수직런 분석을 이용하였다. 문자인식에는 신경망 기반 인식기를 이용하였으며, 주소해석을 위해서는 동적 프로그래밍 기법을 적용하였다. 각 모듈은 독립적으로 구현되었기 때문에 인식 시스템의 성능 개선을 위한 모듈별 최적화가 용이하다는 장점이 있다. 실험에는 대전 유성우체국의 우편물 구분기를 이용하여 실제 우편물에서 수집한 인쇄 우편영상과 필기 우편영상을 이용하였으며, 비교적 우수한 인식 결과를 얻었다.

규칙 정보를 이용한 은행 전표 상의 필기 한글 금액 인식 (Handwritten Korean Amounts Recognition in Bank Slips using Rule Information)

  • 지태창;이현진;김은진;이일병
    • 한국정보처리학회논문지
    • /
    • 제7권8호
    • /
    • pp.2400-2410
    • /
    • 2000
  • 한글 인식에 관한 기존의 연구는 한글 낱자 인식에 치우쳐 왔고, 실제 문서 인식 시스템 개발을 위한 연구는 거의 이루어지지 않았다. 그래서, 본 논문에서는 인식된 문자열의 오류 교정에 관한 연구로서 한글 금액열 인식기를 개발하였다. 한글 낱자 인식에서 문제가 되는 부분은 데이터의 방대함 때문에 발생한다. 컴퓨터상에서 표현될 수 있는 한글 낱자의 개수는 2000여 자 이상이다. 따라서, 기존의 연구들은 이러한 문제점을 해결하기 위해서 실생활에서 많이 쓰이는 낱자에 대해서만 실험을 했다. 하지만, 실험 대상 낱자의 개수를 1000여 자 정도로 줄였어도, 여전히 80%대 이하의 저조한 인식률을 보이고 있다. 이렇게 인식률이 저조한 범용 한글 낱자 인식기를 한글 금액 인식이라는 제한된 상황에서 사용하는 것은 적합하지 않다. 따라서, 본 연구에서는 한글 금액에 사용되는 16자의 한글 낱자만 인식할 수 있는 인식기를 제안하였다. 제안한 한글 낱자 인식기는 통계적 인식기를 사용한 다중 인식기 형태로 만들었고, 이를 통해 개별적인 특징으로 인한 인식률의 저하를 방지할 수 있다. 금액의 후처리는 한글 금액열 내에 내재되어 있는 금액에 대한 구조적인 규칙 정보를 이용하였다. 이 규칙을 이용하여 한글 금액의 후처리는 한글 금액열 내에 내재되어 있는 금액애 대한 구조적인 규칙 정보를 이용하였다. 이규칙을 이용하여 한글 금액의 인식 단위에 대한 인식 결과의 오류 보정을 할 수 있다. 실험 결과 제안한 한글 낱자 인식기의 1후보까지 인식률은 95.49%였고, 4후보까지 인식률은 99.72%였다. 그리고, 후처리기의 처리를 거친 금액열에 대해서는 신뢰도가 96.42%였다. 본 논문에서는 사용된 낱자의 개수가 적고, 구조안에 규칙 정보가 존재하는 한글 문자열의 경우에 제한된 글자를 인식하는 낱자 인식기와 오류를 교정할 수 있는 후처리기로 문자열 인식의 신뢰도를 향상시킬수 있는 방법을 제안하였다.

  • PDF