• 제목/요약/키워드: Handwritten string processing

검색결과 2건 처리시간 0.02초

한글필기체의 구조적 특징을 이용한 효율적 기울기 보정 (An Efficient Slant Correction for Handwritten Hangul Strings using Structural Properties)

  • 유대근;김경환
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제30권1_2호
    • /
    • pp.93-102
    • /
    • 2003
  • 본 논문에서는 한글의 구조적 특징이 반영된 획들의 통계적인 분포에 근거한 필기 문자열의 기울기 보정 방법을 제안한다. 기존의 기울기 보정 방법들은 대부분 영문위주의 보정 방법으로, 영문과 달리 2차원적 구조를 갖는 한글에 적용하는데는 많은 문제가 있다. 일반적인 보정 방법을 적용할 경우 한글에 내재하는 강한 대각선획의 영향으로 인한 역보정의 문제가 가장 많이 나타나며. 기울어진 문자열을 제대로 보정하지 못하는 경우도 빈번하다. 제안하는 방법에서는 추출된 획들의 기울기 분포를 K-평균 군집법을 적용하여 수직획과 대각선획의 두 개의 군집으로 분류하고, 가우시안 분포로의 모델링을 통해 대각선획을 제외하고 수직획만을 이용하여 기울기 보정을 수행하였다. 임의의 필기자에 의해 필기된 우편봉투 주소 문자열 1,300개에 대해 제안하는 방법과 기존의 방법들을 적용하여 실험한 결과 제안하는 방법이 기존방법들에 비해 역보정률을 크게 낮추고, 기울어진 문자열에 대해 완벽한 보정 성능을 보여 그 우수성이 입증되었다.

규칙 정보를 이용한 은행 전표 상의 필기 한글 금액 인식 (Handwritten Korean Amounts Recognition in Bank Slips using Rule Information)

  • 지태창;이현진;김은진;이일병
    • 한국정보처리학회논문지
    • /
    • 제7권8호
    • /
    • pp.2400-2410
    • /
    • 2000
  • 한글 인식에 관한 기존의 연구는 한글 낱자 인식에 치우쳐 왔고, 실제 문서 인식 시스템 개발을 위한 연구는 거의 이루어지지 않았다. 그래서, 본 논문에서는 인식된 문자열의 오류 교정에 관한 연구로서 한글 금액열 인식기를 개발하였다. 한글 낱자 인식에서 문제가 되는 부분은 데이터의 방대함 때문에 발생한다. 컴퓨터상에서 표현될 수 있는 한글 낱자의 개수는 2000여 자 이상이다. 따라서, 기존의 연구들은 이러한 문제점을 해결하기 위해서 실생활에서 많이 쓰이는 낱자에 대해서만 실험을 했다. 하지만, 실험 대상 낱자의 개수를 1000여 자 정도로 줄였어도, 여전히 80%대 이하의 저조한 인식률을 보이고 있다. 이렇게 인식률이 저조한 범용 한글 낱자 인식기를 한글 금액 인식이라는 제한된 상황에서 사용하는 것은 적합하지 않다. 따라서, 본 연구에서는 한글 금액에 사용되는 16자의 한글 낱자만 인식할 수 있는 인식기를 제안하였다. 제안한 한글 낱자 인식기는 통계적 인식기를 사용한 다중 인식기 형태로 만들었고, 이를 통해 개별적인 특징으로 인한 인식률의 저하를 방지할 수 있다. 금액의 후처리는 한글 금액열 내에 내재되어 있는 금액에 대한 구조적인 규칙 정보를 이용하였다. 이 규칙을 이용하여 한글 금액의 후처리는 한글 금액열 내에 내재되어 있는 금액애 대한 구조적인 규칙 정보를 이용하였다. 이규칙을 이용하여 한글 금액의 인식 단위에 대한 인식 결과의 오류 보정을 할 수 있다. 실험 결과 제안한 한글 낱자 인식기의 1후보까지 인식률은 95.49%였고, 4후보까지 인식률은 99.72%였다. 그리고, 후처리기의 처리를 거친 금액열에 대해서는 신뢰도가 96.42%였다. 본 논문에서는 사용된 낱자의 개수가 적고, 구조안에 규칙 정보가 존재하는 한글 문자열의 경우에 제한된 글자를 인식하는 낱자 인식기와 오류를 교정할 수 있는 후처리기로 문자열 인식의 신뢰도를 향상시킬수 있는 방법을 제안하였다.

  • PDF