• 제목/요약/키워드: 문자특징 추출

검색결과 252건 처리시간 0.027초

과다 분리 및 사전 후처리 기법을 이용한 한글이 포함된 무제약 필기 문자열의 오프라인 인식 (Off-Line Recognition of Unconstrained Handwritten Korean Words using Over-Segementation and Lexicon Driven Post-Processing Techniques)

  • 정선화;김수형
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제26권5호
    • /
    • pp.647-656
    • /
    • 1999
  • 본 논문에서는 오프라인 무제약 필기 한글 단어를 인식하기 위한 시스템을 제안한다. 제안된 단어 인식 시스템은 크게 다석가지 모듈-문자 분리,조합행렬생성, 특징 추출, 문자인식, 사전 후처리 -로 구성되어 있다. 문자 분리 모듈은 입력된 단어 영상을 하나의 문자보다 더 작은 이미지 조각으로 과다 분리하며 , 조합 행렬 생성모듈에서는 동적 프로그래밍 기법을 이용하여 분리된 이미지 조각들로부터 사전상의 모든 단어들과 대응되는 가능한 모든 조합을 생성한다. 문자인식모듈은 각 그룹에 대하여 일괄적으로 얻어진 특징과 유니그램을 이용하여 문자인식을 수행한다. 마지막으로 사전 후처리 모듈에서는 각 그룹에 대한 문자인식 결과와 단어 사전을 사용하여 입력단어에 대한 최종 인식 결과를 도출한다. 본 문에서 제안한 방법은 문자 분리, 문자 인식 및 후처리를 상호 보완적으로 결합함으로써 한글이 포함된 무제약 필기 문자열을 효과적으로 인식할 수 있다. 제안된 시스템의 성능을 평가하기 위하여 실제 우편 봉투 상에 쓰여진 필기 한글 단어 200개를 대상으로 실험을 하였다. 실험 결과 200개의 단어중 172개의 단어를 정인식하여 86%의 정확도를 얻을 수 있었으며 나머지 28개의 오인식된 단어들을 분석한 결과 대부분의 오류는 문자 인식기의 낮은 신뢰도 때문임을 알 수 있었다. 또한, 하나의 단어를 인식하기 위하여 약 2초가 소요되었다.

한글문자 인식에 관한 연구(II)(한글자모의 인식 Code와 display) (Recognition of Printed Korean Characters(II))

  • 이주근
    • 대한전자공학회논문지
    • /
    • 제7권3호
    • /
    • pp.5-11
    • /
    • 1970
  • 이 연구는 연구(I)의 계속연구로서 한글자음과 모음의 특징추출에 의한 coding방법과 그의 display에 대해서 검토하였다. 문자를 3x5mesh의 Matrix로서 양자화해서 그의 특징을 변수로한 2단 matrix에 의하여 문자 pattern을 발생하고, 또 발생된 특징 pattern을 다시 논리집합하여 단일 Serial coding 방법을 제시하였다. 이 code는 한글 자모의 원문자가 재생되며, 모든 자모는 각각 15개의 흑백 bit로서 구성된다. 24개 한글자음과 모음에 대해서 coding하였으며, 이론치와 측정치가 잘 일치함을 보았고 그것이 또한 완전히 재현됨을 이 연구에서 알맞게 설계된 display로서 확인하였다.

  • PDF

칼라 정보와 N4M 특징 매칭을 이용한 차량 번호판 자동 인식에 관한 연구 (A Study on the Automatic Recognition of a Car License Plate Using The color Information and N4M Feature Matching)

  • 이종은;이윤형;김재석;정기봉;오무송
    • 한국멀티미디어학회:학술대회논문집
    • /
    • 한국멀티미디어학회 2000년도 추계학술발표논문집
    • /
    • pp.151-154
    • /
    • 2000
  • 차량 번호판 영상을 안정적으로 추출하여 인식하는 방법에는 여러 가지 땅법들이 제시되어 왔다. 기존의 연구들은 번호판 영역 추출에는 높은 성공률을 보이고 있으나 상대적으로 문자 인식의 성공률이 그에 미치지 못해서 전체적인 인식 성공률에 저하를 가져오는 경우가 대부분 이었다. 따라서 본 연구에서는 칼라 정보를 이용하여 입력 영상의 밝기 보정과 번호판 영역을 추출하고 N4M (Normalized 4 - Mash)을 적용하여 문자인식 처리 시간을 단축시키고 인식글을 향상시킬 수 있었다.

  • PDF

비디오 영상 정보 검색을 위한 문자 추출 및 인식 (Caption Detection and Recognition for Video Image Information Retrieval)

  • 구건서
    • 한국컴퓨터산업학회논문지
    • /
    • 제3권7호
    • /
    • pp.901-914
    • /
    • 2002
  • 본 논문에서는 비디오에서 입력된 영상으로부터 내용기반 검색을 위해 자동으로 자막을 추출하여 특징 추출을 기반의 단층 연결 신경망 인식기(FE-MCBP)에 의해 자막 문자를 인식하여 영상 자막의 내용을 검출하는 방법을 제시하였다. 비디오에서 자막 추출은 먼저, 비디오에서 일정한 시간 간격으로 획득한 프레임 중에서 히스토그램 분석을 통하여 키 프레임을 찾는 과정을 수행하며, 그 다음에 각각의 키 프레임에 대하여 칼라 세그먼테이션 후 라인 검사 방법 통하여 자막 영역을 추출하도록 하였다. 마지막으로 추출된 자막영역에서 개별문자를 분리하였다. 본 연구에서는 칼라 히스토그램을 분석 후 지역 최대값을 이용하여 세그먼테이션 후 라인 검사를 수행함으로써 처리 속도와 자막영역 검출의 정확도를 개선하였다. 비디오에서 자막 추출은 비디오 정보를 멀티미디어 데이터베이스화하는 초기 단계로 추출된 자막은 바로 문자 인식기의 입력이 된다. 또한 인식된 자막정보는 데이터베이스로 구축되며 내용기반 검색 기법에 의해 검색되도록 하였다.

  • PDF

자소 접촉특성 분석에 의한 한글패턴의 부분분리 및 인식 (Separation of Subpatern and Recognition of Hanguel Patterns by Analysis of Feature of Contacting Phonemes)

  • 고찬;진용옥
    • 한국통신학회논문지
    • /
    • 제15권7호
    • /
    • pp.618-627
    • /
    • 1990
  • 본 논문은 한글문자 인식을 위하여 새로운 접촉소자의 분리 및 자획연결 특징추출 알고리즘을 제안하였다. 자소 접촉특징을 분석하여 자소접촉 형태별로 분류하고 자획연결특징 추출, 접촉자소의 분리, 문자형식 분류를 시행한다. 분리된 자소로부터 설정된 표준패턴으로 정규화하고 자소별 굴곡특징의 상대위치값으로 부터의 특징을 입력패턴으로 신경망을 이용하여 인식 실험을 하였다. 여기에서의 학습은 BEP 알고리즘을 이용하였다. 접촉자소의 분리, 형식분리, 자획연결특징 추출 및 인식 실험에서 제안된 알고리즘이 좋은 결과를 나타내었다.

  • PDF

동적자소분할과 신경망을 이용한 인쇄체 한글 문자인식기에 관한 연구 (A Study on Printed Hangeul Recognition with Dynamic Jaso Segmentation and Neural Network)

  • 이판호;장희돈;남궁재찬
    • 한국통신학회논문지
    • /
    • 제19권11호
    • /
    • pp.2133-2146
    • /
    • 1994
  • 본 논문에서는 한글의 동적자소분할 방법과 자소분할 결과 얻어진 가변분할 망눈으로부터 특징벡터를 추출해 신경망에 입력함으로써 문자를 인식하는 방법을 제안한다. 먼저, 각 문자에서 4방향 기여도와 $8\pm8$망눈을 사용하여 256차원의 특징벡터를 구한 후, 신경망에 의해 한글을 6형식으로 분류한다. 분류된 결과를 바탕으로 모음의 통계적인 위치정보와 문자의 구조적인 정보를 이용하여 각 문자를 자소 단위로 분할한다. 분할된 자소의 크기에 따라 가변적인 크기를 갖는 망눈을 구성하고 특징벡터를 추출해 자소인식 신경망에 입력함으로써 문자인식을 행한다. 4개의 서체(3개의 서체는 학습, 1개는 인식실험), KS C 5601내의 2350자의 문자를 대상으로 실험한 결과 학습에 사용된 서체에 대해서는 97%이상, 나머지 한 서체에 대해서는 94% 이상의 인식률을 나타내 제안된 방법의 유효성을 보였다.

  • PDF

연역적이고 국부적인 영문자의 폰트 분류법 ($\emph{A Priori}$ and the Local Font Classification)

  • 정민철
    • 한국산학기술학회논문지
    • /
    • 제3권4호
    • /
    • pp.245-250
    • /
    • 2002
  • 본 연구에서는 영문 단어로부터 폰트를 분류하기 위해 연역적이고 국부적인 폰트 분류 방법을 제안한다. 이는 문자 인식 전에 한 단어의 폰트를 분류하는 것을 말한다. 폰트 분류를 위해 활자 특성인 Ascender, Descender와 Serif가 사용된다. 입력 단어로부터 Ascender, Descender 와 Serif가 추출되어 경사도 특징 벡터가 추출되고, 그 특징 벡터는 인공 신경망에 의해 입력 단어에 대한 폰트 스타일, 폰트 그룹, 폰트 이름이 분류된다. 제안된 연역적이고 국부적인 폰트 분류 방법은 폰트 정보가 문자 분할기와 문자 인식기에 사용될 수 있게 한다. 나아가, 특정 폰트에 따른 Mono-Font 문자 분할기와 Mono-Font 문자 인식기로 구성되는 OCR 시스템을 구성할 수 있는 것을 가능하게 한다.

  • PDF

인간의 정보처리 방법에 기반한 특징추출 및 필기체 문자인식에의 응용 (Feature extraction motivated by human information processing method and application to handwritter character recognition)

  • 윤성수;변혜란;이일병
    • 인지과학
    • /
    • 제9권1호
    • /
    • pp.1-11
    • /
    • 1998
  • 본 논문에서는 인간의 정보처리 과정에 관한 심리학적 실험에 바탕을 두고 인간이 사용하고 있는 것으로 생각되는 특징을 이용하여 이를 문자 인식에 적용하였다. 인간의 경우 화소단위의 정보뿐만 아니라 일정지역의 정보를 함께 처리하는 경향이 있다. 그러므로 일정지역에 대한 정보를 표시하는 영역 특징을 정의하고 정의된 이 영역 특징과 기존의 화소단위 특징들을 결합하였다. 사용한 특징으로는 영역 특징에 기반 한 초등 적 분석결과, 영역특징을 포함한 망 특징, 교차거리와 특징 그리고 기울기 특징들이다. 성능 평가 실험은 필기 한글자모, 숫자 그리고 대소영문자를 대상으로 하였으며, 인식기는 역전과 학습 방법을 이용한 신경망 인식기를 사용하였다. 각각의 인식 결과는 90.27∼93.25%, 98.00% 그리고 79.73∼85.75였다. 영역 특징과 유사한 UDLRH 특징을 대상으로 비교한 결과 전체적으로 1∼2% 정도 인식률 향상이 있었으며 인간이 판단하기에 보다 납득하기 쉬운 오 인식 성향을 보였다.

  • PDF

다중 인식기 및 검증기를 갖는 거버문자 인식 시스템 (A Gerber-Character Recognition System with Multiple Recognizers and a Verifier)

  • 오혜원;박태형
    • 한국지능시스템학회논문지
    • /
    • 제14권1호
    • /
    • pp.20-27
    • /
    • 2004
  • 인쇄회로기판 제작에 사용되는 국제표준규격의 거버 파일로부터 부품 위치 이름을 자동으로 추출하기 위한 문자인식 시스템을 제안한다. 거버 파일은 벡터형식의 그림파일로서, 각종도형 및 기호가 문자와 혼합되어 있으며, 가로쓰기와 세로쓰기 및 역 세로쓰기가 병용된다. 거버문자인식 시스템은 거버 파일에서 문자패턴을 추출하여 분리하는 전 처리 단계와 추출된 패턴을 인식하는 인식단계 및 인식된 문자와 숫자를 조합하여 부품위치이름을 구성하는 후 처리단계로 구성된다. 특히 인식률 향상을 위하여 신경회로망에 의한 다중인식기 및 구조적 특징을 이용한 검증기를 개발한다. 본 논문에서 개발된 거버문자 인식시스템은 인쇄회로기판 조립 및 검사 장비를 위한 자동 프로그래밍 시스템에 사용되어, 전자제품 제조시스템의 생산성 향상에 기여할 수 있다.

불규칙 조명 환경에 강인한 번호판 문자 분리 기법 (Robust Scheme of Segmenting Characters of License Plate on Irregular Illumination Condition)

  • 김병현;한영준;한헌수
    • 한국컴퓨터정보학회논문지
    • /
    • 제14권11호
    • /
    • pp.61-71
    • /
    • 2009
  • 자동차의 번호판은 차량의 등록 정보를 확인할 수 있는 유일한 방법이다. 불법 주정차 단속 및 주차 관리 시스템에 차량의 등록 정보를 확인하기 위해 카메라를 이용한 무인 인식시스템의 개발이 활발히 연구되고 있다. 하지만, 일반 도로상에서 날씨나 주변 장애물들은 자동차 번호판 상에 조명 변화를 일으켜 번호판 문자의 추출을 어렵게 한다. 본 논문은 번호판 영상을 개선하여 조명변화에 강인한 문자 추출 알고리즘을 제안한다. 제안하는 기법은 번호판 영상의 명암 대비도를 높이기 위해 Chi-Square 확률 밀도 함수를 이용한다. 또한, 정확한 문자영역을 추출하기 위해, 적응적인 문턱값을 적용함으로써 고품질의 이진화 영상을 얻는다. 번호판의 문자들을 추출하는 일련의 과정에서 방해가 되는 잡음들을 전처리와 레이블링을 통해 제거한다. 마지막으로 번호판의 문자들은 번호판의 기하학적 특징을 이용한 이진화 영상의 프로파일링으로부터 추출된다.