• 제목/요약/키워드: 문서 영상

검색결과 381건 처리시간 0.027초

카메라 문서 영상의 이진화 및 기울어짐 보정 방법 (A Method for Thresholding and Correction of Skew in Camera Document Images)

  • 장대근;전병태
    • 한국컴퓨터정보학회논문지
    • /
    • 제10권3호
    • /
    • pp.143-150
    • /
    • 2005
  • 카메라 영상은 조명에 매우 민감하다. 그 결과 문자 인식을 매우 어렵게 만든다. 또한 카메라로 획득한 문서 영상을 대상으로 문자인식을 수행할 경우 비네팅현상이 발생하며 카메라와 피사체간의 위치와 각도의 불일치에 의해 기학적 왜곡이 발생한다. 비네팅 효과에 의한 문자분리의 어려움과 기하학적 왜곡으로 인한 문자모양의 변형으로 인해 실제로 사용이 가능한 카메라 문자인식 기술의 개발이 쉽지 않았다. 본 논문에서는 양선형 변환을 이용하여 카메라로 획득한 문서영상의 기하학적 왜곡을 보정함으로써 문자인식 성능을 향상시킬 수 있는 방법을 제안한다. 기존에는 카메라의 위치정보 없이 기하하적 왜곡을 보정하기 어려웠으나 제안한 방법은 이진화한 문서영상을 대상으로 문자와 문자줄을 추출하여 상하로는 문자줄의 배열방향을, 좌우로는 문자획의 기울어진 각도를 측정함으로써 문서영상 자체만으로 기하하적 왜곡보정이 가능하다.

  • PDF

문서 영상 내 테이블 영역에서의 단어 추출 (Word Extraction from Table Regions in Document Images)

  • 정창부;김수형
    • 정보처리학회논문지B
    • /
    • 제12B권4호
    • /
    • pp.369-378
    • /
    • 2005
  • 문서 영상은 문서 구조 분석을 통하여 텍스트, 그림, 테이블 등의 세부 영역으로 분할 및 분류되는데, 테이블 영역에 있는 단어는 다른 영역의 단어보다 의미가 있기 때문에 주제어 검색과 같은 응용 분야에서 중요한 역할을 한다. 본 논문에서는 문서 영상의 테이블 영역에 존재하는 문자 성분을 단어단위로 추출하는 방법을 제안한다. 테이블 영역에서의 단어 추출은 실질적으로 테이블을 구성하는 셀 영역에서 단어를 추출하는 것이기 때문에 정확한 셀 추출 과정이 필요하다. 셀 추출은 연결 요소를 분석하여 테이블 프레임을 찾아내고, 교차점 검출은 전체가 아닌 테이블 프레임에 대해서만 수행한다. 잘못 검출된 교차점은 이웃하는 교차점과의 관계를 이용하여 수정하고, 최종 교차점 정보를 이용하여 셀을 추출한다. 추출된 셀 내부에 있는 텍스트 영역은 셀 추출 과정에서 분석한 문자성분의 연결 요소 정보를 재사용하여 결정하고, 결정된 텍스트 영역은 투영 프로파일을 분석하여 문자연로 분리된다. 마지막으로 분리된 문자열에 대하여 갭 군집화와 특수 기호 검출을 수행함으로써 단어 분리를 수행한다. 제안 방법의 성능 평가를 위하여 한글 논문 영상으로부터 추출한 총 In개의 테이블 영상에 대해 실험한 결과, $99.16\%$의 단어 추출 성공률을 얻을 수 있었다.

한글 문서 영상의 단어 검색 시스템 (A Kerword Spotting System of Korean Document Images)

  • 최윤성;오일석
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 가을 학술발표논문집 Vol.29 No.2 (2)
    • /
    • pp.586-588
    • /
    • 2002
  • 본 논문은 한글 문서 영상의 단어 검색 시스템과 그 성능을 제시한다. 두 단계 검색 방법은 검색 속도 증가를 목적으로 하며, 첫 번째 단계에서는 매우 빠른 속도로 거친 정합을 통하여 후보 단어들을 추출한다. 두 번째 단계는 후보 단어들 중에서 미세한 정합을 통한 단어 검색이 이루어진다. 시스템은 문서 영상 구조 분석 모듈과 단어 검색 모듈로 구성된다. 실험 자료를 통해 시스템의 유용성을 입증한다.

  • PDF

이진 대역분할과 Zerotree 기반 산술부호기를 이용한 문서 영상 압축 (Document Image Compression Using Binary Subband Analysis and Zerotree-based Arithmetic Coder)

  • 김정권;김승환;이충웅
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송공학회 1999년도 KOBA 방송기술 워크샵
    • /
    • pp.45-50
    • /
    • 1999
  • 이진 영상의 압축은 디지털 도서관, 팩시밀리 전송, 문서 입출력 시스템과 같이 한정된 대역폭과 저장 공간을 가진 응용 분야에서 절실히 요구되고 있다. 현재 많은 영상 압축 알고리즘이 채택하고 있는 대역분할 기법을 문서와 같은 이진 영상의 압축에 적용한다면, 점진적 전송, 축소영상을 통한 빠른 검색 등의 장점을 얻을 수 있다. 그러나, 이진 영상 신호가 두 단계의 휘도 값을 가지므로, 이에 적합한 대역분할 방법과 산술부호기를 선택하여야 한다. 본 논문에서는 표본화-XOR 대역분할 기법을 선택하여, 알파벳 수의 증가를 막고 공간영역에서 국부적인 성질을 얻을 수 있다 또한, 넓은 단일-색 영역을 Zerotree로 대표하여 부호화 되는 신호의 수를 줄이고, 대역분할 구조에서 예측성의 저하를 막기 위한 적절한 조건화문맥과 새로운 부호를 선택한다. 이진 영상에 적합한 대역분할 방법과 산술부호기를 선택하여, 대역분할의 장점과 우수한 압축 성능을 달성할 수 있다.

  • PDF

조응구조의 지시사상 (mapping) 이론

  • 박영규
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1990년도 제2회 한글 및 한국어정보처리 학술대회
    • /
    • pp.199-199
    • /
    • 1990
  • 입력된 문서 영상으로부터 분리 추출된 문자 영상을 올바르게 인식하는 것은 문서 인식에서 가장 핵심적인 부분이다. 스캐너를 통해 입력되고 분리된 실제의 문자 영상은 많은 문제점들을 가지고 있다. 한글의 경우 이 중 개별 문자 영상내의 각 자소간의 접촉은 올바른 인식을 저해하는 주요한 원인이다. 이런 접촉의 문제를 효율적으로 해결하기 위해 한글의 구조적 특성을 지닌 "방향 필터"를 정의하고, 이것을 이용하여 세선화된 문자 영상을 추적하면서 선소들을 뽑아낸다. 이렇게 하여 얻은 선소들과 선소들간의 지식을 조합하여 한글자소 획을 추출케 되고 결국에는 이런 획의 조합을 통해 문자 영상을 인식하는 방법을 제안한다.

  • PDF

지역적 엔트로피와 텍스처의 주성분 분석을 이용한 문서영상의 분할 및 구성요소 분류 (Segmentation and Contents Classification of Document Images Using Local Entropy and Texture-based PCA Algorithm)

  • 김보람;오준택;김욱현
    • 정보처리학회논문지B
    • /
    • 제16B권5호
    • /
    • pp.377-384
    • /
    • 2009
  • 본 논문은 지역적 엔트로피 기반의 히스토그램을 이용한 문서영상의 분할과 텍스처 기반의 주성분 분석을 이용한 구성요소인 글자, 그림, 그래프 등의 구성요소 분류방안을 제안한다. 지역적 엔트로피와 히스토그램을 이용함으로써 문서영상의 다양한 변형이나 잡음에 강건하며 빠르고 손쉬운 이진화가 가능하다. 그리고 문서영상 내 존재하는 구성요소들이 각기 다른 텍스처 정보를 가지고 있다는 것에 착안하여 각 분할 영역의 텍스처 정보를 기반으로 주성분분석을 수행하였으며 이를 통해 사전에 구성요소들에 대한 구조정보를 설정할 필요가 없다는 장점을 가진다. 실험결과에서 다양한 문서영상의 분할 및 분류결과를 보였으며, 기존 방법보다 우수한 성능을 가져 그 유효함을 보였다.

청소년을 위한 유해 웹영상 차단시스템의 구현 (Implementation of An Inappropriate Web-I mages Blocking System for Youth)

  • 이은애;정명숙;김재건;하석운
    • 한국멀티미디어학회:학술대회논문집
    • /
    • 한국멀티미디어학회 2000년도 춘계학술발표논문집
    • /
    • pp.319-323
    • /
    • 2000
  • 인터넷이 활성화되면서 청소년에게 유해한 영상을 제공하는 사이트들이 급속히 범람하고 있으며, 이로 인해 청소년들의 정신 건강이 심각하게 훼손되고 있다. 본 논문에서는 청소년들이 접근하기 쉬운 유해 URL 의 웹문서에 대해 그 문서 내에 포함되어 있는 영상들의 유해성을 판별하여 유해 영상을 선택적으로 차단할 수 있는 시스템을 구현하여 제시한다. 유해 URL들에 대해 실험한 결과, 제안한 시스템의 효율은 full nudity의 경우에는 89.6% , 반라의 경우는 70.1% 의 차단 효율을 나타내었으며, 얼굴영상의 경우는 2%의 오판별이 있었다.

  • PDF

블록의 속성과 질감특징을 이용한 문서영상의 블록분류 (Block Classification of Document Images by Block Attributes and Texture Features)

  • 장영내;김중수;이철희
    • 한국멀티미디어학회논문지
    • /
    • 제10권7호
    • /
    • pp.856-868
    • /
    • 2007
  • 본 논문에서는 블록의 속성과 질감특징을 이용하여 효과적인 블록 분류 방법을 제안하였다. 제안한 방법에서는 먼저 명암도 문서영상을 이진화한 후, 평활화 기법을 적용하여 블록의 위치정보와 본 논문에서 사용할 특징 중에 하나인 각 블록의 내부에 있는 작은 블록들의 최대 높이 값을 구하였다. 이 위치정보들을 이용하여 문서영상을 각 블록으로 분할한다. 이 블록의 명암도 블록영상에서 문서의 속성이 잘 반영된 (0,1) 방향의 공간 명암도 의존 행렬을 구하여 7가지 질감특징을 구하였다. 먼저 블록의 속성을 최소거리 규칙(Nearest Neighbor Rule)에 입력하여 문자와 비문자 영역으로, 상세분류를 위하여 7가지 질감특징을 이용하여 큰 문자, 작은 문자, 표, 그래픽 및 사진 등으로 구분함으로써 문서인식을 위한 구조 해석뿐만 아니라 다양한 응용 분야에 효과적으로 이용될 수 있도록 하였다.

  • PDF

Water flow model에 기반한 문서영상 이진화 방법의 속도 개선 (Speed-up of Document Image Binarization Method Based on Water Flow Model)

  • 오현화;김도훈;이재용;김두식;임길택;진성일
    • 대한전자공학회논문지SP
    • /
    • 제41권4호
    • /
    • pp.75-86
    • /
    • 2004
  • 본 논문에서는 water flow model의 개념을 적용한 문서영상 이진화 방법의 속도를 개선하는 방법을 제안한다. 제안한 방법은 문서영상에서 문자 주위를 관심영역(region of interest: ROI)으로 추출하고 3차원 영상지형에서 물이 뿌려지는 영역을 관심영역 이내로 제한한다. 국부 계곡에 누적되는 물의 양은 계곡의 깊이와 경사를 이용하여 자동으로 결정된다. 그리고 계곡의 최저 지점뿐만 아니라 그 주위에도 가중치를 부여하여 물을 누적함으로써 관심영역에 해당하는 영상지형에 물을 붓는 과정을 한번만 수행하여 충분한 양의 물이 계곡에 채워지도록 한다. 계곡에 형성된 연못의 깊이는 배경과 문자의 밝기 차에 따라 다양하므로 연못의 깊이를 기준으로 문자 분리를 위한 임계치를 적응적으로 결정한다. 실제 문서영상에 대한 실험에서 제안한 방법의 수행속도가 water flow model에 기반 한 이진화 방법과 비교하여 월등히 향상되었으며 이진화 품질도 매우 우수함을 보였다.

Fuzzy 추론 및 명암차이법을 이용한 카메라 줌, 포커스 자동 조절 시스템 (An Automatic Control System of a Camera Zoom and Focus Using the Fuzzy Inference and the Difference of the Light and Darkness)

  • 박홍선;박상욱;박정현;곽주원;손영선
    • 한국지능시스템학회:학술대회논문집
    • /
    • 한국퍼지및지능시스템학회 2002년도 추계학술대회 및 정기총회
    • /
    • pp.406-409
    • /
    • 2002
  • 본 논문에서는 문자인식이 가능하도록 줌, 포커스를 제어하여 한글 문서 영상을 확대/축소하는 시스템을 구현하였다. 한글 문서 영상에서 확대/축소 할 영역이 지정되면 그 영역의 가로, 세로 거리를 펄스 수로 변환한 후 Step모터를 제어하여 그 위치만큼 카메라를 이동시킨다. 문서 영상이 입력되면 문자인식이 가능한 크기만큼 줌을 제어하고, 피드백 되어진 영상으로부터 조정된 줌에 맞는 포커스로 근접 제어한 후, 더욱 선명한 영상을 얻기 위해 명암 차이에 의한 미세 조정을 하였다. 이 경우, 줌 및 포커스는 퍼지 추론으로 .제어하는 DC모터로 조정하였다.