• 제목/요약/키워드: 문서영상

검색결과 381건 처리시간 0.027초

한글 문서 영상의 단어 검색 시스템 (A Kerword Spotting System of Korean Document Images)

  • 최윤성;오일석
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 가을 학술발표논문집 Vol.29 No.2 (2)
    • /
    • pp.586-588
    • /
    • 2002
  • 본 논문은 한글 문서 영상의 단어 검색 시스템과 그 성능을 제시한다. 두 단계 검색 방법은 검색 속도 증가를 목적으로 하며, 첫 번째 단계에서는 매우 빠른 속도로 거친 정합을 통하여 후보 단어들을 추출한다. 두 번째 단계는 후보 단어들 중에서 미세한 정합을 통한 단어 검색이 이루어진다. 시스템은 문서 영상 구조 분석 모듈과 단어 검색 모듈로 구성된다. 실험 자료를 통해 시스템의 유용성을 입증한다.

  • PDF

이진 대역분할과 Zerotree 기반 산술부호기를 이용한 문서 영상 압축 (Document Image Compression Using Binary Subband Analysis and Zerotree-based Arithmetic Coder)

  • 김정권;김승환;이충웅
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송공학회 1999년도 KOBA 방송기술 워크샵
    • /
    • pp.45-50
    • /
    • 1999
  • 이진 영상의 압축은 디지털 도서관, 팩시밀리 전송, 문서 입출력 시스템과 같이 한정된 대역폭과 저장 공간을 가진 응용 분야에서 절실히 요구되고 있다. 현재 많은 영상 압축 알고리즘이 채택하고 있는 대역분할 기법을 문서와 같은 이진 영상의 압축에 적용한다면, 점진적 전송, 축소영상을 통한 빠른 검색 등의 장점을 얻을 수 있다. 그러나, 이진 영상 신호가 두 단계의 휘도 값을 가지므로, 이에 적합한 대역분할 방법과 산술부호기를 선택하여야 한다. 본 논문에서는 표본화-XOR 대역분할 기법을 선택하여, 알파벳 수의 증가를 막고 공간영역에서 국부적인 성질을 얻을 수 있다 또한, 넓은 단일-색 영역을 Zerotree로 대표하여 부호화 되는 신호의 수를 줄이고, 대역분할 구조에서 예측성의 저하를 막기 위한 적절한 조건화문맥과 새로운 부호를 선택한다. 이진 영상에 적합한 대역분할 방법과 산술부호기를 선택하여, 대역분할의 장점과 우수한 압축 성능을 달성할 수 있다.

  • PDF

제한된 문서 영상에서 패턴 분절과 구분 처리에 관한 연구 (A Study on the Pattern Segmentation and Classification in Specially Documentated Imaged)

  • 옥철호;허도근;진용옥
    • 한국통신학회논문지
    • /
    • 제14권6호
    • /
    • pp.663-674
    • /
    • 1989
  • 본 논문은 문서자동 처리시스템의 구현을 위하여 문서영상의 패턴 분절과 구분처리 방법에 대하여 기술하였다. 가우스 분포함수의 1차 미분 연산자에 의한 윤곽선 추출과 체인 코드법에 의한 영상 분절, 2차 적률과 2차원 Rf 거리 (변환 영역)등에 의한 패턴 구분을 행하였다. 제한된 영상에 대하여 적용한 결과 문자 영역이나 지문, 사진, 도장 등 도형정보 영역을 잘 구분할 수 있음을 알았으며 사용된 알고리즘의 유용성을 검증할 수 있었다.

  • PDF

웨이브렛 특징과 순위 기반 인식을 이용한 한글 문서 영상 검색 시스템 (A Hangul Document Image Retrieval System Using Rank-based Recognition)

  • 이득용;김우연;오일석
    • 한국콘텐츠학회논문지
    • /
    • 제5권2호
    • /
    • pp.229-242
    • /
    • 2005
  • 우리는 스캔된 한글 문서 영상에 대한 전문(full-text) 검색 시스템을 구축하였다. 이 시스템은 크게 전처리부, 인식부, 그리고 검색부로 구성되어 있다 검색 알고리즘은 k순위까지의 인식 결과를 이용한다. 이 방법은 검색 성능이 인식 오류에 둔감할 뿐만 아니라, 재현률과 정확률을 사용자가 조절할 수 있는 장점을 갖는다. 객관적인 성능 평가를 위해 KISTI가 제공하는 정보과학회 논문지 영상을 실험에 사용하였다. 인식과 검색 성능을 통하여 시스템이 실용적임을 보였다.

  • PDF

조응구조의 지시사상 (mapping) 이론

  • 박영규
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1990년도 제2회 한글 및 한국어정보처리 학술대회
    • /
    • pp.199-199
    • /
    • 1990
  • 입력된 문서 영상으로부터 분리 추출된 문자 영상을 올바르게 인식하는 것은 문서 인식에서 가장 핵심적인 부분이다. 스캐너를 통해 입력되고 분리된 실제의 문자 영상은 많은 문제점들을 가지고 있다. 한글의 경우 이 중 개별 문자 영상내의 각 자소간의 접촉은 올바른 인식을 저해하는 주요한 원인이다. 이런 접촉의 문제를 효율적으로 해결하기 위해 한글의 구조적 특성을 지닌 "방향 필터"를 정의하고, 이것을 이용하여 세선화된 문자 영상을 추적하면서 선소들을 뽑아낸다. 이렇게 하여 얻은 선소들과 선소들간의 지식을 조합하여 한글자소 획을 추출케 되고 결국에는 이런 획의 조합을 통해 문자 영상을 인식하는 방법을 제안한다.

  • PDF

Water Flow Model을 이용한 문서 영상의 이진화 (Document Image Binarization Using a Water Flow Model)

  • 김인권;정동욱;송정희;박래홍
    • 대한전자공학회논문지SP
    • /
    • 제38권1호
    • /
    • pp.19-32
    • /
    • 2001
  • 본 논문에서는 영상의 밝기 값을 마치 3차원 지형과 같은 개념으로 간주하여 여기에 물이 흐르는 개념을 적용하여 국부 적응 (locally adaptive) thresholding 방법을 제안하였다. 문자를 추출해내기 위해 제안한 방법에서는 지형 표면에 물을 붓는 과정을 수행하였다. 물은 지형의 낮은 곳으로 흐르게 되어 계곡 (valley)에 쌓인다. 이때 문자와 배경으로 구성된 문서영상에서 쌓인 물의 양을 기준으로 두 개의 영역을 구분을 하였다. 제안한 water flow model의 개념을 적용한 threholding 방법은 국부 적응 thresholding의 특성을 나타낸다. 합성 영상과 실제 영상을 이용하여 전산 모의 실험을 수행함으로써 제안한 방법이 문서 영상을 효과적으로 이진화할 수 있음을 보였다.

  • PDF

1차원 메디안 필터 기반 문서영상 영역해석 (The Region Analysis of Document Images Based on One Dimensional Median Filter)

  • 박승호;장대근;황찬식
    • 대한전자공학회논문지SP
    • /
    • 제40권3호
    • /
    • pp.194-202
    • /
    • 2003
  • 인쇄문서를 전자문서로 자동변환하기 위해서는 문서영상 영역해석과 문자인식 기술이 필요하다. 이들 중 영역해석은 문서영상을 세부 영역으로 분할하고, 분할한 영역을 문자, 그림, 표 등의 형태로 분류한파. 그러나 문자와 그림의 일부는 크기, 밀도, 화소분포의 복잡도가 비슷하여 정확한 분류가 어렵다. 따라서 영역해석에서의 오 분류는 자동변환을 어렵게 만드는 주된 원인이 된다. 본 논문에서는 분서영상을 문자와 그림영역으로 분할하는 영역해석 방법을 제안한다. 문자와 그림의 분류는 1차원 메디안 필터링을 기반으로 한 방법을 이용하여 언급한 문제점을 해결한다. 또한 메디안 필터링에 의해 발생하는 볼드체 문자와 그래프나 표와 같은 그림영역의 오 분류 문제를 표피 제거 필터와 문자의 최대크기를 이용하여 해결한다. 따라서 상용제품을 포함한 기존의 영역해석 방법보다 그 성능이 우수하다.

청소년을 위한 유해 웹영상 차단시스템의 구현 (Implementation of An Inappropriate Web-I mages Blocking System for Youth)

  • 이은애;정명숙;김재건;하석운
    • 한국멀티미디어학회:학술대회논문집
    • /
    • 한국멀티미디어학회 2000년도 춘계학술발표논문집
    • /
    • pp.319-323
    • /
    • 2000
  • 인터넷이 활성화되면서 청소년에게 유해한 영상을 제공하는 사이트들이 급속히 범람하고 있으며, 이로 인해 청소년들의 정신 건강이 심각하게 훼손되고 있다. 본 논문에서는 청소년들이 접근하기 쉬운 유해 URL 의 웹문서에 대해 그 문서 내에 포함되어 있는 영상들의 유해성을 판별하여 유해 영상을 선택적으로 차단할 수 있는 시스템을 구현하여 제시한다. 유해 URL들에 대해 실험한 결과, 제안한 시스템의 효율은 full nudity의 경우에는 89.6% , 반라의 경우는 70.1% 의 차단 효율을 나타내었으며, 얼굴영상의 경우는 2%의 오판별이 있었다.

  • PDF

Fuzzy 추론 및 명암차이법을 이용한 카메라 줌, 포커스 자동 조절 시스템 (An Automatic Control System of a Camera Zoom and Focus Using the Fuzzy Inference and the Difference of the Light and Darkness)

  • 박홍선;박상욱;박정현;곽주원;손영선
    • 한국지능시스템학회:학술대회논문집
    • /
    • 한국퍼지및지능시스템학회 2002년도 추계학술대회 및 정기총회
    • /
    • pp.406-409
    • /
    • 2002
  • 본 논문에서는 문자인식이 가능하도록 줌, 포커스를 제어하여 한글 문서 영상을 확대/축소하는 시스템을 구현하였다. 한글 문서 영상에서 확대/축소 할 영역이 지정되면 그 영역의 가로, 세로 거리를 펄스 수로 변환한 후 Step모터를 제어하여 그 위치만큼 카메라를 이동시킨다. 문서 영상이 입력되면 문자인식이 가능한 크기만큼 줌을 제어하고, 피드백 되어진 영상으로부터 조정된 줌에 맞는 포커스로 근접 제어한 후, 더욱 선명한 영상을 얻기 위해 명암 차이에 의한 미세 조정을 하였다. 이 경우, 줌 및 포커스는 퍼지 추론으로 .제어하는 DC모터로 조정하였다.

문서 영상의 기울기 검출을 위한 기준선 탐색 기법 (Baseline Searching Method for Document Skew Detection)

  • 신명진;김도연;차의영
    • 한국멀티미디어학회논문지
    • /
    • 제10권2호
    • /
    • pp.218-225
    • /
    • 2007
  • 본 논문은 문자 인식 등을 통한 문서 자동 처리 시스템을 위해서 스캔 과정에서 발생할 수 있는 문서의 기울기를 정확하게 검출하는 기법을 제안한다. 제안한 알고리즘은 처리 속도 향상을 위해 영상을 축소한 다음 형태학적 연산과 연결 성분 분석 방법으로 기울기 검출 대상 영역(ROI)을 먼저 설정한 후 설정된 영역 내에서 문서의 기울기 정보를 가지고 있는 기준선을 탐색하는 방법으로 정확하게 기울어진 각도를 검출할 수 있게 하였다. 기존의 형태학적 연산을 기반으로 한 기울기 검출 기법과 비교하고 다양한 종류의 대용량 문서 영상을 대상으로 한 실험 및 분석을 통해 제안한 기울기 검출 방법의 정확도 및 효율성을 증명하였다.

  • PDF