Search | Korea Science

A new segmentation method for non-manhattan layout document images using connected component (연결요소 특징을 이용한 복잡한 문서영상의 구조 분석)

이상협;이경무
- Proceedings of the Korean Society of Broadcast Engineers Conference
- /
- 1997.11a
- /
- pp.71-74
- /
- 1997
본 논문은 일반적으로 제약 없는 형식 문서 즉, 논-맨하탄(non-manhattan) 형식의 이진문서영상을 분석하는 기법으로서, 연결요소기법에 기반한 특징추출과 이를 이용한 영역분리 및 분류에 관한 새로운 방법을 제안한다. 제안한 방식은 바텀-업(bottom-up)방식으로서 먼저 처리속도의 고속화와 축소시 특징 영역보존을 위해 임계치 축소기법을 사용하고, 축소된 이진 문서영상내의 각 연결된 검은 화소의 집합을 개체화하고 개체의 특성에 따라 텍스트, 신성분, 해프톤, 도형 그리고 표 등으로 분류한다. 영역분류는 두단계로 이루어지는데, 1차분류에서는 우선, B/W 비, 면적, 외각 테두리의 높이와 너비 비, 테두리선유무 등의 특징을 이용하여 해프톤, 수평 수직선, 테두리(표 및 도형)영역을 분리한다. 이후 2차 분류에서는 문자성분의 수평결합을 통한 텍스트행 성분을 추출한다. 마지막 후처리 과정으로 표분석 알고리듬을 통하여 테두리 영역중 표와 도형을 정확히 구분하고, 또한 도형에 관련한 문서성분을 해당 도형 개체에 연결하는 작업을 수행함으로써 완벽한 영역분류를 한다. 다양한 문서영상을 이용한 시뮬레이션을 통해 제안한 알고리듬의 성능을 입증한다.
PDF

Understanding Documents With Chemical Structures Using Image Segmentation (영상 분할을 활용한 화학 구조 문서 이해)

Yang, Haeyoon;Cho, Nam Ik
- Proceedings of the Korean Society of Broadcast Engineers Conference
- /
- 2022.06a
- /
- pp.1297-1300
- /
- 2022
Document layout analysis는 문서 이미지의 구조와 구성요소를 파악하는 기술이다. 기존 딥러닝을 사용한 학습 기반 방법에는 각 구성 요소를 검출하는 detection 기반 방식이 많으나 이는 다양한 형식의 문서 이미지에 확장될 수 있는 가능성이 낮다는 한계가 존재한다. 특히, 다양한 모양과 크기의 화학 구조를 포함하는 화학 문서 이미지에 적용하기 어렵다. 본 논문에서는 영상분할을 활용하여 화학 구조 문서를 이해하는 연구를 진행하였다. 기존의 블록 단위로 레이블링된 벤치마크와 다르게 객체 단위로 레이블링한 학습 데이터를 가지고 DeepLabv3 구조의 네트워크를 학습하여 화학 문서 이미지를 효과적으로 분할하였다. 객체 단위 레이블링과 영상 분할을 사용한 방식이 문서 이해 및 화학 구조 검출에 준수한 성능을 보이는 것을 확인하였고 이 방식이 다양한 형식의 문서 이미지에 확장될 수 있음을 보였다.
PDF

A Design of Image Information Retrieval System based on XML Database (XML 데이터베이스 기반의 영상정보 검색시스템 설계)

Kwak Kil-Sin;Joo Kyung-Soo
- Proceedings of the Korean Information Science Society Conference
- /
- 2005.11b
- /
- pp.139-141
- /
- 2005
최근 인터넷의 발달에 따라 XML 문서의 사용과 각종 영상정보의 양이 크게 증가되었다. 이에 따라 XML 문서를 관리하기 위한 XML 데이터베이스의 필요성과 메타데이터 표준화에 대한 중요성이 증가되고 있다. XML 데이터베이스는 XML 문서의 특성을 고려하여 그 특성을 효율적으로 지원할 수 있다. 또한 국내에서는 교육정보분야 메타데이터 표준인 KEM 2.0이 제정 되었고 국외에서는 멀티미디어 데이터에 대한 표준으로 MPEG-7이 제정이 되었다. 이에 따라 본 논문에서는 MPEG-7을 기반으로 KEM 2.0을 이용한 영상정보 XML 스키마를 생성하고 이를 이용한 영상정보 검색시스템을 XML 데이터베이스 기반으로 설계하고자 한다. 본 논문에서 설계하는 XML 데이터베이스 기반의 영상정보 검색시스템은 XML 문서에 대한 빠른 저장과 검색이 가능할 것이다. 또한 검색 기능에 있어서는 키워드 기반의 의미기반 검색과 유사 이미지를 통한 내용기반 검색, 그리고 이를 내용기반과 의미기반을 통합한 검색 기능을 제공할 것이며 XML 문서에 대한 강력한 질의 수단인 XQuery 질의를 포함하게 될 것이다.
PDF

Watermarking Text Document Images Using Edge Direction Histograms (에지 방향 히스토그램을 이용한 텍스트 문서 영상의 워터마킹)

김영원;문경애;오일석
- Proceedings of the Korean Information Science Society Conference
- /
- 2002.10c
- /
- pp.601-603
- /
- 2002
이 논문은 명암(grayScale)을 갖는 텍스트 문서 영상을 위한 새로운 워터마킹 알고리즘을 제안한다. 텍스트 문서 영상을 여러 블록으로 나누었을 때, 블록 영상들의 에지 방향 히스토그램이 유사하다는 부분 영상의 일관성이라는 특성을 갖는다. 이러한 특성을 이용하여 블록의 에지 방향 히스토그램을 조작하여 신호를 삽입한다. 다양한 공격에 대한 실험을 통하여 알고리즘의 강인성과 비인지성을 분석하였다.
PDF

Skew Correction of Document Images using Edge (에지를 이용한 문서영상의 기울기 보정)

Ju, Jae-Hyon;Oh, Jeong-Su
- Journal of the Korea Institute of Information and Communication Engineering
- /
- v.16 no.7
- /
- pp.1487-1494
- /
- 2012
This paper proposes an algorithm detecting the skew of the degraded as well as the clear document images using edge and correcting it. The proposed algorithm detects edges in a character region selected by image complexity and generates projection histograms by projecting them to various directions. And then it detects the document skew by estimating the edge concentrations in the histograms and corrects the skewed document image. For the fast skew detection, the proposed algorithm uses downsampling and 3 step coarse-to-fine searching. In the skew detection of the clear and the degraded images, the maximum and the average detection errors in the proposed algorithm are about 50% of one in a conventional similar algorithm and the processing time is reduced to about 25%. In the non-uniform luminance images acquired by a mobile device, the conventional algorithm can't detect skews since it can't get valid binary images, while the proposed algorithm detect them with the average detection error of 0.1o or under.
https://doi.org/10.6109/jkiice.2012.16.7.1487 인용 PDF KSCI

Copyright protection using watermarking (워터마킹 기술 중심의 저작권 보호 기술)

이영아;하재호
- Korea Multimedia Society
- /
- v.5 no.1
- /
- pp.41-54
- /
- 2001
본 기술개발은 인터넷망을 통한 멀티미디어 컨텐츠(영상, 정지영상, 동영상, 오디오, 문서 등)의 유통에 따른 지적소유권, 저작권을 보호하기 위한 워터마킹 시스템 구축에 목적을 둔다. 개인용 컴퓨터의 보급 확대와 네트워크의 급속한 성장으로 인해 정지영상, 문서, 동영상, 음악 데이터 등의 멀티미디어보급이 급격히 증가하고 있다.(중략)
PDF

A New Method for Nonparametric Document Layout Analysis (매개변수에 무관한 새로운 문서 구조 분석 방법)

류대석;강선미;이성환
- Proceedings of the Korean Information Science Society Conference
- /
- 1999.10b
- /
- pp.482-484
- /
- 1999
본 논문에서는 매개변수 없이 입력 문서 영상을 최대 동질 영역들로 분할한 다음, 각 동질 영역을 텍스트, 그림, 표 그리고 선으로 자동 분류하는 새로운 방법을 제안한다. 다단계 분석과 하향식 접근 방법을 사용하기 위하여 문서 영상을 피라미드 구조로 계층화하였으며, 어떤 영역을 분할할 지의 여부를 결정하기 위하여 그 영역의 주기성을 이용하여 판단하였다. 이러한 주기성 정보를 이용함으로써, 어떠한 매개변수 없이도 활자체 크기와 행간에 무관하게 텍스트 영역을 정확히 분석할 수 있었으며, 피라미드 구조를 만드는데 걸리는 시간이 질감 분석 접근방법보다 빠른 방법으로 설계되었다. Washington 대학의 문서 영상 데이터베이스를 이용한 실험 결과, 제안된 방법이 기존의 방법들보다 더 정확하게 문서 영상을 분할 및 분류할 수 있음을 확인할 수 있었다.
PDF

A study on the segmentation and extraction of the pictures and characters in korean document (한글 문서 인식을 위한 문서 영상에서의 문자와 그림의 분리 추출)

Lee, In-Dong;Ho, Kang-Tae;Kwon, Oh-Seok;Kim, Tae-Kyun
- Annual Conference on Human and Language Technology
- /
- 1989.10a
- /
- pp.50-53
- /
- 1989
한글 문서를 인식하기 위하여 문서 영상에서 문자와 그림을 분리 추출하기 위한 방법에 대하여 논하였다. 분리 추출 방법으로는 실시간으로 입력되는 영상 데이타로부터 문자와 그림 의 경계 위치를 알아내는 방법을 사용하였다. 한글, 영문, 한자, 기호 등의 문자와 그림이 혼합된 A4 크기의 문서 영상을 300 DPI의 해상도로 입력받아 실험하였다. 단 한번의 주사만으로 모든 문자와 그림이 정보 gm름의 순서에 따라 분리 추출되었다. 실험 결과 본 방법은 최소한의 시간과 최소한의 기억 용량으로 완벽한 분리 추출이 가능함을 보였다.
PDF

Scale-Invariant Document Detection Algorithm Based on LLAH (스케일에 강인한 LLAH 기반 문서 인식 알고리즘)

Lee, Jaeha;Park, Jungjoo;Park, Jong-Il
- Proceedings of the Korean Society of Broadcast Engineers Conference
- /
- 2016.11a
- /
- pp.161-162
- /
- 2016
비슷한 코너의 모양을 가지는 다수의 글자가 포함된 문서 영상을 인식하는 일은 쉽지 않다. 일반적으로 성능이 우수하다고 알려진 SIFT 알고리즘은 코너를 기반으로 특징을 기술하는 알고리즘이기 때문에 각 글자가 비슷한 코너의 모양을 가지는 문서 영상 인식에서는 좋은 성능을 발휘하지 못한다. 반면, LLAH 는 각 단어의 크기를 알아내어 가우시안 필터와 이진화를 통해 단어를 하나의 점으로 나타내고 각 점과 점 사이의 기하 관계를 기술자로 표현하기 때문에 문서의 단어에서 점이 일관되게 추출된다면 좋은 인식 성능을 발휘한다. 그러나, 영상에서 단어의 크기를 알아내는 작업은 계산 측면에서 많은 비용을 필요로 한다. 이에 본 논문에서는 LLAH 를 사용하기 전에 반복적인 가우시안 필터와 이진화를 적용하여 단어의 크기를 알지 못하는 상황에서도 스케일에 강인하게 문서 영상을 인식할 수 있는 알고리즘을 제안한다.
PDF

Block Classification of Document Images Using the Spatial Gray Level Dependence Matrix (SGLDM을 이용한 문서영상의 블록 분류)

Kim Joong-Soo
- Journal of Korea Multimedia Society
- /
- v.8 no.10
- /
- pp.1347-1359
- /
- 2005
We propose an efficient block classification of the document images using the second-order statistical texture features computed from spatial gray level dependence matrix (SGLDM). We studied on the techniques that will improve the block speed of the segmentation and feature extraction speed and the accuracy of the detailed classification. In order to speedup the block segmentation, we binarize the gray level image and then segmented by applying smoothing method instead of using texture features of gray level images. We extracted seven texture features from the SGLDM of the gray image blocks and we applied these normalized features to the BP (backpropagation) neural network, and classified the segmented blocks into the six detailed block categories of small font, medium font, large font, graphic, table, and photo blocks. Unlike the conventional texture classification of the gray level image in aerial terrain photos, we improve the classification speed by a single application of the texture discrimination mask, the size of which Is the same as that of each block already segmented in obtaining the SGLDM.
PDF

Search Result 381, Processing Time 0.029 seconds

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

Detail Search

Image Search (β)