• 제목/요약/키워드: 텍스트 구성

검색결과 865건 처리시간 0.029초

텍스트의 언어적 난이도 측정 공식 비교 연구 - 초중고 교과서를 중심으로 - (A Comparative Study on Modelling Readability Formulas: Focus on Primary and Secondary Textbooks)

  • 최인숙
    • 정보관리학회지
    • /
    • 제22권4호통권58호
    • /
    • pp.173-195
    • /
    • 2005
  • 본 연구는 언어적 난이도에 영향을 주는 요인들로 텍스트수준점수 측정공식을 구성하는 방법론이 초등학교 텍스트는 물론 중고등학교 텍스트까지 확장 ·적용될 수 있는지 확인하고 텍스트가 확장됨에 따라 나타나는 새로운 특성을 설명할 수 있는 요인들을 규명하고자 한다. 초중고 텍스트 통합공식, 중고등학교 텍스트 전용공식, 초등학교 텍스트 전용공식을 구성하여 각 공식들의 특징을 비교한 결과 텍스트의 범위를 넓게 잡아 통합 공식을 구성하는 것보다는 소규모 집단으로 분리한 후 전용공식을 구성하는 것이 해당 집단의 특성을 잘 반영하는 우수한 공식을 도출할 수 있는 것으로 확인되었다. 중고등학교 텍스트의 점수를 측정하려면 단락내문장수요인, 문장수 $\cdot$ 단락수요인을 사용하고 초등학교 텍스트의 점수를 측정하려면 이형어절수요인, 이형어절수$\cdot$새어절출현비율요인을 사용하는 것이 효율적이었다.

콘텐츠 제작방식, 지각된 위험, 미디어 풍부성이 고객만족에 미치는 영향 분석 (Empirical Analysis on the Effect of Design Pattern of Web Page, Perceived Risk and Media Richness to Customer Satisfaction)

  • 박봉원;이중만;이종원
    • 한국콘텐츠학회논문지
    • /
    • 제11권6호
    • /
    • pp.385-396
    • /
    • 2011
  • 인터넷의 웹페이지는 다양한 형태로 존재하지만, 크게 텍스트 중심의 웹페이지, 텍스트와 이미지로 구성된 웹페이지, 그리고 텍스트와 동영상으로 구성된 웹페이지로 구분할 수 있다. 본 연구에서는 콘텐츠 제작방식에 따라서 변하는 소비자들의 지각된 위험 수준과 미디어 풍부성이 미치는 영향을 분석하며, 이들 요인이 고객만족에 미치는 영향을 분석한다. 분석결과, 텍스트 형식의 웹페이지가 텍스트와 이미지 혹은 동영상으로 구성된 웹페이지에 비해서 지각된 위험 중 성능위험, 심리적 위험, 시간 위험 등으로 구성된 개인적 위험을 더 크게 느끼는 것으로 나타났다. 또한, 미디어 풍부성 측면에서는 텍스트와 이미지 혹은 동영상으로 구성된 웹페이지가 텍스트 위주의 웹페이지에 비해서 상징성 및 사회적 실재감이 높은 것으로 조사되었다. 그리고 개인적 위험 및 텍스트 형식의 웹페이지는 고객 만족에 음의 영향을 미치며, 상징성 및 사회적 실재감은 양의 효과를 가진다. 본 연구는 지각된 위험과 미디어 풍부성의 개념을 콘텐츠 제작방식과 연결시킴으로써 기대와는 달리 동영상 콘텐츠가 폭발적으로 성장하지 못한 점에 대해서 규명한데 의의를 둔다.

기획 - Text Mining을 이용한 영문 특허텍스트 DB의 텍스트 경제성 및 피검색성을 평가하는 기법에 관한 연구

  • 김현태
    • Patent21
    • /
    • 통권89호
    • /
    • pp.2-15
    • /
    • 2010
  • 본 연구보고서는 Text Mining 가법을 기반으로 영문 특허텍스트 DB를 구성하는 텍스트 (Text) 부분의 경제성 및 피검색성을 정량적으로 평가하는 모델을 제시하고, 이를 바탕으로 2차 가공된 영문 특허텍스트 DB의 성능을 일정범위 내에서 관리하는 품질관리모델의 개발 가능성을 탐색하는데 그 목적이 있다.

  • PDF

그림책 페리텍스트 분석을 위한 구성 요소 (Components for Picturebook Peritext Analysis)

  • 남아름;김상림
    • 문화기술의 융합
    • /
    • 제9권2호
    • /
    • pp.181-188
    • /
    • 2023
  • 그림책의 교육적 활용 가치와 페리텍스트의 서사적 중요성에 대한 학문적 관심이 증가하면서 그림책 분석 시 사용되는 페리텍스트 구성 요소에 대한 체계적인 고찰이 요구되는 실정이다. 이에 본 연구에서는 그림책 페리텍스트를 분석한 11편의 선행연구에서 사용한 페리텍스트 구성 요소를 고찰한 후, 네 가지('기본적 정보', '물리적 요소', '위치적 요소', '콘텐츠 요소')로 범주화하여 분석틀을 제안했다. 첫 번째 범주는 '기본적 정보'로 '제목', '작가명', '출판 정보', '수상 정보', '헌사/감사의 말', '추천사' 등이 포함되며, 두 번째 범주는 '물리적 요소'로 '판형', '제본', '재질' 등이 포함된다. 세 번째 범주는 '위치적 요소'로 '표지(앞표지, 뒤표지, 책등)', '면지', '표제지', '간기면', '덧싸개 및 띠지' 등이 포함되며, 네 번째 범주는 '콘텐츠 요소'로 '글', '그림', '타이포그래피', '레이아웃', '페이지 형태' 등이 포함된다. 본 연구결과를 통해 다양한 그림책의 페리텍스트 분석 및 활용 연구가 활성화될 수 있을 것으로 기대한다.

한국어 텍스트의 논증 구조 내 담화 관계의 자동 분류 연구 (An Automatic Classification of Discourse Relations in the Arguing Structure of Korean Texts)

  • 이상아;신효필
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2015년도 제27회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.59-64
    • /
    • 2015
  • 최근 온라인 텍스트 자료를 이용하여 대중의 의견을 분석하는 작업이 활발히 이루어지고 있다. 이러한 작업에는 주관적 방향성을 갖는 텍스트의 논증 구조와 중요 내용을 파악하는 과정이 필요하며, 자료의 양과 다양성이 급격히 증가하면서 그 과정의 자동화가 불가피해지고 있다. 본 연구에서는 정책에 대한 찬반 의견으로 구성된 한국어 텍스트 자료를 직접 구축하고, 글을 구성하는 기본 단위들 사이의 담화 관계를 정의하였다. 각 단위들 사이의 관계는 기계학습과 규칙 기반 방식을 이용하여 예측되고, 그 결과는 합성되어 하나의 글에 대응되는 트리 구조를 이룬다. 또한 텍스트의 구조상에서 주제문을 직접적으로 뒷받침하는 문장 혹은 절을 추출하여 글의 중요 내용을 얻고자 하였다.

  • PDF

고 품질 텍스트 압축 기능을 지원하는 정지영상 압축 시스템 (A Still Image Compression System with a High Quality Text Compression Capability)

  • 이제명;이호석
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제34권3호
    • /
    • pp.275-302
    • /
    • 2007
  • 본 논문은 고품질 텍스트 압축 기능을 지원하는 우수한 정지영상 압축 시스템을 제안한다. 영상에서 텍스트 부분을 분리하여 압축을 수행함으로서 고품질의 텍스트 압축 기능을 지원한다. 시스템은 코드블록 단위로 적응 이진 산술부호화를 수행하여 48:1 이상의 높은 정지영상 압축률을 보여주고 있다. 코드블록은 비트평면을 구성하는 비트들을 서브블록 단위로 파악하여 산술부호에 적합한 코드블록을 구성한 것이다. 산술부호기는 구성된 코드블록을 문맥을 기반으로 압축한다. 시스템의 입력 모드는 분할(Segmentation) 모드와 ROI(Region Of Interest) 모드로 구성된다. 분할 모드는 입력 영상을 텍스트 부분과 배경 영상 부분으로 분할하여 입력할 수 있게 한다. ROI 모드는 입력 영상을 관심 영역과 그 밖의 영역으로 구분하여 입력할 수 있게 한다. 현재 시스템이 나타내는 텍스트 압축 기능과 높은 압축률은 다른 JPEG2000 시스템들과 충분히 비교할 수 있는 수준이다. 시스템은 그 밖에 그레이 코딩을 수행하여 압축률을 향상시킨다.

독서교육시스템을 위한 텍스트수준 측정 공식 구성에 관한 연구 (A Study on Modelling Readability Formulas for Reading Instruction System)

  • 최인숙
    • 정보관리학회지
    • /
    • 제22권3호
    • /
    • pp.213-232
    • /
    • 2005
  • 본 고의 목적은 초등학생용 독서자료의 텍스트수준에 영향을 미치는 요인들을 규명하여 텍스트수준 측정 공식을 구성함으로써 텍스트의 수준 평가를 자동화하는 데에 있다. 컴퓨터로 계량화할 수 있는 언어적 요인들을 대상으로 표본집단에 부여된 텍스트수준 점수와의 상관관계를 검토한 결과 글자수, 어절수, 이형어절수, 문장수, 단락수 요인이 텍스트수준을 결정하는 요인으로 드러났다. 단순회귀분석을 통해 도출된 회귀방정식들 중에서 이형어절수 모형이 최적의 공식으로 드러났으나, 중회귀분석을 한 결과 이형어절수요인과 새 어절출현비율요인을 결합한 모형은 설명력이 더욱 향상된 공식으로 밝혀졌다. 공식에 따라 측정된 텍스트수준 점수는 학년 내에서 매우 세분된 단계까지 나타내고 있으므로 각 학생별로 그들의 독서능력에 적합한 자료를 추천할 수 있다.

장면 이미지로부터 문자-에지 맵 특징을 이용한 텍스트 추출 (Text Extraction using Character-Edge Map Feature From Scene Images)

  • 박종천;황동국;이우람;권교현;전병민
    • 한국산학기술학회:학술대회논문집
    • /
    • 한국산학기술학회 2006년도 춘계학술발표논문집
    • /
    • pp.139-142
    • /
    • 2006
  • 본 연구는 장면 이미지로부터 텍스트에 존재하는 문자-에지 특징을 이용하여 텍스트를 추출하는 방법을 제안한다. 캐니(Canny)에지 연산자를 이용하여 장면 이미지로부터 에지를 추출하고, 추출된 에지로부터 16종류의 에지-맵 생성한다. 생성된 에지 맵을 재구성하여 문자 특징을 갖는 8종류의 문자-에지 맵을 만단다. 텍스트는 배경과 잘 분리되는 특징이 있으므로 텍스트에 존재하는 '문자-에지 맵'의 특징을 이용하여 텍스트를 추출한다. 텍스트 영역에 대한 검증은 문자-에지 맵의 분포와 텍스트에 존재하는 글자간의 공백 특징으로 한다. 제안한 방법은 다양한 종류의 장면 이미지를 실험대상으로 하였고, 텍스트는 적어도 2글자 이상으로 구성된다는 제한조건과 너무 크거나 작은 텍스트는 텍스트 추출에서 제외하였다. 실험결과 텍스트 영역 추출률은 약 83%를 얻었다.

  • PDF

하이퍼텍스트의 개념과 응용에 관한 고찰 (An Overview of Hypertext and Its Applications)

  • 정영미
    • 정보관리학회지
    • /
    • 제6권2호
    • /
    • pp.3-20
    • /
    • 1989
  • 하이퍼텍스트시스템은 비직선적이며 비연속적인 형태로 문헌을 조직하고 이용할 수 있는 새로운 형태의 정보시스템이다. 하이퍼텍스트는 정보뭉치를 소장하는 노드와 상호 관련된 노드들을 연결하는 링크로 구성되며 노드에는 텍스트, 그래프, 그림, 비디오화면, 소리 등의 정보가 소장될 수 있다. 이용자는 링크를 선택함으로써 원하는 정보에 자유롭게 접근할 수 있다. 이 논문에서는 하이퍼텍스트의 개념, 구성요소, 특성 둥을 구체적으로 살펴보고 PC용 상용시스템인 Guide에 관해 간단한 응용 예를 들어 기술하였다.

  • PDF

자연영상에서 적응적 문자-에지 맵 특징을 이용한 텍스트 영역 검출 (Text Region Detection using Feature of Adaptive Character-Edge Map in Natural Images)

  • 박종천;황동국;이우람;전병민
    • 한국산학기술학회:학술대회논문집
    • /
    • 한국산학기술학회 2007년도 춘계학술발표논문집
    • /
    • pp.181-184
    • /
    • 2007
  • 자연영상에 포함된 텍스트는 많은 중요한 정보를 포함하고 있으므로 자연영상에서 텍스트 정보를 검출하는 연구가 활발히 진행되고 있다. 본 논문에서는 문자 영역의 구조적인 특정을 배열문법으로 정의한 적응적 문자-에지 맵을 제안하여 텍스트 영역을 검출한다. 캐니-에지 검출기로 에지를 추출하고, 생성된 에지 이미지를 레이블링하고 그 영역의 문자구조 특징을 분석하기 위해서 적응적 문자-에지 맵을 분석한다. 적응적 문자-에지 랩의 분포 상태를 분석함으로서 텍스트 후보 영역을 검출하고, 텍스트 영역의 에지 히스토그램 프로파일을 분석함으로서 텍스트 후보 영역에 대한 검증을 수행하여 최종적인 텍스트 영역을 검출한다. 제안한 방법은 다양한 종류의 자연영상을 대상으로 실험하였고, 기울어진 텍스트와 다양한 크기의 텍스트 구성된 자연영상에서 텍스트 영역을 효과적으로 검출하였다.

  • PDF