• Title/Summary/Keyword: 언어적 분석

Search Result 3,359, Processing Time 0.029 seconds

Korean Dependency Structure Analyzer based on Probabilistic Chart Parsing (확률적 차트 파싱에 기반 한 한국어 의존 구조 분석기)

  • Eun, Ji-Hyun;Jeong, Min-Woo;Lee, Gary Geun-Bae
    • Annual Conference on Human and Language Technology
    • /
    • 2005.10a
    • /
    • pp.105-111
    • /
    • 2005
  • 정형적인 프로그래밍 언어에서는 언어를 기계적으로 해석하기 위해 입력의 구조적인 형태를 구축하는 파싱이 필수적인 과정으로 여겨진다. 기계에 기반 해서 개발된 프로그래밍 언어와 달리, 인간의 자유로운 의사소통을 위해 형성된 자연어는 특유의 다양성으로 인해 어휘, 구문, 의미 분석이 매우 어렵다. 반대로 자연어 구조 분석이 성공적으로 이루어지면 응용 시스템의 성능 향상에 상당한 기여를 할 것이라고 여겨지고, 이로 인해 끊임없이 자연어 처리, 특히 구문 분석에 많은 연구가 이루어지고 있다. 본 논문에서는 파싱에 사용되는 문법 전체를 말뭉치로부터 자동 구축하여 영역별 이식성 및 문법의 효율성을 도모했다. 또한 확률적 차트 파싱 기법과 immediate-head 파싱 모델을 적용하여 기존 파싱 시스템의 성능 향상을 시도했다. 세종 말뭉치를 이용한 파서의 성능은 각각 LP/LR 78.98%/79.55%로 나타났다.

  • PDF

Corpus-Linguistical Analysis of Newspaper Articles (신문 기사의 코퍼스 언어학적 분석)

  • Song, Kyung-Hwa;Kang, Beom-Mo
    • Annual Conference on Human and Language Technology
    • /
    • 2006.10e
    • /
    • pp.7-14
    • /
    • 2006
  • 본 연구에서는 신문 기사에 대한 실증적 언어 분석을 목적으로 하여, <21세기 세종계획>에 의해 구축된 대용량의 신문 기사 말뭉치를 다양한 각도로 계량화하여 분석한다. 신문 기사를 표제, 전문, 본문의 구성으로 나누고 각 구성의 특징에 따라 형태 분석 말뭉치, 형태의미 분석 말뭉치, 구문 분석 말뭉치를 이용하여 분석한다. 본 연구는 대량의 신문 기사 말뭉치를 이용한 계량적 방법이라는데 의의가 있다 이러한 연구 방법을 통하여 기존의 직관을 이용한 연구 방법들과 차별화 된 실증적 연구로서 신문 이론을 검증하고, 신문 기사의 새로운 언어 현상을 발견할 수 있을 것이다.

  • PDF

A Design of Reliability Analysis System for Review Videos using the Integrated Analysis of Verbal and Nonverbal Sentiment (언어와 비언어 표현의 통합 분석을 통한 리뷰 동영상의 신뢰성 분석 시스템 설계)

  • Shin, Hee-Won;Lee, So-Jeong;Son, Gyu-Jin;Kim, Hye-Rin;Gwak, Seo-Hyun;Kim, Yeong-Min;Kim, Yoonhee
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • 2020.11a
    • /
    • pp.515-518
    • /
    • 2020
  • 영상 콘텐츠 생산 간편화와 방송 채널 운영의 편리화에 따른 '영상의 시대'가 도래함에 따라 여러 제품에 대한 리뷰 영상이 관심을 받고 있다. 본 연구에서는 리뷰 영상의 언어와 비언어적 감성 분석을 토대로 통합 신뢰도 분석 시스템을 제안한다. 이를 위해, 영상 속 음성의 언어 감성 분석과 리뷰어의 표정 분석을 통해 얻은 각 감성값을 추출하고 정량화한다. 이후 표준화된 언어, 비언어적 감성 값에 대한 통합 신뢰도 분석을 진행한다. 결과적으로, 리뷰 영상에 대한 신뢰도를 객관화된 지표로써 평가할 수 있다.

Maximally Efficient Syntactic Parsing with Minimal Resources (최소자원 최대효과의 구문분석)

  • Shin, Hyo-Pil
    • Annual Conference on Human and Language Technology
    • /
    • 1999.10e
    • /
    • pp.242-248
    • /
    • 1999
  • 이 논문은 지역적 동사구 분할에 바탕을 두고 서술어가 문말에 위치하는 언어에 특성에서 기인하는 속성을 반영하는 부분적 그러나 빠른 구문분석에 관해 논한다. 즉 완벽성 보다는 신속함 그리고 신뢰에 바탕을 둔 새로운 한국어 구문분석에 대해 논의한다. 기존의 문법이론 대신 한국어의 형태적 통사적 특성에 기인한, 성분들의 분할(partitions)에 의한 단위 (chunks) 분석방법을 제안한다. 근간은 동사구 장벽(VP-barrier) 알고리즘이며, 이 알고리즘은 한 문장안에서의 다양한 동사의 파생접사에 의해 형성되는 관형화, 명사화, 부사화 등의 파생구조와 내포된 동사구(인용문, 종속문 등)에 의해 형성되는 지역적 동사구내에서 그 성분들의 논리적인 분할을 구성하고 다시 그 다음 요소와 체계적으로 결합하는 관계로 확장하여 가능한 구조들을 생성한다. 다시 언어의존적인 발견적 규칙(heuristics)들을 점수화하여 가장 높은 점수의 단위구조를 적격한 구조로 선택한다. 이 방법은 하위범주화 및 의미정보를 사용하지 않는, 빠른 구문분석이 요구되는 시스템을 위해 고안되었으며, 집단적인 노력이 아닌 개인적인 노력 및 최소의 자원으로도 최대의 효과를 얻을 수 있다는데 그 의의가 있다.

  • PDF

Comparative Analysis of Description Language for Business Architecture (비즈니스 아키텍처에 대한 기술 언어의 비교 분석)

  • Shim, Goon-Bo;Jeong, Seung-Ryul
    • 한국IT서비스학회:학술대회논문집
    • /
    • 2003.11a
    • /
    • pp.479-484
    • /
    • 2003
  • 기업 내 외적으로 끊임없이 변화하는 상황에 발맞추어 조직, 시스템, 기술, 프로세스의 진화관리는 큰 문제점으로 나타나고 있다. 이들을 관리하기 위한 전사적인 비즈니스 아키텍처(EBA)는 조직의 변화와 기술의 개발, 비즈니스 프로세스와 정보의 흐름에 따른 애플리케이션 솔루션의 통제와 기술 인프라의 가버런스 내용에 대하여 계획과 분석에 대한 원칙을 담고 있다. 이러한 내용이 설계와 구현으로 이어지는 단계를 기술하기 위하여, XML 혹은 HTML기반의 기술 언어(Description Language)가 역할을 담당하고 있다. 이러한 기술언어들로 BPEL, BPMI, XBRL, WSDL, ADML에 대한 비교 분석을 통해 전사적으로 각 기업의 특수성에 맞는 기술 언어로 프로세스를 통합하여 웹 서비스를 구현한다. 이러한 EBA는 계획과 분석을 하여, 기술언어는 EBA의 스팩 설정과 아울러, 설계 구현을 실행하는 것으로 본 논문은 기술언어를 비교하는 EBA와 연결하는 탐색적인 연구이다.

  • PDF

Implementation of Knowledgebase and Grammar Checker Based on Asymmetric Relationship (비대칭 관계에 기반한 지식베이스와 문법 검사기 구현)

  • Kang, Mi-Young;Lim, Sung-Shin;Kwon, Hyuk-Chul
    • Annual Conference on Human and Language Technology
    • /
    • 2002.10e
    • /
    • pp.147-154
    • /
    • 2002
  • 이 논문은 한국어 문서 교정을 위해 부산대학교 인공지능 연구실에서 개발되고 있는 맞춤법 및 문법 검사기와 그 지식베이스 구축에 대해 알아본다. 비대칭 관계(asymmetric relation) 설정과 더불어 개발된 문법 검사기는 한 문장의 임의의 두 요소간의 비대칭 관계를 토대로 (1) 잠재적 지배관계 개념을 설정하고 (2) 부분 문장 분석 방법을 사용한다. 이런 요소들을 효율적으로 운영하는 시스템을 구현하기 위해서는 한국어에 대한 이해와 경험적 자료를 적절히 조화시킨 지식베이스 구축이 필수적이다. 이 논문은 그 선수(先手) 작업으로 한국어 문서의 오류들을 관찰하고, 그로부터 추출한 언어적이거나 언어 외적인 요소들로부터 일반적 패턴을 뽑아내어 사용자의 기대를 만족시키기 위한 적절한 규칙지식베이스를 구축하고 문법 검사기의 성능 향상을 위해 문장 분석 출발점과 분석방향 그리고 분석범위를 한정한다.

  • PDF

A Probing Task on Linguistic Properties of Korean Sentence Embedding (한국어 문장 임베딩의 언어적 속성 입증 평가)

  • Ahn, Aelim;Ko, ByeongiI;Lee, Daniel;Han, Gyoungeun;Shin, Myeongcheol;Nam, Jeesun
    • Annual Conference on Human and Language Technology
    • /
    • 2021.10a
    • /
    • pp.161-166
    • /
    • 2021
  • 본 연구는 한국어 문장 임베딩(embedding)에 담겨진 언어적 속성을 평가하기 위한 프로빙 태스크(Probing Task)를 소개한다. 프로빙 태스크는 임베딩으로부터 문장의 표층적, 통사적, 의미적 속성을 구분하는 문제로 영어, 폴란드어, 러시아어 문장에 적용된 프로빙 테스크를 소개하고, 이를 기반으로하여 한국어 문장의 속성을 잘 보여주는 한국어 문장 임베딩 프로빙 태스크를 설계하였다. 언어 공통적으로 적용 가능한 6개의 프로빙 태스크와 한국어 문장의 주요 특징인 주어 생략(SubjOmission), 부정법(Negation), 경어법(Honorifics)을 추가로 고안하여 총 9개의 프로빙 태스크를 구성하였다. 각 태스크를 위한 데이터셋은 '세종 구문분석 말뭉치'를 의존구문문법(Universal Dependency Grammar) 구조로 변환한 후 자동으로 구축하였다. HuggingFace에 공개된 4개의 다국어(multilingual) 문장 인코더와 4개의 한국어 문장 인코더로부터 획득한 임베딩의 언어적 속성을 프로빙 태스크를 통해 비교 분석한 결과, 다국어 문장 인코더인 mBART가 9개의 프로빙 태스크에서 전반적으로 높은 성능을 보였다. 또한 한국어 문장 임베딩에는 표층적, 통사적 속성보다는 심층적인 의미적 속성을 더욱 잘 담고 있음을 확인할 수 있었다.

  • PDF

THE ROLE OF IMITATION IN CHILD LANGUAGE DEVELOPMENT : DISCUSSION OF RESEARCH METHODS (아동의 언어발달에서의 모방의 역할 : 각 이론에 따른 연구절차 분석)

  • Woo, Nam Hee
    • Korean Journal of Child Studies
    • /
    • v.13 no.1
    • /
    • pp.5-15
    • /
    • 1992
  • 아동의 언어습득 과정에서의 모방은 흔히 볼 수 있는 현상이지만 한편 인간의 독특하고 신기한 일면이기도 하다. 이 모방에 관하여 그동안 많은 연구들이 되어왔으나 그 중요성이나 역할에 대한 연구들의 결론이 모두 일치하는 것은 아니다. 본 논문에서는 이 모방현상에 대한 그 동안의 연구들을 이론별로 분류해 보고 각 이론들이 모방의 역할을 밝히기 위하여 사용해 온 연구방법, 절차들을 분석해 보았다. 행동주의와 사회학습이론에서는 언어습득에서의 모방의 역할을 특히 강조하고 있으며 이 모방의 효과를 입증하기 위하여 다른 어떤 이론보다도 훨씬 조직적인 실험연구를 해 왔다. 이와는 대조적으로, 언어 심리학적 접근에서는 언어습득에서의 생득성과 창의성을 강조하므로 모방의 역할은 중시하지 않으며, 모방의 정의를 엄격하게 규정하고 자연적인 관찰 중심의 연구를 주로 하여 언어습득에서의 모방의 역할이 미비하다는 결론을 내리고 있다. Piaget 중심의 인지발달적 접근에서는 모방을 인간의 전체 발달의 한 측면으로 보아 모방은 인지발달과 함께 점진적으로 발달되는 것으로 설명하고 있다. 특히 언어발달에서의 지연모방의 중요성을 강조하고 있으며, 대부분의 연구는 자연적인 관찰연구를 통하여 모방의 발달과정을 밝히고 있다. 언어발달에서의 모방의 역할에 대한 지금까지의 일치하지 않는 연구 결과들은 각각의 이론들이 나름대로 달리 모방을 정의하고, 언어의 다른 측면들을 다루어 왔기 때문으로 밝혀 졌다. 앞으로 언어발달이 아동의 발달 전체의 맥락 속에서 연구되어지고, 언어습득과정에서 보이는 아동들의 개인차까지도 고려되어지는 포괄적인 연구가 이루어지면 모방의 역할도 좀더 명백하고 일관성 있게 밝혀지리라 본다.

  • PDF

A Korean Grammar Chacker Founded on Expanded Lexical Disambiguation Rule and Partial Parsing (확장한 어휘적 중의성 제거 규칙에 따른 부분 문장 분석에 기반한 한국어 문법 검사기)

  • Park, Su-Ho;Kwon, Hyuk-Chul
    • Annual Conference on Human and Language Technology
    • /
    • 2001.10d
    • /
    • pp.516-522
    • /
    • 2001
  • 본 논문에서는 한국어 형태소 분석기가 처리할 수 없는 어휘적 중의성 해결을 위한 방법으로 부분 문장 분석 기법을 연구한다. 부분 문장 분석 기법의 신뢰도를 높이기 위해서 말뭉치를 이용한 데이터를 통해 학습한 경험적 규칙을 이용한다. 학습한 경험적 규칙을 오류 유형에 따라 확장하고 전문화하여 축적된 연구결과를 지식 베이스로 삼아 한국어 맞춤법 및 문법 검사기에서 사용하는 부분 문장 분석기의 성능을 향상시킨다. 본 논문에서 사용한 확장하고 전문화한 지식 베이스는 말뭉치에서 얻은 경험적 규칙을 기반으로 한다. 이 경험적 규칙은 언어적 지식을 기반으로 한다.

  • PDF

An Analysis of Linguistic Features in Science Textbooks across Grade Levels: Focus on Text Cohesion (과학교과서의 학년 간 언어적 특성 분석 -텍스트 정합성을 중심으로-)

  • Ryu, Jisu;Jeon, Moongee
    • Journal of The Korean Association For Science Education
    • /
    • v.41 no.2
    • /
    • pp.71-82
    • /
    • 2021
  • Learning efficiency can be maximized by careful matching of text features to expected reader features (i.e., linguistic and cognitive abilities, and background knowledge). The present study aims to explore whether this systematic principle is reflected in the development of science textbooks. The current study examined science textbook texts on 20 measures provided by Auto-Kohesion, a Korean language analysis tool. In addition to surface-level features (basic counts, word-related measures, syntactic complexity measures) which have been commonly used in previous text analysis studies, the present study included cohesion-related features as well (noun overlap ratios, connectives, pronouns). The main findings demonstrate that the surface measures (e.g., word and sentence length, word frequency) overall increased in complexity with grade levels, whereas the majority of the other measures, particularly cohesion-related measures, did not systematically vary across grade levels. The current results suggest that students of lower grades are expected to experience learning difficulties and lowered motivation due to the challenging texts. Textbooks are also not likely to be suitable for students of higher grades to develop the ability to process difficulty level texts required for higher education. The current study suggests that various text-related features including cohesion-related measures need to be carefully considered in the process of textbook development.