• 제목/요약/키워드: Syntactic Analysis

검색결과 261건 처리시간 0.025초

A Simple Syntax for Complex Semantics

  • Lee, Kiyong
    • 한국언어정보학회:학술대회논문집
    • /
    • 한국언어정보학회 2002년도 Language, Information, and Computation Proceedings of The 16th Pacific Asia Conference
    • /
    • pp.2-27
    • /
    • 2002
  • As pact of a long-ranged project that aims at establishing database-theoretic semantics as a model of computational semantics, this presentation focuses on the development of a syntactic component for processing strings of words or sentences to construct semantic data structures. For design arid modeling purposes, the present treatment will be restricted to the analysis of some problematic constructions of Korean involving semi-free word order, conjunction arid temporal anchoring, and adnominal modification and antecedent binding. The present work heavily relies on Hausser's (1999, 2000) SLIM theory for language that is based on surface compositionality, time-linearity arid two other conditions on natural language processing. Time-linear syntax for natural language has been shown to be conceptually simple and computationally efficient. The associated semantics is complex, however, because it must deal with situated language involving interactive multi-agents. Nevertheless, by processing input word strings in a time-linear mode, the syntax cart incrementally construct the necessary semantic structures for relevant queries and valid inferences. The fragment of Korean syntax will be implemented in Malaga, a C-type implementation language that was enriched for both programming and debugging purposes arid that was particluarly made suitable for implementing in Left-Associative Grammar. This presentation will show how the system of syntactic rules with constraining subrules processes Korean sentences in a step-by-step time-linear manner to incrementally construct semantic data structures that mainly specify relations with their argument, temporal, and binding structures.

  • PDF

쉼표의 자동분류에 따른 중국에 장문분할 (Segmentation of Long Chinese Sentences using Comma Classification)

  • 김미훈;김미영;이종혁
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제33권5호
    • /
    • pp.470-480
    • /
    • 2006
  • 입력문장이 길어질수록 구문분석의 정확률은 크게 낮아진다. 따라서 긴 문장의 구문분석 정확률을 높이기 위해 장문분할 방법들이 많이 연구되었다. 중국어는 고립어로서 자연언어처리에 도움을 줄 수 있는 굴절이나 어미정보가 없는 대신 쉼표를 비교적 많이, 또 정확히 사용하고 있어서 이러한 쉼표사용이 장문분할에 도움을 줄 수 있다. 본 논문에서는 중국어 문장에서 쉼표 주변의 문맥을 파악하여 해당 쉼표위치에 문장분할이 가능한지 Support Vector Machine을 이용해 판단하고자 한다. 쉼표의 분류의 정확률이 87.1%에 이르고, 이 분할모델을 적용한 후 구문분석한 결과, 의존트리의 정확률이 5.6% 증가했다.

2-패스 색인 기법과 규칙 기반 질의 처리기법을 이용한 고속, 고성능 질의 응답 시스템 (A Fast and Powerful Question-answering System using 2-pass Indexing and Rule-based Query Processing Method)

  • 김학수;서정연
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제29권11호
    • /
    • pp.795-802
    • /
    • 2002
  • 본 논문은 2-패스 점수 부여 방법에 기초한 정답 후보 색인기를 이용하여 고속, 고정밀의 질의 응답을 실현하는 한국어 질의 응답 시스템을 제안한다. 제안한 정답 후보 색인기의 색인 과정은 다음과 같다. 먼저, 대상 문서에 포함된 모든 정답 후보들을 추출한다. 그리고, 2-패스 점수 부여 방법을 이용하여 각 정답 후보와 밀접하게 연관된 주변 내용어들에게 점수를 부여한다. 마지막으로 데이터베이스에 각 정답과 점수가 부여된 내용어들을 역파일 형태로 저장한다. 사용자의 질의에 포함된 의도(질의 유형)을 파악하기 위해서는 수동으로 구축된 lexico-syntactic 패턴을 이용한다. 이러한 색인 방법과 질의 처리 방법을 이용하여, 제안된 질의 응답 시스템은 빠른 응답 시간을 보장하고 정확률을 향상시킨다.

비문법적 실어증의 형태-통사론적 분석 (A morpho-syntactic analysis of agrammatic aphasia in Korean)

  • 김영주
    • 인지과학
    • /
    • 제9권1호
    • /
    • pp.41-46
    • /
    • 1998
  • 이 논문에서는 뇌졸중으로 인한 Broca 유형의 실어증 환자가 회복 초기와 회복이 진행됨에 따라 발화하는 서술어의 논항 구조적 속성이 정상 언어 집단의 서술어 분포와 어떻게 다르며, 또한 편으로는 전도 실어증 환자의 서술어 분포와는 어떻게 다른지 세 환자와, 조건이 비슷한 정상인의 자유 발화 산출 자료를 분석하여 비교한다. Broca 유형 실어증 환자가 발화하는 서술어 중에서 비대격 동사가 차지하는 비율을 언어간 비교해 본 결과, 영어 실어증 환자의 경우에는 계사가 아닌 비대격 동사에 심한 어려움을 겪어 거의 산출되어 못하는 것으로 나타난 반면(Kegl 1995), 한국어 실어증 환자의 경우에는 별다른 어려움을 겪지 않는 것으로 나타났다. 이에 대한 설명으로 영어의 비계사 비대격 구문에서는 d-구조와 s-구조 사이에서 동사에 상대적인 논항 이동이 일어나는 데 반해, 한국어에서는 격 부여라는 동기로 유발되는 그러한 논항 이동이 없거나, 설사 있더라도 공허하기(vacuous) 때문에 비문법적 실어증 환자들이 어려움을 느끼지 않으리라는 제안을 한다.

  • PDF

코퍼스 기반 한국어 합성기의 억양 구현 방안 (A Method of Intonation Modeling for Corpus-Based Korean Speech Synthesizer)

  • 김진영;박상언;엄기완;최승호
    • 음성과학
    • /
    • 제7권2호
    • /
    • pp.193-208
    • /
    • 2000
  • This paper describes a multi-step method of intonation modeling for corpus-based Korean speech synthesizer. We selected 1833 sentences considering various syntactic structures and built a corresponding speech corpus uttered by a female announcer. We detected the pitch using laryngograph signals and manually marked the prosodic boundaries on recorded speech, and carried out the tagging of part-of-speech and syntactic analysis on the text. The detected pitch was separated into 3 frequency bands of low, mid, high frequency components which correspond to the baseline, the word tone, and the syllable tone. We predicted them using the CART method and the Viterbi search algorithm with a word-tone-dictionary. In the collected spoken sentences, 1500 sentences were trained and 333 sentences were tested. In the layer of word tone modeling, we compared two methods. One is to predict the word tone corresponding to the mid-frequency components directly and the other is to predict it by multiplying the ratio of the word tone to the baseline by the baseline. The former method resulted in a mean error of 12.37 Hz and the latter in one of 12.41 Hz, similar to each other. In the layer of syllable tone modeling, it resulted in a mean error rate less than 8.3% comparing with the mean pitch, 193.56 Hz of the announcer, so its performance was relatively good.

  • PDF

운전자 사용자경험기반의 인지향상 시스템 연구 (Driver's Behavioral Pattern in Driver Assistance System)

  • 조두리;신동희
    • 디지털콘텐츠학회 논문지
    • /
    • 제15권5호
    • /
    • pp.579-586
    • /
    • 2014
  • 본 논문은 문맥-자유 문법 (context-free grammar)를 이용하여, 차선변경 상황에서의 운전자의 행동패턴 인식을 하는 방법을 제안하는 것을 목표로 한다. 문맥-자유-문법은 기존 패턴인식 방식과는 대조적으로 유한적 기호로는 쉽게 표현될 수 없는 특징들을 비교적 손쉽게 표현할 수 있다. 이 방식을 적용하여, 동시에 여러 특징을 각각 고려해야 하는 좌표기반 데이터 처리 대신 심볼 시퀀스 방식 (symbolic sequence)을 패턴화하기 위해 구문론적 방식을 적용한다. 이 방법은 운전자와 안전 운전 분야 연구자들에게 효율적이고 보다 직관적인 방법으로 보다 더 효과적인 수행에 도움이 된다. 본 연구의 향후과제로 보다 안정적인 인식률을 획득하기 위해 확률적 구문분석 방법을 적용할 계획이다.

복합명사 분할과 명사구 합성을 이용한 통합 색인 기법 (Integrated Indexing Method using Compound Noun Segmentation and Noun Phrase Synthesis)

  • 원형석;박미화;이근배
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제27권1호
    • /
    • pp.84-95
    • /
    • 2000
  • 본 논문에서는 명사구 색인과 복합명사 분할을 포함한 복합명사 처리를 위해 통계 정보와 자연언어 처리를 제한적으로 이용 가능하게 하는 통합적 색인 기법을 제안한다. 먼저 색인과 검색에서 복합명사 분할 및 합성 모두를 고려한 통합 기법을 제시하고, 이를 위해 통계 정보와 제한적인 자연언어 처리를 모두 이용하는 통합 색인 기법을 제안한다. 먼저 형태소 분석 및 태깅 과정에서 단일어를 색인어로 추출하고 구문분석의 결과에서 명사구를 합성해 낸다. 구문 분석 실패 시에는 형태소 분석 및 태깅의 결과만을 사용하게 된다. 또한 태깅의 결과에서 복합명사를 골라 통계 정보를 이용하여 단일 명사로 분할하고 재합성한다. 분할된 단일 명사와 합성된 명사구는 기존의 단일어로만 이루어진 색인어를 보완하기 위해 색인어로 사용된다. 실험은 한국어 정보검색의 실험 집합인 KTSET 2.0과 KRIST SET을 사용하여 통합색인 기법이 복합명사 처리에 효율적임을 보였다.

  • PDF

대규모 말뭉치와 전산 언어 사전을 이용한 의미역 결정 규칙의 구축 (Rule Construction for Determination of Thematic Roles by Using Large Corpora and Computational Dictionaries)

  • 강신재;박정혜
    • 정보처리학회논문지B
    • /
    • 제10B권2호
    • /
    • pp.219-228
    • /
    • 2003
  • 본 논문은 한국어정보처리 과정에서 구문 관계를 의미역으로 사상시키기 위한 규칙을 효과적으로 구축하는 방법을 제시하고 있다. 의미역의 결정은 의미 분석의 핵심 작업 중 하나이며 자연어처리에서 해결해야 하는 매우 중요한 문제 중 하나이다. 일반적인 언어학 지식과 경험만 가지고 의미역 결정 규칙을 기술하는 것은 작업자의 주관에 따라 결과가 많이 달라질 수 있으며, 또 모든 경우를 다룰 수 있는 규칙의 구축은 불가능하다. 하지만 본 논문에서 제시하는 방법은 대량의 원시 말뭉치를 분석하여 실제 언어의 다양한 사용례를 반영하며, 또 수십 명의 한국어 학자들이 심도 있게 구축하고 있는 세종전자사전의 격틀 정보도 함께 고려하기 때문에 보다 객관적이고 효율적인 방법이라 할 수 있다. 의미역을 보다 정확하게 결정하기 위해 구문관계, 의미부류, 형태소 정보, 이중주어의 위치정보 등의 자질 정보를 사용하였으며, 특히 의미부류의 사용으로 인해 규칙의 적용률이 향상되는 효과를 가져올 수 있었다.

초등 수학 교과서의 수학 용어 정의 및 문장제에 사용된 표현의 문장 복잡성 비교 분석 (A Comparative Analysis of the Word Depth Appearing in Representations Used in the Definitions of Mathematical Terms and Word Problem in Elementary School Mathematics Textbook)

  • 강윤지;백석윤
    • 한국초등수학교육학회지
    • /
    • 제24권2호
    • /
    • pp.231-257
    • /
    • 2020
  • 본 연구는 현행 초등 수학 교과서 내 주요 용어의 정의 및 단원평가의 문장제에 사용된 표현을 구문론적 관점에서 문장 복잡성(Yngve, 1960)에 따라 비교분석하였다. 분석 결과, 교과서 내 용어의 정의와 문장제에 사용된 표현에서 저학년 교과서의 문장 복잡성이 낮게 구성되었고, 각 용어의 개별 특성에 따라 문장 구조 및 형태가 서로 다르게 나타나며, 전반적으로 간결하며 문장 복잡성이 낮게 해당 용어의 정의 및 문장제가 서술되었고 용어 정의의 문장이 문장제의 문장보다 복잡하게 구성되었음을 알 수 있었다. 초등학생이 복잡한 문장으로 인하여 수학적 개념 학습의 어려움을 겪지 않도록 교과서 내 문장을 명확하게 서술하고, 적절한 시각적 자료를 함께 제시하며, 개별 학습자의 문해 수준에 알맞은 설명을 보다 섬세하게 고려하여 제공하는 등의 노력이 필요하다.

구문 분석과 Level Building을 이용한 한국어 연속음 인식 (The Recognition of Korean Continuous Speech using Syntactic Analysis and Level Building)

  • 안태옥;변용규;김순협
    • 한국음향학회지
    • /
    • 제5권4호
    • /
    • pp.27-36
    • /
    • 1986
  • 본 논문은 특정 화자에 대한 하국어 연속음의 효율적인 인식을 위하여, 구문분석과 OGS기법으 로 변형시킨 Level Building을 이용한 인식시스템에 대해서 제안하고 있다. 본 시스템에서 사용하는 template는 연속음을 분할시킨 단독음이며 소구간 경로 및 본 논문에서 제안한 전체 경로 제약에 의해 거리 계산값이 최소인 super reference를 구함으로써 인식된다. 본 연구에서 사용한 연속음은 단독음 11 자로 구성된 13개의 전철역명으로서 2인의 남성과 1인의 여성화자에 의해 10번씩 발음한 130단어를 테 스트하였는데 97.7%의 단어인식을 보였다.

  • PDF