• Title/Summary/Keyword: Korean Parser

Search Result 168, Processing Time 0.021 seconds

Korean Dependency Parser Using Subcategorization Information of Predicates (술어 하위범주화 정보를 이용한 한국어 의존 파서)

  • Jang, Myung-Gil;Lee, Hyun-A;Park, Jae-Deuk;Park, Dong-In;Hwang, Do-Sam
    • Annual Conference on Human and Language Technology
    • /
    • 1996.10a
    • /
    • pp.452-463
    • /
    • 1996
  • 의존 문법을 사용한 의존 파싱에서 기본적인 단어(품사정보)들 사이의 의존 관계 검사에 의한 파싱 방법은 불필요한 의존 관계의 생성을 가져온다. 이러한 과생성을 해결하기 위하여 파싱 단계에서 보다 정교한 의존 파싱을 통해서 불필요한 의존 관계의 생성을 최소한으로 줄이는 방법에 대한 연구가 필요하다. 본 논문은 의존 파싱에서 최소한의 의존 관계를 생성하기 위하여 후보 의존소가 지배가능경로 상에서 술어 지배소와의 의존 관계 검사 시에 술어의 하위범주화 정보를 이용하는 효율적인 의존 파싱 방법을 제안한다. 이것은 의존 파싱의 다음 처리 단계인 의존 제약의 적용에 훨씬 부담을 덜어 줄 수 있다.

  • PDF

MathML Based Browser for the Web Application

  • Kim, Sunghan;Min, Jae-Hong;Hoegyung Jung
    • Proceedings of the Korean Institute of Information and Commucation Sciences Conference
    • /
    • 2003.10a
    • /
    • pp.552-554
    • /
    • 2003
  • Recently, many kinds of XML based application services are widely used in internet. And the markets for mathml editor are needed for the technology combined with other text editor. We are developing a system for MathML based browser and editor for the service of internet application. MathML based browser is applicable for e-book service and many kinds of document system. This system is composed of document editing module and displaying processing module. This system isfor the processing of MathML tag by unexperienced users with MathML syntax. Users can edit the math tag's documentwith ease and efficiently. Based on XML, many parser's functions are optimized for the speed of document processing. This system ran afford to the development of internet world.

  • PDF

The Investigate of Human Strength Demand of Information Electrical the Kind of Occupation (정보전기 직종의 인력 수요에 대한 고찰)

  • Kim, Soo-Yong;Lee, Seung-Ho
    • Journal of Engineering Education Research
    • /
    • v.11 no.4
    • /
    • pp.58-63
    • /
    • 2008
  • This thesis investigated way of employment, education course of a training school of electrical company. And student more than. Faced a human power demand in an education demand and a field rehearsal student demand and and analyzed it. The sample extraction used industrial classification, work of scale, Assignment sample extraction way (quota Sampling). All data called at a silver phone and, and the investigated, The data parser analyzed the statistics that used Microsoft Excel.

Implementation of Dependency Parser using Argument Information based on Korean WordNet (한국어 어휘의미망에 기반한 논항 정보를 이용한 의존문법 구문분석기의 구현)

  • Im, Gyeong-Eop;Jung, Youngim;Kwon, Hyuk-Chul
    • Annual Conference on Human and Language Technology
    • /
    • 2007.10a
    • /
    • pp.158-164
    • /
    • 2007
  • 한국어는 한 어절이 한 개 이상의 형태소로 이루어졌으며, 이 때문에 지역 중의성이 발생한다. 대부분의 선행 연구에서는 이러한 지역 중의성을 배제하거나, 태거를 사용하여 지역 중의성을 제거해왔다. 본 연구에서는 문장의 모든 형태소 분석에 대해 구문분석을 시도하며, 중의성을 제거하고자 적용된 의존문법 규칙과 구 묶음, 부사 하위범주화, 논항 정보 사전 이용 등의 다양한 기법을 설명하고, 구문분석 성능을 실험으로 나타낸다. 특히, 말뭉치마다 논항 정보 사전을 따로 구축하는 번거로움을 피하고자 한국어 어휘의미망을 사용한다.

  • PDF

Shallow parser using Korean information (한국어 통사 및 의미 정보를 활용한 명사구 인식)

  • Han, Kyou-Youl;Ahn, Kwang-Mo;Seo, Young-Hoon
    • Annual Conference on Human and Language Technology
    • /
    • 2008.10a
    • /
    • pp.129-134
    • /
    • 2008
  • 본 논문에서는 한국어 문장의 통사적 특성과 제한된 통계정보를 이용한 명사구의 패턴에 의한 명사구 인식에 대해 기술한다. 본 논문의 명사구 인식기는 관형사와 관형격 조사, 관형형 어미에 관련된 패턴의 명사구 인식을 수행하고, 시간과 장소를 나타내는 특정한 명사에 의해 유도되는 명사구를 인식한다. 또한 복합명사 결합의 문제를 의미쌍 간의 결합도의 문제로 분류하고 해결방법을 제시한다. 실험 결과는 본 논문에서 제안하는 통사적으로 확실한 정보와 제한된 통계정보를 이용한 명사구 인식기가 높은 수준의 명사구 인식을 수행한다는 것을 보여준다.

  • PDF

A Description Technique and It's Simulation of Gate Level Digital Circuits (게이트 레벨 디지털 회로의 기술방법 및 시뮬레이션)

  • 권승학;이명호
    • Journal of the Korea Society of Computer and Information
    • /
    • v.4 no.4
    • /
    • pp.57-68
    • /
    • 1999
  • The purpose of this study is to build a description technique and to make a simulator, which can simulate and verify the behavior of gate level digital system. To get the object code from the input description language, we build a translator. To do this, we used YACC of the UNIX parser generator. and made an intermediate code in the mid-process between translator and simulator to extend the range of application. For experimental models. we used the Full-Adder and Modulo-3 Counter.

  • PDF

Improving Stack LSTMs by Combining Syllables and Morphemes for Korean Dependency Parsing (Stack LSTM 기반 한국어 의존 파싱을 위한 음절과 형태소의 결합 단어 표상 방법)

  • Na, Seung-Hoon;Shin, Jong-Hoon;Kim, Kangil
    • Annual Conference on Human and Language Technology
    • /
    • 2016.10a
    • /
    • pp.9-13
    • /
    • 2016
  • Stack LSTM기반 의존 파싱은 전이 기반 파싱에서 스택과 버퍼의 내용을 Stack LSTM으로 인코딩하여 이들을 조합하여 파서 상태 벡터(parser state representation)를 유도해 낸후 다음 전이 액션을 결정하는 방식이다. Stack LSTM기반 의존 파싱에서는 버퍼 초기화를 위해 단어 표상 (word representation) 방식이 중요한데, 한국어와 같이 형태적으로 복잡한 언어 (morphologically rich language)의 경우에는 무수히 많은 단어가 파생될 수 있어 이들 언어에 대해 단어 임베딩 벡터를 직접적으로 얻는 방식에는 한계가 있다. 본 논문에서는 Stack LSTM 을 한국어 의존 파싱에 적용하기 위해 음절-태그과 형태소의 표상들을 결합 (hybrid)하여 단어 표상을 얻어내는 합성 방법을 제안한다. Sejong 테스트셋에서 실험 결과, 제안 단어 표상 방법은 음절-태그 및 형태소를 이용한 방법을 더욱 개선시켜 UAS 93.65% (Rigid평가셋에서는 90.44%)의 우수한 성능을 보여주었다.

  • PDF

Performance Improvement of Dependency Parser using Syntactic Constraint Rules (통사적 제약규칙에 기반을 둔 의존문법 구문 분석의 성능 향상)

  • Nam, Woong;Kim, Hyemi;Kwon, Hyuk-Chul
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • 2013.05a
    • /
    • pp.353-355
    • /
    • 2013
  • 한국어는 어근의 형태가 변하는 굴절어인 영어와 달리, 한 어절이 어근과 접사가 결합하여 각자 고유한 의미를 지닌다. 이 때문에 하나의 어절에 대한 형태소 분석 후보가 여러 개가 나올 수 있어 구문 분석을 더욱 어렵게 만든다. 본 논문에서는 한국어의 통사적 특성에 적합한 의존문법을 이용하여 구분 분석을 수행한다. 모든 형태소 분석 후보에 의존관계를 부여하고 통사적 제약규칙을 통해 의존관계를 줄여나간다. 특히, 기존의 통사적 제약규칙에 형용사의 결합정보와 논항정보를 이용한 통사적 제약규칙을 추가하여 생성 가능한 의존관계의 수를 줄인다.

On-Line Recongnition of Handwritten Hangeul by Structure Analysis (구조해석에 의한 필기체 한글의 온라인 인식)

  • Hong, Sung Min;Kim, Eun Won;Park, Chong Kug;Cho, Won Kyung
    • Journal of the Korean Institute of Telematics and Electronics
    • /
    • v.23 no.1
    • /
    • pp.114-119
    • /
    • 1986
  • In this paper, an algorithm for the on-line recognition of handwritten Hangeul is proposed. The strokes are recognized by the minimum distance parser. The phonemes are separated by the finite-state automata resulted from the state graph of phonemes which are produced by the order of strokes. By simulation result for 3,000 characteristics in practical sentences, the recognition rate of strokes is obtained to be 98.5% and the separation rate of phonemes is obtained to be 92.5%.

  • PDF

Cascaded Parsing Korean Sentences Using Grammatical Relations (문법관계 정보를 이용한 단계적 한국어 구문 분석)

  • Lee, Song-Wook
    • The KIPS Transactions:PartB
    • /
    • v.15B no.1
    • /
    • pp.69-72
    • /
    • 2008
  • This study aims to identify dependency structures in Korean sentences with the cascaded chunking. In the first stage of the cascade, we find chunks of NP and guess grammatical relations (GRs) using Support Vector Machine (SVM) classifiers for all possible modifier-head pairs of chunks in terms of GR categories as subject, object, complement, adverbial, etc. In the next stages, we filter out incorrect modifier-head relations in each cascade for its corresponding GR using the SVM classifiers and the characteristics of the Korean language such as distance between relations, no-crossing and case property. Through an experiment with a parsed and GR tagged corpus for training the proposed parser, we achieved an overall accuracy of 85.7%.