• 제목/요약/키워드: 문장 유형

검색결과 240건 처리시간 0.021초

연어 정보를 이용한 한국어 철자 검사기의 기능 개선 (Improvement of a Korean Speller with Collocation of Parts of Speech)

  • 심철민;김현진;김영진;권혁철
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1995년도 제7회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.86-90
    • /
    • 1995
  • 본 논문에서는 한 어절 단위에서 다수 어절 단위로 그 고려 영역을 확장한 개선된 철자 검사기를 제시한다. 개선된 철자 검사기는 1) 한 어절 철자 검사 교정부, 2) 언어 규칙 처리부, 3) 문장 부호 규칙 처리부로 구성된다. 한 어절 철자 검사 교정부는 기존의 철자 검사기와 같은 기능을 수행한다. 연어 규칙처리부는 형태소간의 연어 관계를 이용하여 7가지로 유형 분류된 어절 간 오류를 처리한다. 문장 부호 처리부는 문장 부호 자체의 오류와 문장 부호를 참조하여 좌우 어절들의 오류를 검사한다. 현재 256가지의 연이 규칙과 51가지의 문장 부호 규칙이 구축되어 있다. 본 논문에서 제시한 개선된 철자 검사기는 한국어 문체 검사기(Korean Style Checker) 로서 의의를 가지며, 형태소의 연어 정보는 향후 파싱 등의 문장 분석이나 의미 분석에 중요한 자료로 이용될 수 있을 것으로 기대된다.

  • PDF

한국어 관계절 문장의 이해 과정과 구조 (Comprehension Processes and Stuctures of Korean Relative Clause Sentence)

  • 김영진
    • 인지과학
    • /
    • 제6권2호
    • /
    • pp.5-27
    • /
    • 1995
  • 본 논문에서는 관계절 문장의 마디별 읽기 시간을 측정한 세 실험 결과를 종합하여 한국어 문장 해독의 처리 전략 및 수행 구조를 제안하였다. 첫째로,읽기 시간의 증가가 주로 명사 마디에서 일어났다는 결과에 근거해,한국어 해독이 명사 중심으로 이루어질 가능성에 대하여 논의하였다. 둘째로 문장 구조의 특성과 작업 기억의 부담을 읽기 시간의 증감과 관련지어 세가지 처리를 구분하였으며,병행기능 효과를 설명하기 위한 처리 전략을 제안하였다.셋째로 인접한 마디간의 읽기 시간의 차이에 기초해 관계절 문장 이해의 수행 구조를 제안하였다.이들 전략과 수행 구조는 관계절문장에서 보이는 마디별 읽기 시간의 변화를 잘 설명할 뿐만 아니라,현재 실험 자료가 없는 관계절 문장 유형에서 마디별 읽기 시간이 어떻게 나타날 것인지를 예측할 수 있게 한다.마지막으로 앞으로의 실험을 위한 여러 생각들을 논의 하였다.

  • PDF

채팅 시스템 구현을 위한 3단계 문장 검색 방법 (A three-step sentence searching method for implementing a chatting system)

  • 전원표;송영길;김학수
    • Journal of Advanced Marine Engineering and Technology
    • /
    • 제37권2호
    • /
    • pp.205-212
    • /
    • 2013
  • 기존 채팅 시스템은 일반적으로 사용자 입력 문장과 데이터베이스 내 목표 문장들 사이의 어휘 일치도에 기반을 둔 방법을 사용한다. 그러나 이러한 방법은 어휘 불일치 문제를 자주 일으킨다. 이러한 문제를 해결하기 위해 순차적으로 적용되는 3단계 문장 검색 방법을 제안한다. 첫 번째 단계는 어휘 수준에서 사용자 입력 문장과 목표 문장들 사이의 공통 키워드 열을 비교하는 것이다. 두 번째 단계는 의미 수준에서 사용자 입력 문장과 데이터베이스 내 문장들 사이의 문장 유형과 의미 표지를 비교하는 것이다. 마지막 단계는 미리 정의된 어휘-구문 패턴을 사용자 입력 문장과 매칭하는 것이다. 실험에서 제안된 방법은 단순 키워드 매칭 방법 보다 더 나은 응답 정확도와 사용자 만족도를 보였다.

명사화의 관점에서 수와 연산 영역의 교과서 문장제 분석 (Analysis of Word Problems in the Domain of 'Numbers and Operations' of Textbooks from the Perspective of 'Nominalization')

  • 장혜원;강윤지
    • 한국수학교육학회지시리즈C:초등수학교육
    • /
    • 제25권4호
    • /
    • pp.395-410
    • /
    • 2022
  • 명사화는 문법적 은유 중 하나로, 동적 표현을 명사 상당 어구를 통해 표현하는 것이다. 수학 문장제에서 명사화를 사용한 문장 표현은 수학화 단계에서 주목해야 할 대상을 분명하게 한다는 장점과 일상적 표현과 달리 문장의 이해를 어렵게 하고 온전한 수학적 모델링 단계의 경험을 저해한다는 단점을 모두 지닌다. 본 연구의 목적은 수학 학습시 학생들의 어려움을 야기하는 문장제 해결과 관련하여, 언어학적 요소인 명사화의 관점에서 교과서 문장제를 분석하고 시사점을 도출하는 것이다. 이를 위해 2015 개정 교육과정에 따른 초등학교 수학 교과서의 수와 연산 영역에 포함된 연산 관련 문장제 341개의 명사화 유형을 학년군별, 차시 활동과 단원 평가, 특화 차시별, 수식화에 대한 명시적인 요구 문장제의 네 가지 관점에서 분석하였다. 분석 결과에 기초하여 수학 문장제의 언어적 표현과 관련한 교수학적 시사점을 도출하였다.

수학 문장제의 명사화 여부에 따른 초등학교 3학년의 해결 과정 분석 (Analysis of the 3rd Graders' Solving Processes of the Word Problems by Nominalization)

  • 강윤지;장혜원
    • 한국수학교육학회지시리즈C:초등수학교육
    • /
    • 제26권2호
    • /
    • pp.83-97
    • /
    • 2023
  • 명사화는 문법적 은유 중 하나로, 수식으로 변환해야 하는 대상의 수학화를 용이하게 한다는 장점과 함께 복잡하고 압축된 문장 구성으로 인해 문장 이해를 어렵게 할 가능성이 있다는 단점이 있다. 이러한 명사화가 실제 학생들의 문장제 해결 과정에 어떠한 영향을 미치는지 파악하기 위하여 초등학교 3학년을 대상으로 명사화 여부에 따른 사칙연산 문장제 8개를 제공하여 검사를 실시하였다. 분석 결과, 문장제의 명사화 여부는 문제 이해 및 수식화 가능 여부에 의미 있는 영향을 미치지 못하였다. 그러나, 검사에 참여한 학생에게 명사화에 대한 사전 경험이 없음에도 불구하고 문제 이해 단계에서 명사화 또는 탈명사화가 나타나는 것을 확인하였으며, 명사화의 유형 변화가 발생하는 경우 성공 비율이 높게 나타나는 등 수식화 단계를 용이하게 하였다. 이를 통하여 명사화가 문장제의 문제 이해 및 수식화 단계에서 교수학적 전략으로 활용될 수 있으며 문장제의 학습에서 더 깊이 있는 이해를 유도할 수 있을 것으로 기대할 수 있다. 

Probing Sentence Embeddings in L2 Learners' LSTM Neural Language Models Using Adaptation Learning

  • Kim, Euhee
    • 한국컴퓨터정보학회논문지
    • /
    • 제27권3호
    • /
    • pp.13-23
    • /
    • 2022
  • Prasad et al.는 사전학습(pre-trained)한 신경망 L1 글로다바(Gulordava) 언어모델을 여러 유형의 영어 관계절과 등위절 문장들로 적응 학습(adaptation learning)시켜 문장 간 유사성(sentence similarity)을 평가할 수 있는 통사 프라이밍(syntactic priming)-기반 프로빙 방법((probing method)을 제안했다. 본 논문에서는 한국인 영어학습자가 배우는 영어 자료를 바탕으로 훈련된 L2 LSTM 신경망 언어 모델의 영어 관계절 혹은 등위절 구조의 문장들에 대한 임베딩 표현 방식을 평가하기 위하여 프로빙 방법을 적용한다. 프로빙 실험은 사전 학습한 LSTM 언어 모델을 기반으로 추가로 적응 학습을 시킨 LSTM 언어 모델을 사용하여 문장 임베딩 벡터 표현의 통사적 속성을 추적한다. 이 프로빙 실험을 위한 데이터셋은 문장의 통사 구조를 생성하는 템플릿을 사용하여 자동으로 구축했다. 특히, 프로빙 과제별 문장의 통사적 속성을 분류하기 위해 통사 프라이밍을 이용한 언어 모델의 적응 효과(adaptation effect)를 측정했다. 영어 문장에 대한 언어 모델의 적응 효과와 통사적 속성 관계를 복합적으로 통계분석하기 위해 선형 혼합효과 모형(linear mixed-effects model) 분석을 수행했다. 제안한 L2 LSTM 언어 모델이 베이스라인 L1 글로다바 언어 모델과 비교했을 때, 프로빙 과제별 동일한 양상을 공유함을 확인했다. 또한 L2 LSTM 언어 모델은 다양한 관계절 혹은 등위절이 있는 문장들을 임베딩 표현할 때 관계절 혹은 등위절 세부 유형별로 통사적 속성에 따라 계층 구조로 구분하고 있음을 확인했다.

ERP로 확인된 한국어 문장 이해과정에서의 통사 및 의미 처리특성 연구 (Syntactic and Semantic Integration Processes during Korean Sentence Comprehension: using ERPs as an neurophysiological index)

  • 김충명;이경민
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2004년도 제16회 한글.언어.인지 한술대회
    • /
    • pp.259-263
    • /
    • 2004
  • 본 연구는 머리어-후행언어(head-final language)로 분류되는 한국어의 통사 및 의미 처리 과정의 언어간(cross linguistic) 일반성과 언어내(intra-language) 특이성을 ERP(event- related potentials) 실험결과를 통해 알아보고자 하였다. 한국어 문장처리 과정에서의 통사 및 의미 처리특성은, 우선 이들을 지표하는 각각의 오류문을 통해 P600과 N400 이라는 언어일반의 처리과정을 보이면서도 각 성분의 영역분포는 오류가 출현된 위치에 따라 분기하고 있음을 관찰할 수 있었다. 곧, 문미위치의 술어오류에서 중심-두정 부위의 활성화 우세로 각 오류간 영역분화를 보이는 패턴을 새롭게 확인하였다. 이로써 오류의 유형별 재분류과정으로 드러난 오류출현 위치가 오류의 유형 내에 영향을 끼치는 한 변수가 될 수 있으며. 이는 이들 보어 및 술어를 구성하는 고유의 범주 특성으로 해석할 수 있는 근거가 될 수 있음도 아울러 확인하였다.

  • PDF

다중 작업 학습을 이용한 선박사고 형량 예측 모델 제작 (Developing a Model for Predicting of Ships Accident Using Multi-Task Learning)

  • 박호민;천민아;김재훈
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2020년도 제32회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.418-420
    • /
    • 2020
  • 해양에서의 선박사고 발생 횟수는 매년 꾸준히 증가하고 있다. 한국해양안전심판원에서는 이러한 사례들의 판결을 관련 인력들이 공유할 수 있도록 재결서를 제작하여 발간하고 있다. 그러나 선박사고는 2019년 기준 2,971건이 발생하여, 재결서만으로 관련 인력들이 다양한 사건들의 판례를 익히기엔 어려움이 따른다. 따라서 본 논문에서는 문장 표상 기법을 이용한 다중 작업 학습을 이용하여 선박사고의 사고 유형, 적용되는 법령, 형량을 분류 및 예측하는 실험을 진행하였다. USE, KorBERT 두 가지의 모델을 2010~2019년 재결서 데이터로 학습하여 선박사고의 사고 유형, 적용되는 법령, 형량을 분류 및 예측하였으며 그에 따른 정확도를 비교한 결과, KorBERT 문장 표상을 사용한 분류 모델이 가장 정확도가 높음을 확인했다.

  • PDF

한국어 맞춤법 교정을 위한 초거대 언어 모델의 잠재적 능력 탐색 (Examining the Feasibility of Utilizing a Large Language Model for Korean Grammatical Error Correction)

  • 구선민;박찬준;박정배;임희석
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2023년도 제35회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.61-65
    • /
    • 2023
  • 최근, 대부분의 태스크가 초거대 언어 모델로 통합되고 있을 정도로 많은 관심 및 연구되고 있다. 초거대 언어 모델을 효과적으로 활용하기 위해서는 모델의 능력에 대한 분석이 선행되어야 하나, 한국어에 대한 분석 및 탐색은 상대적으로 부족하다. 본 논문에서는 한국어 맞춤법 교정 태스크를 통해 초거대 언어 모델의 능력을 탐색한다. 맞춤법 교정 태스크는 문장의 구조 및 문법을 이해하는 능력이 필요하며, 사용자의 만족도에 영향을 미칠 수 있는 중요한 태스크이다. 우리는 맞춤법 세부 유형에 따른 ChatGPT의 제로샷 및 퓨샷성능을 평가하여 초거대 언어 모델의 성능 분석을 수행한다. 실험 결과 제로샷의 경우 문장부호 오류의 성능이 가장 우수했으며, 수사 오류의 성능이 가장 낮았다. 또한, 예제를 더 많이 제공할수록 전체적인 모델의 성능이 향상되었으나, 제로샷의 경우보다 오류 유형 간의 성능 차이가 커지는 것을 관찰할 수 있었다.

  • PDF

Maximum Entropy 모델을 이용한 나열 및 병렬형 인식 (Syntax Analysis of Enumeration type and Parallel Type Using Maximum Entropy Model)

  • 임수종;이창기;허정;장명길
    • 한국HCI학회:학술대회논문집
    • /
    • 한국HCI학회 2006년도 학술대회 1부
    • /
    • pp.1240-1245
    • /
    • 2006
  • 한국어 문장을 구조 분석할 때에 모호성을 발생시키는 유형 중의 하나가 나열 및 병렬형이다. 문장 구조 복잡도를 증가시키는 나열 및 병렬형을 구조 분석 전에 미리 하나의 단위로 묶어서 처리하는 것이 문장 구조 분석의 정확도를 높이는데 중요하다. 본 연구에서는 형태소 태그를 이용한 기본 규칙으로 문장을 청크 단위로 분할하고 분할된 청크 중에서 나열형을 인식하여 해당되는 청크들을 하나의 나열 청크로 통합하여 청크의 개수를 줄인다. 병렬형에 대해서는 반복되는 병렬 청크의 범위와 생략된 용언을 복원한다. 이러한 인식은 첫 단계로 기호(symbol)를 중심으로 구축된 간단한 규칙으로 인식을 하고 이러한 규칙에 해당되지 않는 형태의 나열 및 병렬형은 Maximum Entropy 모델을 이용하여 적용한다. ME모델은 어휘자질, 형태소 품사 자질, 거리 자질, 의미자질, 구 단위 태그 자질(NP:명사구, VP:동사구, AP:형용사구), BIO 태그(Begin, Inside, Outside) 자질에 대한 ME(Maximum Entropy) 모델을 이용하여 구축되었다.

  • PDF