• 제목/요약/키워드: basic sentence patterns

검색결과 15건 처리시간 0.019초

술어기반 문형정보를 이용한 자동요약시스템에 관한 연구 (A Study on an Automatic Summarization System Using Verb-Based Sentence Patterns)

  • 최인숙;정영미
    • 정보관리학회지
    • /
    • 제18권4호
    • /
    • pp.37-55
    • /
    • 2001
  • 본 연구에서는 특정 주제분야의 텍스트를 대표할 수 있는 단어술어를 추출하고 기본문형을 형성 한 후 각 단서술어의 기본문형을 실례화하여 연결함으로써 요약문을 작성하는 자동요약시스템의 모형을 설계하고 구현하였다. 시스템은 학습과정과 요약과정을 구분되며, 학습과정에서는 술어와 격조사를 출현빈도를 이용하여 주제분야 텍스트집단을 대표하는 단어술어와 필수격 조사를 추출한 뒤 단어술어가 이루는 문장의 기본문형을 형성한다. 요약과정에서 실례화 규직을 요약 대상 문장의 구문 분석 결과에 적용하여 기본문형의 격조사와 결합될 논항을 찾아 단문을 생성하고 연결하여 요약문을 완성한다. ‘화재’및‘강도’와 관련된 신문기사를 대상으로 실험을 수행하였으며, 작성된 요약문은 단어술어가 포함된 주요 문장에서 추출한 필수 정보항목과 술어를 중심으로 생성된 문장들로서 문장간의 연결이 자연스러울 뿐 아니라 텍스트의 전체적인 의미를 표현할 수 있었다. 또한, 통계적 기법을 이용한 학습을 통해 주제영역의 확장이 가능하였다.

  • PDF

SPEECH SYNTHESIS USING LARGE SPEECH DATA-BASE

  • Lee, Kyu-Keon;Mochida, Takemi;Sakurai, Naohiro;Shirai, Katasuhiko
    • 한국음향학회:학술대회논문집
    • /
    • 한국음향학회 1994년도 FIFTH WESTERN PACIFIC REGIONAL ACOUSTICS CONFERENCE SEOUL KOREA
    • /
    • pp.949-956
    • /
    • 1994
  • In this paper, we introduce a new speech synthesis method for Japanese and Korean arbitrary sentences using the natural speech data-base. Also, application of this method to a CAI system is discussed. In our synthesis method, a basic sentence and basic accent-phrases are selected from the data-base against a target sentence. Factors for those selections are phrase dependency structure (separation degree), number of morae, type of accent and phonemic labels. The target pitch pattern and phonemic parameter series are generated using those selected basic units. As the pitch pattern is generated using patterns which are directly extracted form real speech, it is expected to be more natural than any other pattern which is estimated by any model. Until now, we have examined this method on Japanese sentence speech and affirmed that the synthetic sound preserves human-like features fairly well. Now we extend this method to Korean sentence speech synthesis. Further more, we are trying to apply this synthesis unit to a CAI system.

  • PDF

초등학교 예비교사들의 수학적 '문제 만들기'에 나타나는 문장의 오류 유형 분석 (Analysis on Sentence Error Types of Mathematical Problem Posing of Pre-Service Elementary Teachers)

  • 허난;신호철
    • 한국학교수학회논문집
    • /
    • 제16권4호
    • /
    • pp.797-820
    • /
    • 2013
  • 본 논문은 초등학교 예비교사 100명을 대상으로 수학적 '문제 만들기'의 문장에 나타나는 오류를 분석하고 그에 대한 간단한 예방책을 기술한 논의이다. '문제 만들기' 문장에는 '음운 오류, 단어 오류, 문장 오류, 의미 오류, 표기 오류' 등 5가지 오류 유형이 나타났다. 이를 다시 14개의 세부 유형으로 구분하여 세부적으로 논의하였다. 곧 음운 오류의 유형은 'ㄹ'첨가 오류와 조사끼리의 준말 사용 오류가 있다. 단어 오류는 크게 '부적절한 사용 오류'와 '부당한 생략 오류'로 구분하고 이를 다시 조사, 어미, 어휘의 사용 오류와 조사와 어휘의 부당한 생략 오류로 유형화하였다. 문장 오류는 '지시 대상의 오류, 문장 성분의 생략 오류, 어순 오류, 자체 비문'의 네 가지로 유형화하였다. 의미 오류는 논리적 모순 관계 오류와 중의성을 띄는 의미 오류에 대해서만 논의하였고, 표기 오류는 띄어쓰기와 문장 부호, 철자에 관한 한글 맞춤법 오류와 외래어 표기법 오류 등에 대하여 논의하였다. 또한 14개의 문법적 세부 오류 유형을 방지하기 위한 예방책을 제시하였다. 먼저 구어와 문어의 차이를 인식하고, 둘째 글을 쓰는 문어 상황에 맞도록 구어적 표현을 지양하도록 하는 것, 셋째 국어 기본 문형 학습에 대한 강조, 넷째 단어 의미의 명확한 이해를 바탕으로 한 의미의 논리적 전개 인식을 제안하였으며, 끝으로 국어 어문 규정에 대한 학습을 제안하였다. 그리고 대학생 글쓰기 교육에 대한 필요성에 대한 재인식을 결론으로 갈음하였다.

  • PDF

수학 문장제의 문장 구조와 해석상의 오류 분석 -초등학교 2학년을 중심으로- (An Analysis on Sentence Structures and Interpretation Errors in Word Problems in Mathematics -Focussing on the 2nd grade elementary students-)

  • 이병옥;안병곤
    • 한국초등수학교육학회지
    • /
    • 제12권2호
    • /
    • pp.185-204
    • /
    • 2008
  • 본 연구에서는 초등학교 2학년 수학 교과서에 제시된 문장제의 문장 구조와 해석상의 오류를 분석하고, 문장 구조가 해석상의 오류에 어떻게 관여하는지를 알아보았다. 이를 위해 초등학교 2학년 수학 교과서에 제시된 문장제 168문항의 문장 구조와 초등학교 2학년 160명의 학생을 대상으로 수학 문장제 해결과정에서의 오류경향을 분석한 결과, 문장제의 문장 구조는 쉽고 단순한 낱말이나 어휘를 반복적으로 사용하고 있으며, 과일이나 책, 사람 수 등의 특정한 실생활 소재를 반복적으로 많이 사용되고 있었다. 문장제의 오류 경향은 문장 해석상의 오류가 전체 오류의 51.56%로 계산상의 오류 39.20%보다 높았다. 이는 역연산(逆演算) 유형, 문장의 길이, 문제에 사용된 숫자의 개수 등이 해석상의 오류에 관여하는 것으로 분석되었다. 따라서 문장제의 문장을 구성할 때 교사의 관점에서 벗어나 학생들의 입장을 고려하는 것이 매우 중요하며, 학생들에게 기초적인 문장 해석 지도가 필요하다는 것을 알 수 있었다.

  • PDF

하위범주화에 의한 한국어 파싱 설계 (A Design of Korean Language Parsing based on Subcategorization)

  • 이호석
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2008년도 한국컴퓨터종합학술대회논문집 Vol.35 No.1 (C)
    • /
    • pp.242-247
    • /
    • 2008
  • 본 논문은 하위범주화에 의한 한국어 파싱의 설계를 논의한다. 우선, 기계 번역에 중요한 영향을 끼치는 한국어 문법구성 요소인 통사 범주, 조사, 어미, 통사적 접사, 의존 명사 등을 논의하고 하위 범주화와 표현 패턴을 논의한다. 다음에 간단한 한국어 파서의 기본 골격을 제시한다. 첫 번째 과정은 입력 단계로서 문장을 스캐닝(scanning) 하고 관사, 명사, 수사, 통사적 접사, 조사, 의존 명사, 어미활용, 형용사, 부사, 조동사 들을 처리한다. 두 번째 과정에서는 하위범주화 패턴과 표현 패턴을 처리한다. 세 번째 단계에서는 절을 처리하고, 네 번째 단계에서는 SEA(Sentence Ending+Auxiliary)를 처리한다.

  • PDF

백과사전 영역에서 중심어주도패턴에 기반한 문장주제 할당 기법 (A Sentence Theme Allocation Scheme based on Head Driven Patterns in Encyclopedia Domain)

  • 강보영;맹성현
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제32권5호
    • /
    • pp.396-405
    • /
    • 2005
  • 기존의 주제 관련 연구들은 문서에 자주 등장하는 용어를 주제로 간주하는 등 문서에서 다루는 주제에 대한 정의가 모호하다. 또한 문서를 구성하는 기본 단위인 문장의 주제가 문서 요약 및 정보 추출 등의 연구 분야에 중요하게 활용될 수 있음에도 불구하고, 이에 대한 고려 없이 문서 전체의 주제를 추출하고 할당하는 연구가 대부분이다. 따라서 본 논문에서는 문장 단위의 주제 처리에 대한 기본 연구로서, 백과사전 영역에서 효과적인 중심어주도패턴에 기반한 문장주제 할당 기법을 제안하였다. 두산동아 백과사전 인물분야 2,381문서를 대상으로 성능을 분석해본 결과, 제안된 기법이 비교기준보다 향상된 성능을 보였으며, 특히 제안된 네 가지 중심어주도 패턴 중 술어를 기반으로 구성된 중심어주도패턴 유형 4가 학습집합에 대하여 평균 $98.96\%$, 실험집합에 대하여 $88.57\%$의 성능(F-score)으로 주제할당에 가장 효과적임을 알 수 있었다.

자발화에 나타난 구문구조 발달 양상 (A Study on Syntactic Development in Spontaneous Speech)

  • 장진아;김수진;신지영;이봉원
    • 대한음성학회지:말소리
    • /
    • 제68권
    • /
    • pp.17-32
    • /
    • 2008
  • The purpose of the present study is to investigate syntactic development of Korean by analysing the spontaneous speech data. Thirty children(3, 5, and 7-year-old and 10 per each age group) and 10 adults are employed as subjects for this study. Speech data were recorded and transcribed in orthography. Transcribed data are analysed syntactically: sentence(simple vs complex) patterns and clause patterns(4 basic types according to the predicate) etc. The results are as follows: 1) simple sentences show higher frequency for the upper age groups, 2) complex sentences with conjunctive and embedded clauses show higher frequency for the upper age groups.

  • PDF

제주어 강세구의 억양 (The intonation patterns of accentual phrase in Jeju dialect)

  • 이숙향
    • 말소리와 음성과학
    • /
    • 제6권4호
    • /
    • pp.117-123
    • /
    • 2014
  • This study investigated the intonation patterns of accentual phrase in Jeju dialect. 9 speakers (Experiment 1) and 6 speakers (Experiment 2) read a carrier sentence '__ youngah miwonghumnida' with a target accentual phrase varying its number of syllables from 1 to 8. The results showed that like Seoul dialect pattern could be the basic pattern of accentual phase in Jeju dialect even though several differences were observed in the realization of each tone: Flat staircase-like tones in L, M, and even in H were often observed, and a very small difference in F0 between intial L and +H was found in many speakers. For some of these differences, this paper tried to give an explanation still in the Intonational Phonology framework. However, introducing M tone as a lexical tone was also suggested as one possible solution. Finally, unlike Seoul dialect, most speakers showed pattern in an accentual phrase beginning with a strong consonant, i.e., aspirated and unaspirated obstruents including /h/ and /s/.

내포문의 단문 분할을 이용한 한국어 구문 분석 (Korean Syntactic Analysis by Using Clausal Segmentation of Embedded Clause)

  • 이현영;이용석
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제35권1호
    • /
    • pp.50-58
    • /
    • 2008
  • 한국어 문장은 대부분 주절과 내포문을 가지는 복문으로 구성되어 있다. 따라서 복문에 나타나는 하나 이상의 용언으로 인해 구문 분석 과정에서 다양한 구문 애매성이 발생한다. 이들 중 대부분은 내포문의 수식 범위로부터 발생되는 구 부착의 문제 때문이다. 이런 구문 애매성은 내포문의 범위를 정해서 하나의 구문 범주의 기능을 가지도록 하면 해결할 수가 있다. 본 논문에서는 내포문의 범위를 정하기 위해서 문형과 한국어의 구문 특성을 이용한다. 먼저, 내포문에 있는 용언의 문형 정보가 가질 수 있는 필수격을 최대로 부착하여 내포문의 범위를 정하고 이를 이용해서 복문을 내포문과 주절로 분할한다. 그리고 한국어의 구문 특성을 이용해서 분할된 내포문의 기능을 하나의 구문 범주인 체언구나 부사구로 변환한다. 이렇게 함으로써 복합문의 구성 형태가 단문 구조로 변환되기 때문에 내포문의 범위에 의한 구 부착의 문제가 쉽게 해결된다. 이것을 본 논문에서는 내포문의 단문 분할이라고 한다. 본 논문에서 제안한 방법으로 1000 문장을 실험한 결과 문형과 단문 분할을 이용하지 않은 방법보다 구문 애매성이 88.32% 감소되었다.

다문화가정 이주여성의 운율구 경계짓기와 억양패턴 (Prosodic Phrasing and Intonation Patterns in the Speech of Migrant Women from Multicultural Families)

  • 정진숙;이숙향
    • 한국음향학회지
    • /
    • 제31권7호
    • /
    • pp.461-471
    • /
    • 2012
  • 본 연구는 다문화가정 이주여성의 운율구 경계짓기와 억양패턴에 대한 음향학적인 분석을 통하여 이주여성대상 한국어교육 프로그램 개발의 기초자료를 제공하고자 하였다. 대부분의 운율 특성에서 이주집단이 한국집단과 차이를 보였다. 한국집단은 첫 어절을 100% 강세구로 읽은 반면, 이주집단은 거의 억양구로 실현하였으며 이주여성들은 첫 분절음에 따라 달라지는 강세구의 첫 음조의 패턴 습득이 아직 제대로 이루어지지 않아 한국집단보다 훨씬 다양한 첫 어절의 억양패턴들을 보였다. 몇몇 운율 특성에서는 이주집단 간에도 차이를 보였으며 한국에서의 거주기간이 상대적으로 긴 필리핀집단이 베트남집단에 비해 상대적으로 한국집단에 가까운 특성을 보였다. 문장 내 평균 억양구수는 베트남집단이 필리핀집단보다 많았으며 가부의문문의 문미 경계음조는 필리핀집단은 한국집단처럼 'H%'로만 실현한 반면, 베트남집단은 'H%'뿐만 아니라 'HL%'로도 실현하였다.