• Title/Summary/Keyword: 검사어휘

Search Result 74, Processing Time 0.028 seconds

Morphological Analysis and Spelling Check Function of Korean Morphological Analyzer HAM (한국어 형태소 분석기 HAM의 형태소 분석 및 철자 검사 기능)

  • Kang, Seung-Shik;Lee, Ha-Gyu
    • Annual Conference on Human and Language Technology
    • /
    • 1996.10a
    • /
    • pp.246-252
    • /
    • 1996
  • 한국어 형태소 분석기의 효율성에 영향을 미치는 요인은 분석 알고리즘의 효율성보다도 어휘 사전 등 형태소 분석과 관련된 여러 가지 요인들이 미치는 영향이 훨씬 더 크다. 따라서 단어의 유형 분류 기법이나 불규칙 용언의 분석 방법을 비롯하여 어휘 사전의 구조 및 크기, 알고리즘의 선택과 구현 등 형태소 분석과 관련된 모든 요소들을 형태소 분석에 적합하도록 구성하여야 한다. 본 논문에서는 어휘형태소 사전과 문법형태소 사전의 크기, 한글 문서에 나타나는 단어의 특성 등 형태소 분석기의 효율 및 성능에 영향을 미치는 요소들을 고찰하였다. 그 결과로 알고리즘의 효율보다는 사전 탐색 시간이 형태소 분석에 미치는 영향이 매우 크다는 것을 알 수 있었다. 이와 같이 형태소 분석기의 성능에 영향을 미치는 요인들을 고려하여 구현된 범용 형태소 분석기 HAM에 대하여 형태소 분석 기능과 철자 검사 기능을 실험하였다. 형태소 분석 성공률에 대한 실험 결과 99.46%의 분석률을 보이고 있으며, 맞춤법 검사 기능으로는 상용화된 철자 검사기와 비슷한 성능을 보이고 있다. HAM의 처리 속도는 pentium 120MHz linux 2.0 환경에서 1 초에 약 1,000 단어를 분석한다.

  • PDF

Vocabulary Learning from Storybooks : Effects of a Teacher's Reading Strategy on Korean Preschoolers with Different Prior Word Knowledge (이야기책을 통한 취학 전 아동의 어휘력 발달에 관한 연구 : 개인차에 따른 교사 읽기 방법의 차별적 영향을 중심으로)

  • Han, Eun Hae
    • Korean Journal of Child Studies
    • /
    • v.22 no.1
    • /
    • pp.251-271
    • /
    • 2001
  • 교사가 이야기책을 반복하여 읽어주는 (a multiple reading) 과정에서 아동이 새로운 단어에 해당하는 그림을 보고 그 단어를 명명하게 하는 (a labeling strategy) 읽기 방법이 아동의 어휘획득에 연령과 경험에 따라 차별적인 효과를 가져오는가, 또한 동일한 읽기 방법이 그룹 상황에 적용되었을 때 일대일 상황에서 얻어지는 효과와 같은 효율성을 갖는가의 문제가 각각의 실험에서 다루어졌다. 양 실험에서 각 연령 (4, 5세) 집단은 그림 어휘력 검사의 표준 점수 결과를 기준으로 하여, 상 하 두 어휘력 집단으로 나뉘어졌다. 아동이 설정된 새로운 단어를 획득한 결과는 comprehensive와 productive 어휘력 검사를 통해 측정되었다. 첫 번째 실험에서 4세와 5세 아동들은 각 연령 집단에서 교사가 일 대 일로 이야기책을 읽어줄 때, 수동적으로 듣거나 또는 설정된 단어에 해당하는 그림을 보며 직접 명명할 수 있었다. 두 번째 실험에서는 첫 번째 실험에 참여한 4세 아동들이 같은 읽기 방법으로 그룹 상황에서 읽혀졌다. 첫 번째 실험 결과, 새로운 단어를 comprehend 하고 produce 하는데 5세 아동이 4세 아동 보다 나은 기제를 갖고 있는지는 분명히 밝혀지지 않았다. 결과를 통해 분명하게 밝혀진 것은 이야기책이 읽혀지는 동안 얻어지는 comprehensive 어휘와 productive 어휘에는 차이가 있다는 것이다. 아동들은, 특히 어릴수록, 새로운 단어를 comprehend 하는데 있어서는 labeling strategy의 효과를 보지 못한 반면, 단어를 produce 하는데 있어서는 동일한 방법이 단순한 반복 읽기 보다 효과적이었다. 덧붙여, 어휘력에 있어 상위 집단에 속한 아동이 하위 집단에 속한 아동 보다 더 많은 단어를 comprehend 하고 produce 한다는 점을 확인시켰다. 두 번째 실험 결과는 그룹 상황에서 4세 아동에게 이야기책을 읽어줌으로써 새로운 단어를 획득하게 할 수 있다는 것을 보여 주었다. 사용된 labeling strategy는 특히 productive 어휘 획득에 효과적인 것으로 나타났으며, 따라서 일대일 상황에서 뿐 아니라 그룹 상황에서도 중요한 요소로 보였다. 덧붙여, productive 어휘 획득에 있어서 labeling strategy의 효과는 어휘력에 있어 하위 집단에 속한 아동에게는 상황에 따라 다른 결과를 가져왔다. 즉, labeling strategy의 효과에 있어서 하위 집단의 아동들은 그룹보다 일대일 상황에서 productive 어휘를 더 많이 획득했다. 연구결과, productive 어휘력 발달을 위하여 교사는 일대일 책읽기 뿐 아니라 그룹 책 읽기에서도 labeling strategy를 사용하는 것을 고려해야 하며, 비교적 적은 어휘력을 갖고 있는 아동에게는 일대일 상황에서 labeling strategy를 사용하여 이야기책을 읽어주는 시간을 할당할 것을 제시했다.

  • PDF

Korean Writing Assistant System using Corpus Statistics (말뭉치의 통계정보를 이용한 한국어 글쓰기 도우미 시스템)

  • Lee, Jae-Seoung;Yu, Joo-Hyun;Lee, Hyun-Ho;Lee, Hyun Ah
    • Annual Conference on Human and Language Technology
    • /
    • 2015.10a
    • /
    • pp.206-208
    • /
    • 2015
  • 온라인을 통해 접하게 되는 잘못된 우리말 표현과 외국어 중심 교육 등으로 인하여 학생들의 한국어 능력, 특히 글쓰기 능력에 우려가 높아지고 있다. 본 논문에서는 잘 작성된 말뭉치에서 얻어진 데이터에 기반한 한국어 글쓰기 도우미 시스템을 제안한다. 시스템은 작성 중인 문맥에 맞은 단어를 추천하는 용언/체언 추천과 입력 문장의 주요 단어가 포함된 말뭉치의 문장을 제시하는 유사 문장 추천, 문서의 단어가 문서의 문맥 단어와 조화로운지를 확인하는 어휘 응집성 검사, 단어 중복도를 확인하기 위한 단어 빈도 검사 기능을 제공한다. 시스템에서는 사용자가 말뭉치를 추가하면 색인을 구축할 수 있어 원하는 분야에 맞는 추천과 검사 기능을 제공할 수 있다.

  • PDF

A Korean Grammar Chacker Founded on Expanded Lexical Disambiguation Rule and Partial Parsing (확장한 어휘적 중의성 제거 규칙에 따른 부분 문장 분석에 기반한 한국어 문법 검사기)

  • Park, Su-Ho;Kwon, Hyuk-Chul
    • Annual Conference on Human and Language Technology
    • /
    • 2001.10d
    • /
    • pp.516-522
    • /
    • 2001
  • 본 논문에서는 한국어 형태소 분석기가 처리할 수 없는 어휘적 중의성 해결을 위한 방법으로 부분 문장 분석 기법을 연구한다. 부분 문장 분석 기법의 신뢰도를 높이기 위해서 말뭉치를 이용한 데이터를 통해 학습한 경험적 규칙을 이용한다. 학습한 경험적 규칙을 오류 유형에 따라 확장하고 전문화하여 축적된 연구결과를 지식 베이스로 삼아 한국어 맞춤법 및 문법 검사기에서 사용하는 부분 문장 분석기의 성능을 향상시킨다. 본 논문에서 사용한 확장하고 전문화한 지식 베이스는 말뭉치에서 얻은 경험적 규칙을 기반으로 한다. 이 경험적 규칙은 언어적 지식을 기반으로 한다.

  • PDF

An English Essay Scoring System Based on Grammaticality and Lexical Cohesion (문법성과 어휘 응집성 기반의 영어 작문 평가 시스템)

  • Kim, Dong-Sung;Kim, Sang-Chul;Chae, Hee-Rahk
    • Korean Journal of Cognitive Science
    • /
    • v.19 no.3
    • /
    • pp.223-255
    • /
    • 2008
  • In this paper, we introduce an automatic system of scoring English essays. The system is comprised of three main components: a spelling checker, a grammar checker and a lexical cohesion checker. We have used such resources as WordNet, Link Grammar/parser and Roget's thesaurus for these components. The usefulness of an automatic scoring system depends on its reliability. To measure reliability, we compared the results of automatic scoring with those of manual scoring, on the basis of the Kappa statistics and the Multi-facet Rasch Model. The statistical data obtained from the comparison showed that the scoring system is as reliable as professional human graders. This system deals with textual units rather than sentential units and checks not only formal properties of a text but also its contents.

  • PDF

Analysis of Korean Compound Noun using Semantic Information (의미 정보를 이용한 한국어 복합명사 분석)

  • 김수남;원상현;권혁철;주종철;이상기
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 1998.10c
    • /
    • pp.195-197
    • /
    • 1998
  • 복합명사 분석은 조합이 자유롭고 제한이 없으므로 여러 가지 모호성을 발생시킨다. 이러한 모호성을 해결하는 기존 방법으로 사전을 이용하는 방법[2]과 통계적 정보를 이용하는 방법[3,4]이 있다. 본 논문에서는 하위 범주화된 어휘 정보를 가진 전자사전을 이용하여 복합명사를 분석한다. 그리고 어휘 정보만으로 처리했을 때 의미상으로 잘못된 분석이 발생할 수 있으므로 본 논문은 복합명사를 구성하는 어휘의 정보와 특정단어의 의미에 따른 복합명사 제약조건을 규칙베이스로 구축하여 분석에 이용한다. 또한 분석에 실패한 복합명사의 유형을 분석하여 각 유형에 따른 교정 방법도 제시한다. 실험 데이터는 부산일보, 교과서, 그리고 각종 문서에서 무작위로 추출한 27,945개의 복합명사를 사용하였다. 본 논문에서 제시한 의미적 제약조건을 이용하여 분석했을 때 복합명사로 잘못 쓴 어절의 검사율이 21% 향상되었다.

  • PDF

Semantic transparency effects in the learning of new words: An ERP study (의미 투명성이 단어 학습에 미치는 영향: 사건관련전위 연구)

  • Bae, Sungbong;Yi, Kwangoh;Park, Taejin
    • Korean Journal of Cognitive Science
    • /
    • v.27 no.3
    • /
    • pp.421-439
    • /
    • 2016
  • The present study investigates the effects of semantic transparency on the learning of new words using both behavioral measures and event-related brain potentials. Participants studied novel words with either semantically transparent or opaque definitions while their brain potentials were recorded. Learning performance was assessed with both a lexical decision task and a recall test. The results indicated that transparent novel words were easier to learn than opaque words. More specifically, self-paced learning times were shorter for transparent novel words across three study sessions. Transparent words also elicited reduced N400s compared with opaque words in all sessions. Moreover, lexical decisions to both learned novel words and real words were faster and more accurate within the transparent condition compared to the opaque condition. These results suggest that semantic transparency also plays an important role within word learning, just as within word recognition, further supporting the notion that morphological information is critical within lexical processing.

The Influence of Learner Factors on Foreign Language Vocabulary Learning: Negative Emotion and Working Memory (외국어 어휘 학습에서 학습자 요인의 영향: 부적 정서와 작업기억)

  • Min, Sungki;Lee, Yoonhyoung
    • The Journal of the Korea Contents Association
    • /
    • v.15 no.4
    • /
    • pp.545-555
    • /
    • 2015
  • We investigated the influence of negative emotion such as state-trait anxiety and depression and working memory (WM) on Foreign Language Vocabulary Learning (FLVL) of South Korean university students. Also, its implications for developing contents for FLVL were discerned. To do so, state-trait anxiety and depression inventories as well as four kinds of WM test were performed for 132 undergraduate students. Participants also had two semantic learning sessions for Swahili words. The mean scores of negative emotions were normal level. The results of structural equation modeling (SEM) showed that there was no effect of negative emotion on FLVL, while direct effects of the negative emotion on WM and the WM on FLVL were significant. Such results suggested that FLVL would be weakened, with the result that WM had been impaired by negative emotions. These outcomes suggested that when developing FLVL content for university students, it is necessary to consider the negative emotions of foreign language learners and to develop the contents for FLVL in the light of WM load.

A study on the predictability of acoustic power distribution of English speech for English academic achievement in a Science Academy (과학영재학교 재학생 영어발화 주파수 대역별 음향 에너지 분포의 영어 성취도 예측성 연구)

  • Park, Soon;Ahn, Hyunkee
    • Phonetics and Speech Sciences
    • /
    • v.14 no.3
    • /
    • pp.41-49
    • /
    • 2022
  • The average acoustic distribution of American English speakers was statistically compared with the English-speaking patterns of gifted students in a Science Academy in Korea. By analyzing speech recordings, the duration time of which is much longer than in previous studies, this research identified the degree of acoustic proximity between the two parties and the predictability of English academic achievement of gifted high school students. Long-term spectral acoustic power distribution vectors were obtained for 2,048 center frequencies in the range of 20 Hz to 20,000 Hz by applying an long-term average speech spectrum (LTASS) MATLAB code. Three more variables were statistically compared to discover additional indices that can predict future English academic achievement: the receptive vocabulary size test, the cumulative vocabulary scores of English formative assessment, and the English Speaking Proficiency Test scores. Linear regression and correlational analyses between the four variables showed that the receptive vocabulary size test and the low-frequency vocabulary formative assessments which require both lexical and domain-specific science background knowledge are relatively more significant variables than a basic suprasegmental level English fluency in the predictability of gifted students' academic achievement.

Ontology Mapping using Semantic Relationship Set of the WordNet (워드넷의 의미 관계 집합을 이용한 온톨로지 매핑)

  • Kwak, Jung-Ae;Yong, Hwan-Seung
    • Journal of KIISE:Databases
    • /
    • v.36 no.6
    • /
    • pp.466-475
    • /
    • 2009
  • Considerable research in the field of ontology mapping has been done when information sharing and reuse becomes necessary by a variety of ontology development. Ontology mapping method consists of the lexical, structural, instance, and logical inference similarity computing. Lexical similarity computing used in most ontology mapping methods performs an ontology mapping by using the synonym set defined in the WordNet. In this paper, we define the Super Word Set including the hypenym, hyponym, holonym, and meronym set and propose an ontology mapping method using the Super Word Set. The results of experiments show that our method improves the performance by up to 12%, compared with previous ontology mapping method.