• 제목/요약/키워드: Linguistic Features

검색결과 178건 처리시간 0.03초

아라비안 숫자를 동반한 중의적 기호의 자동전사: 온점, 쌍점, 빗금을 중심으로 (Automatic Transcription of Three Ambiguous Symbols Used with Arabic Numerals: Period, Colon and Slash.)

  • 윤애선;정영임;권혁철
    • 한국언어정보학회지:언어와정보
    • /
    • 제8권1호
    • /
    • pp.117-136
    • /
    • 2004
  • In this paper, we have proposed Auto- TSS, an automatic transcription module of three ambiguous symbols-period (.), colon (:) and slash (/)--using their linguistic contexts. Few previous studies have discussed the problems of ambiguities in reading those symbols into Korean alphabetic letters in order to improve the current Korean TTS (Text-To-Speech) systems. We have classified 9 different reading formulae of the three symbols, analyzed their left and right contexts, and investigated selection rules and distributions between the symbols and their contexts. Based on these linguistic features, 30 stereotyped patterns, 53 rules and 5 heuristics determining the types of reading formulae are investigated for Auto-TSS. This module works modularly in 4 steps. The pilot test was conducted with three test suites, which contain respectively 6,979, 3,491 and 2,450 morpheme clusters containing at least one of three ambiguous symbols and Arabic numeral(s). Encouraging results of 94.3%, 93.0%, 94.2% accuracy were obtained for the test suites. Our next phases are to develop a guessing routine for unknown contexts of the union symbols by using statistical information; to refine the proper nouns and terminology detecting module; and to apply Auto-TSS on a larger scale.

  • PDF

Linguistic and Stylistic Markers of Influence in the Essayistic Text: A Linguophilosophic Aspect

  • Kolkutina, Viktoriia;Orekhova, Larysa;Gremaliuk, Tetiana;Borysenko, Natalia;Fedorova, Inna;Cheban, Oksana
    • International Journal of Computer Science & Network Security
    • /
    • 제22권5호
    • /
    • pp.163-167
    • /
    • 2022
  • The article explores linguo-stylistic influence markers in essayistic texts. The novelty of this investigation is provided by its perspective. Essayism is looked at as a style of thinking and writing and studied as a holistic philosophical and cultural phenomenon, as a revalent form of comprehension of reality that features non-lasting author's judgements and enhancement of the author's voice in the text. Based on the texts by V. Rosanov, G.K. Chesterton, and D. Dontsov, the remarkable English, Russian, and Ukrainian essay-writers of the first party of the 20th century, the article tracks the typical ontological-and-existentialist correlation at the content, stylistic, and semantic levels. It is observed in terms of the ideas presented in the texts of these publicists and the lexicostylistic markers of the influence on the reader that enable these ideas to implement. The explored poetic syntax, key lexemes, dialogueness, intonational melodics, specific language, free associations, aphoristic nature, verbalization of emotions and feeling in the psycholinguistic form of their expression, stress, heroic elevation, metaphors and evaluative linguistic units in the ontological-and-existentialist aspects contribute to extremely delicate and demanding nature of the essayistic style. They create a "lacework" of unpredictable properties, intellectual illumination, unexpected similarity, metaphorical freshness, sudden discoveries, unmotivated unities.

A Study on the Syntagma & Paradigm by Repetition, Variation and Contrast in Ads

  • Choi, Seong-hoon
    • 예술인문사회 융합 멀티미디어 논문지
    • /
    • 제7권9호
    • /
    • pp.1-12
    • /
    • 2017
  • This study is the academic work to explore the potential meanings of print advertisements. Linguistic features such as repetition, variation, contrast and phonological structure in the verbal texts of ads can give rise to shades-of-meaning or slight variations in advertising. The language of advertising is not only language in words. It is also a language in images, colors, and pictures. Pictures and words combine to form the advertisement's visual text.. While the words are very important in delivering the sales message, the visual text cannot be ignored in advertisements. Forming part of the visual text is the paralanguage of the ad. Paralanguage is the meaningful behaviour accompanying language, such as voice quality, gestures, facial expressions and touch in speech, and choice of typeface and letter sizes in writing. Foregrounding is the throwing into relief of the linguistic sign against the background of the norms of ordinary language. This paper focuses its discussion on the advertisements within the framework of the paradigmatic and the syntagmatic relationship. The sources of ads have been confined to Malboro. The ads were reselected based on purposive sampling methods.

감성공학 문서 데이터의 지표 자동화를 위한 코퍼스 분석 기반 특성정보 추출 (Extraction of Informative Features for Automatic Indexation of Human Sensibility Ergonomic Documents)

  • 배희숙;곽현민;채균식;이상태
    • 감성과학
    • /
    • 제7권2호
    • /
    • pp.133-140
    • /
    • 2004
  • 최근 대량으로 쏟아지는 감성공학 연구 결과와 논문들을 가치 있는 자료로 만들기 위해서는 감성 데이터가 산업 전반에 활용될 수 있도록 지표로 정리해야 한다. 본 논문에서는 "웹기반 감성 데이터 베이스 구축 및 보급에 관한 연구" 과제를 통해 작성된 감성 데이터 지표에 입각해서 앞으로 대량으로 출현할 감성공학 데이터의 지속적인 지표화를 위한 과정의 자동화를 제안한다. 문서 데이터의 지표화 작업이 자동요약과 유사하다는 점에 착안하여 자동지표화 시스템을 위한 기술들의 기초가 되는 정보유형 및 주요어 추출, 특성표현을 통한 정보문 추출에 대해 감성공학 코퍼스 분석을 통해 연구하고자 한다. 이는 감성공학 분야에서의 지식관리 시스템이나 자동요약 시스템에 활용될 수 있다. 활용될 수 있다.

  • PDF

대기 중 물의 상태변화에 관한 중학생의 글에서 나타나는 의미관계 및 과학 언어적 특성에 관한 예비연구 (Preliminary Research about Semantic Relations and Linguistic Features in Middle School Students' Writings about Phase Transitions of Water in Air)

  • 정은숙;김찬종
    • 한국지구과학회지
    • /
    • 제31권3호
    • /
    • pp.288-299
    • /
    • 2010
  • 본 연구는 과학적 소양은 과학적 지식의 획득과 과학적 담화에 참여할 수 있는 언어적 능력을 통하여 길러진다는 전제하에 대기 중의 물의 상태변화에 관한 학생 글에서 나타나는 의미관계와 과학 언어적 특징을 알아보았다. 중학교 3학년 학생 67명이 참여하여 일상생활에서 흔히 경험할 수 있는 현상과 학교과학교육에서 체계적으로 배우는 현상 에 관한 두 개의 서술형 문항에 대한 글을 작성하였다. 연구의 결과 학생들은 '이슬점' 같은 생소한 용어뿐만 아니라 '수증기', '김' 등과 같은 친숙한 용어에 대해서도 잘못된 의미관계를 형성하고 있었고, 학교과학 교육보다 일상의 경험에서 형성된 지식에서 옳은 의미관계와 잘못된 의미관계 모두 더 많이 나타났다. 일상의 과학적 현상에 대해서는 행위와 절차를 중심으로 한 서술 양상이, 학교 교육에 의해 접하게 된 현상에 대해서는 전문용어와 명사구의 사용 양상이 보였다. 본 연구를 통하여 경험에 기초한 자발적 과정은 풍부한 의미관계 형성에, 형식적이고 이론적인 과정은 명사화를 중심으로 한 전문적이고 추상적인 서술의 측면에서 과학적 언어 능력 발달에 기여함을 알 수 있었다.

한국어와 영어 성별어 비교연구: 공손표현과 관련하여 (A Comparative Study on the Korean and English Genderlect: Focused on Polite Expressions)

  • 김현효
    • 한국산학기술학회논문지
    • /
    • 제16권10호
    • /
    • pp.6527-6533
    • /
    • 2015
  • 본 논문은 한국어와 영어 성별어(genderlect)에 관한 비교연구이다. 성별어란 성(gender)의 차이가 언어에 반영된 현상을 말한다. 일반적으로 여성의 언어가 남성의 언어와 다르며, 이러한 차이가 성차별의 원인이나 증거가 된다는 것에 초점이 맞추어져서 연구가 이루어져 왔다. 본 논문은 성별어 중 여성발화의 특성을 영어와 한국어의 영화와 드라마 대사를 분석하여 알아보고자 하였다. 영어자료에서는 여성어가 주로 어휘 즉, 명사, 형용사, 부사의 사용과 관련하여 나타났으나, 한국어 자료에서는 어휘 뿐 아니라 한국어 경어법의 최고단계인 '합쇼체'와 관련하여 여성이 익숙치 않다는 특성이 드러났다. 일반적으로 공손발화에서는 영어나 한국어 모두 여성발화가 공손표현의 특징과 유사한데, 한국 여성들은 경어법에서 아주높임단계를 선호하지 않는 것으로 나타났다. 한국어와 영어의 성별어의 특징이 공손표현이라는 측면에서는 일반적으로 공유하는 부분이 많지만, 한국 여성들의 경우에는 공손어법 중 경어법의 최고 단계인 '합쇼체'보다는 '해요체'를 선호하는 부분을 주목하였다. 이는 성별어의 세계 보편적인 특성과 개별 문화의 차이가 드러나는 부분이라 하겠다.

Performance Comparison of Korean Dialect Classification Models Based on Acoustic Features

  • Kim, Young Kook;Kim, Myung Ho
    • 한국컴퓨터정보학회논문지
    • /
    • 제26권10호
    • /
    • pp.37-43
    • /
    • 2021
  • 말소리의 음향 특징을 이용하여 화자에 대한 중요한 사회, 언어학적 정보를 얻을 수 있는데 그 중 한 가지 핵심 특징은 방언이다. 화자의 방언 사용은 컴퓨터와의 상호작용을 방해하는 주요 요소이다. 방언은 발화의 음소, 음절, 단어, 문장 및 구와 같이 다양한 수준에서 구분할 수 있지만 이를 하나하나 식별하여 방언을 구분하기는 어렵다. 이에 본 논문에서는 음성 데이터의 특성 중 MFCC만 사용하는 경량화된 한국어 방언 분류 모델을 제안한다. 한국인 대화 음성 데이터를 통해 MFCC 특징을 활용하는 최적의 방법을 연구하고, 8가지 머신 러닝 및 딥러닝 분류 모델에서 경기/서울, 강원, 충청, 전라, 경상 5개의 한국어 방언 분류 성능을 비교한다. MFCC를 정규화하는 방법으로 대부분의 분류 모델에서 성능을 향상시켰으며, MFCC를 정규화하기 전 분류 모델의 최고 성능과 비교하여 정확도는 1.07%, F1-score는 2.04% 향상된 성능을 기록하였다.

무역 중국어 담화 고찰과 한중 협상문화 비교 - '냅킨꽂이' 수입 관련 비즈니스 이메일을 중심으로 - (Discourse Analysis of Business Chinese and the Comparison of Negotiation Culture between Korea and China - Focused on Business Emails Related to 'Napkin Holder' Imports -)

  • 최태훈
    • 비교문화연구
    • /
    • 제50권
    • /
    • pp.103-130
    • /
    • 2018
  • 이 연구의 목표는 한국 구매자와 중국 공급자 사이에 주고받은 이메일을 분석 대상으로 삼아 무역 중국어 담화를 고찰하고 한 중 협상문화를 비교함에 있다. 연구 문제는 첫째, 이메일 비즈니스를 통해 보이는 무역 중국어 담화의 특징과 기능. 둘째, 이메일 비즈니스의 절차에 따른 중국어 무역 용어 분류. 셋째, 한 중문화 가치관에 따른 협상과 갈등 양상 비교이다. 연구 참가자는 한국 구매자 제임스와 중국 공급자 소냐이다. 분석대상은 거래 품목 냅킨꽂이를 주문, 생산, 수입하는 과정에서 교환 된 74개의 이메일로 한다. 연구의 발견은 다음과 같다. 첫째, 본 이메일 무역 중국어 담화는 필요시마다 몇 번에 걸쳐 반복적으로 진행되는 특징을 보여주었다. 더불어 무역 중국어 담화의 주요한 언어기능은 요청, 알려주기, 협상, 설득하기로 드러났다. 둘째, 본 이메일 무역에 집중적으로 사용된 중국어 어휘는 (1) 주문과 가격협상, (2) 원산지 표시, (3) 상품검사와 세관신고, (4) 무역 통관에 필요한 서류, (5) 포장과 운송 등으로 구분하여 설명하였다. 셋째, 한 중 문화적 가치관의 유사점과 차이점이 비즈니스 행위에 미치는 영향에 대해 협상과 갈등 양상을 중심으로 비교 고찰하였다. 한 중 비즈니스에서 상대방의 체면을 세워줌으로써 자신의 체면도 유지하는 협상 전략은 자기주장을 중시하여 상대방의 체면을 위협하거나 무관심한 서양의 협상 문화와는 뚜렷한 차이를 보인다. 나아가 무역 문서의 법적 문제와 관련한 담화에서는 한 중 양국의 불확실성 회피 전략의 큰 차이로 인한 갈등양상에 대해 고찰하였다. 이를 통해 우리는 한 중 무역에서 문화적 가치관이 당사자들의 행동 패턴에 영향을 미침으로 사전에 대책 마련이 중요함을 알 수 있게 되었다.

한중 자동 문서분류를 위한 최적 자질어 비교 (Comparison Between Optimal Features of Korean and Chinese for Text Classification)

  • 임미영;강신재
    • 한국지능시스템학회논문지
    • /
    • 제25권4호
    • /
    • pp.386-391
    • /
    • 2015
  • 본 논문에서는 한국어와 중국어의 언어학적인 특징을 고려하여 문서 자동분류 시스템의 성능을 높일 수 있는 최적의 자질어 단위를 제안한다. 언어 종속적 단위인 형태소 자질어와 언어 독립적 단위인 n-gram 자질어 그리고 이들을 조합한 복합 자질어 집합을 대상으로 각 언어의 인터넷 신문기사를 SVM으로 분류하는 실험을 수행하였다. 실험 결과, 한국어 문서분류에서는 bi-gram이 F1-measure 87.07%로 가장 좋은 분류 성능을 보였고, 중국어 문서분류에서는 'uni-gram 명사 동사 형용사 사자성어'의 복합 자질어 집합이 F1-measure 82.79%로 가장 좋은 성능을 보였다.

Conditional Random Fields를 이용한 영역 행위 분류 모델 (A Domain Action Classification Model Using Conditional Random Fields)

  • 김학수
    • 인지과학
    • /
    • 제18권1호
    • /
    • pp.1-14
    • /
    • 2007
  • 목적 지향 대화에서 사용자의 의도는 화행과 개념열의 쌍으로 구성된 영역 행위로 표현될 수 있다. 그러므로 지능적인 대화 시스템을 구성하기 위해서는 영역 행위를 정확히 파악하는 것이 매우 중요하다. 본 논문에서는 CRFs (Conditional Random Fields)를 이용하여 화행과 개념열을 동시에 결정하는 통계 모델을 제안한다. 편향 학습 문제를 피하기 위하여 제안한 모델은 어휘와 품사 같은 낮은 수준의 언어 자질을 입력 자질로 사용하며, 카이 제곱 통계량을 이용하여 불필요한 자질들을 제거한다. 일정 관리 영역에서 실험을 수행한 결과, 제안한 모델은 화행 분류 정착률에서 93.0%, 개념열 분류 정확률에서 90.2%의 좋은 성능을 보였다.

  • PDF