• Title/Summary/Keyword: 어휘 분석

검색결과 864건 처리시간 0.025초

의미 정보를 이용한 한국어 복합명사 분석 (Analysis of Korean Compound Noun using Semantic Information)

  • 김수남;원상현;권혁철;주종철;이상기
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 1998년도 가을 학술발표논문집 Vol.25 No.2 (2)
    • /
    • pp.195-197
    • /
    • 1998
  • 복합명사 분석은 조합이 자유롭고 제한이 없으므로 여러 가지 모호성을 발생시킨다. 이러한 모호성을 해결하는 기존 방법으로 사전을 이용하는 방법[2]과 통계적 정보를 이용하는 방법[3,4]이 있다. 본 논문에서는 하위 범주화된 어휘 정보를 가진 전자사전을 이용하여 복합명사를 분석한다. 그리고 어휘 정보만으로 처리했을 때 의미상으로 잘못된 분석이 발생할 수 있으므로 본 논문은 복합명사를 구성하는 어휘의 정보와 특정단어의 의미에 따른 복합명사 제약조건을 규칙베이스로 구축하여 분석에 이용한다. 또한 분석에 실패한 복합명사의 유형을 분석하여 각 유형에 따른 교정 방법도 제시한다. 실험 데이터는 부산일보, 교과서, 그리고 각종 문서에서 무작위로 추출한 27,945개의 복합명사를 사용하였다. 본 논문에서 제시한 의미적 제약조건을 이용하여 분석했을 때 복합명사로 잘못 쓴 어절의 검사율이 21% 향상되었다.

  • PDF

사회적 이슈 리스크 유형 분류를 위한 어휘 자질 선별 (Linguistic Features Discrimination for Social Issue Risk Classification)

  • 오효정;윤보현;김찬영
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제5권11호
    • /
    • pp.541-548
    • /
    • 2016
  • 사용자의 다양한 의견을 수렴하고 모니터링하기 위한 정보원으로써 소셜미디어의 활용은 이미 필수가 되었다. 본 논문은 소셜미디어에 나타난 다양한 이슈 중 여론 형성에 악영향을 끼치는 부정적 사건을 이슈 '리스크'로 정의, 그 세부 유형을 자동으로 분류하는 모델을 개발하고자 한다. 이를 위해 소셜미디어에 나타난 다양한 어휘 자질을 선별, 그 효과를 규명하였다. 특히 리스크 문장의 어휘 구문 특징을 표현하기 위한 자질로 워드 임베딩 학습 결과를 활용한다. 개별 어휘 자질의 특징을 분석하기 위해 언어분석 오류를 보정한 환경에서 수행한 실험 결과, 가장 효과가 큰 자질은 개체명 자질로 분석되었으며, 기본 어휘 자질을 기반으로 주요 술부의 워드 임베딩 결과와 워드 클러스터 결과를 모두 조합한 경우가 최고 성능을 보이는 것으로 파악되었다. 실제 소셜빅데이터에 적용하는 환경과 유사하도록 자동 언어분석 결과의 오류를 포함한 조건에서 실험한 결과, 고빈도 평가셋에서는 92.08%의 성능을, 전체 58개 범주 평가셋에서는 85.84%의 성능을 얻었다.

브렉시트 캠페인 기간 동안 영어 미디어에 나타난 이민자들 (Migrant Representation in the English-language Media during the Brexit Campaign)

  • 이재승
    • 비교문화연구
    • /
    • 제45권
    • /
    • pp.325-348
    • /
    • 2016
  • 본 논문은 브렉시트 캠페인 기간 동안 영어권 국가, 영국, 미국, 캐나다, 그리고 호주의 미디어에서 이민자들이 어떻게 표현되는지 살펴본다. 코퍼스 지원 담화연구의 틀을 사용한 본 연구는 브렉시트 국민투표 캠페인이 시작된 날부터 국민투표가 실시되기 전 날까지(2016년 4월 15일-6월 22일) 검색기간으로 설정하고, 검색어 'Brexit'가 포함된 모든 기사를 수집하여 브렉시트 캠페인 코퍼스를 구축하였다. 수집된 코퍼스 자료를 통해서 이민자를 나타내는 어휘들, IMMIGRANT, MIGRANT, 그리고 REFUGEE의 빈도를 관찰하고, 이 어휘들과 함께 나타나는 연어를 분석하였다. 또한 세 어휘의 연어들을 사회적 행위자 범주에 따라 분류 및 분석하였다. 분석 결과, IMMIGRANT의 연어는 법적 상태 및 출신지역 어휘들과 연관성이 있고, MIGRANT는 경제적인 용어들과 주로 연어 관계에 있으며, REFUGEE는 큰 수를 나타내는 어휘와 관련성이 있는 것으로 나타났다. 그리고 이민자들은 기능범주, 유형범주, 그리고 평가범주를 통해서 묘사되며, 특히 영국과 미국의 미디어에서 이민자들이 부정적으로 그려지고 있는 것으로 관찰되었다. 본 연구를 통하여 특정 현상 및 특정 집단의 사람들을 가리킬 때 특정 어휘가 사용되며, 코퍼스 지원 언어분석이 해당 사회의 사회 문화 정치적 상황을 파악하는데 도움이 된다는 것을 확인할 수 있었다.

아바타의 실시간 표정변환을 위한 감정 표현 어휘 분석에 관한 연구 (A Study on the Analysis of Emotion-expressing Vocabulary for Realtime Conversion of Avatar′s Countenances)

  • 이영희;정재욱
    • 디자인학연구
    • /
    • 제17권2호
    • /
    • pp.199-208
    • /
    • 2004
  • 인터넷이라는 가상의 공간에서 사람들은 공동체를 형성하며 서로 상호작용 한다. 이러한 사이버 공간에서 아바타(Avatar)의 존재는 자신을 표현하는 분신일 뿐만 아니라 가상공간에서 나를 표현하는 '또 하나의 나'로서 의미를 부여한다. 자신의 생각에 따라 표정 짓고 행동하는 아바타를 보며 사용자가 느끼는 현실감은 실로 크다고 할 수 있다. 따라서 아바타 기반 채팅 커뮤니케이션에서 문자 입력만으로 아바타의 표정이 애니메이션 될 수 있다면 사용자간의 커뮤니케이션에 더욱 효과적인 감정 전달이 가능할 것이다. 본 연구는 채팅시 사용자에 의해 입력되는 단어들에 의해 아바타가 스스로 반응하는 시스템을 위해 요구되는 감정 표현 어휘들을 분류 분석하였다. 분류 분석한 결과는 다음과 같다. 첫째, 한국어의 형용사와 자동사에서 추출한 감정 표현 어휘는 25개 그룹 209단어로 분류할 수 있었다. 둘째, 25개의 감정 표현 어휘 그룹 중 긍정적인 표현은 단 2개(좋다, 혹하다)이고 나머지 23개는 모두 부정적인 감정 표현 어휘들이다. 따라서 한국어에는 긍정적인 감정 표현 어휘보다는 부정적인 감정 표현 어휘가 더 발달되어 있다는 것을 알 수 있었다. 셋째, 분류된 25개의 감정 표현 어휘들을 수량화이론III류 분석하여 아바타의 표정을 제작한 결과 감정 표현 어휘들과 아바타 표정이 밀접한 관련성을 지니고 있어 사용자의 감정을 표현하는데 있어 유용하다는 것을 명확히 하였다. 하지만 국어 언어학적 구조 즉, 문맥 전체의 의미를 정량적 관계로 해석해 내지 못하는 등 실험의 한계성을 지니고 있다.

  • PDF

어휘인출과 구어동반 제스처의 관계 (The Relationship between Lexical Retrieval and Coverbal Gestures)

  • 하지완;심현섭
    • 인지과학
    • /
    • 제22권2호
    • /
    • pp.123-143
    • /
    • 2011
  • 본 연구의 목적은 구어동반 제스처가 어휘인출과정의 개념화와 어휘화 가운데 어떠한 단계와 관계가 있는지를 알아보고자 하는 것이다. 제스처와 발화 분석을 위하여, 모 방송국의 TV 버라이어티 프로그램 중 제시된 목표단어의 의미를 설명하여 전화상대방이 그 단어의 이름을 맞추게 하는 게임의 동영상 자료를 이용하였다. 분석자료로 이와 같은 TV 자료를 선택한 이유는 프로그램의 게임과제가 어휘인출의 개념화 과정과 어휘화 과정을 동시에 유도할 수 있는 과제로 판단되었기 때문이다. 20회의 동영상 자료를 재생하여 목표단어와 목표단어 설명과정에서 출연자들이 산출한 발화를 전사하고, 출연자들이 사용한 제스처를 어휘 제스처(lexical gesture)와 운동 제스처(motor gesture)로 구분하여 기록하였다. 구어동반 제스처가 어휘인출과정의 개념화와 관계가 있는지 알아보기 위하여, 구체적 단어와 추상적 단어 설명 시 동반된 제스처의 사용양상이 다른지, 그리고 단어 개념의 난이도와 제스처 양 사이에 상관관계가 있는지 분석하였다. 제스처가 어휘인출과정의 어휘화와 관계가 있는지 알아보기 위하여, 출연자가 목표단어 설명 시 산출한 발화의 단어 양과 제스처 양, 그리고 저빈도어 비율과 제스처 양 사이의 상관관계를 각각 살펴보았다. 연구결과 단어 개념의 심상성(imageability)에 따라 유의하게 많이 동반되는 제스처가 다르다는 것을 알 수 있었다. 즉 구체적 단어 설명 시에는 추상적 단어 설명 시보다 어휘 제스처가 유의하게 많이 동반되었고, 추상적 단어 설명 시에는 구체적 단어 설명 시보다 운동 제스처가 유의하게 많이 동반되었다. 또한 구체적 단어의 경우 개념의 난이도와 제스처 양 사이에 유의한 상관관계가 있었다. 그러나 목표단어 설명 시 산출된 발화의 단어 양과 제스처 양, 저빈도어 비율과 제스처 양 사이에는 상관관계가 나타나지 않았다. 본 연구의 결과는 구어동반 제스처가 어휘인출과정의 개념화부를 반영한다는 것을 시사한다. 뿐만 아니라 이제까지 많은 연구들에서 간과되어 왔던 운동 제스처의 기능에 대한 새로운 접근을 시도하였다는 점에서 본 연구는 의의가 있을 것이다.

  • PDF

소셜 데이터에서 재난 사건 추출을 위한 사용자 행동 및 시간 분석을 반영한 토픽 모델

  • 촐몽 바야르;이경순
    • 정보와 통신
    • /
    • 제34권6호
    • /
    • pp.43-50
    • /
    • 2017
  • 본고에서는 소셜 빅데이터에서 공공안전에 위협되고 사회적으로 이슈가 되는 재난사건을 추출하기 위한 방법으로 소셜 네트워크상에서 사용자 행동 분석과 시간분석을 반영한 토픽 모델링 기법을 알아본다. 소셜 사용자의 글 수, 리트윗 반응, 활동주기, 팔로워 수, 팔로잉 수 등 사용자의 행동 분석을 통하여 활동적이고 신뢰성 있는 사용자를 분류함으로써 트윗에서 스팸성과 광고성을 제외하고 이슈에 대해 신뢰성 높은 사용자가 쓴 트윗을 중요하게 반영한다. 또한, 트위터 데이터에서 새로운 이슈가 발생한 것을 탐지하기 위해 시간별 핵심어휘 빈도의 분포 변화를 측정하고, 이슈 트윗에 대해 감성 표현 분석을 통해 핵심이슈에 대해 사건 어휘를 추출한다. 소셜 빅데이터의 특성상 같은 날짜에 여러 이슈에 대한 트윗이 많이 생성될 수 있기 때문에, 트윗들을 토픽별로 그룹핑하는 것이 필요하므로, 최근 많이 사용되고 있는 LDA 토픽모델링 기법에 시간 특성과 사용자 특성을 분석한 시간상에서의 중요한 사건 어휘를 반영하고, 해당이슈에 대한 신뢰성 있는 사용자가 쓴 트윗을 중요시 반영하도록 토픽모델링 기법을 개선한 소셜 사건 탐지 방법에 대해 알아본다.

의존 문법과 대조 의미론을 이용한 한국어의 어휘적 중의성 해결 시스템 (Lexical Ambiguity Resolution System of Korean Language using Dependency Grammar and Collative Semantics)

  • 윤근수;권혁철
    • 인지과학
    • /
    • 제3권1호
    • /
    • pp.1-24
    • /
    • 1991
  • 본 논문은 한국어의 어휘적 중의성을 해결하는 시스템을 보여준다. 이 시스템은 의존 문법과 대조 의미론을 이용하고 있다. 의존 문법은 두 형태소 사이의 의존관계에 의하여 문장을 분석한다. 대조 의미론은 어휘적 중의성과 의미관계의 상호작용을 조사한다. 대조 의미론은 의미 프레임,의미 백터,대조,분류의 4개의 구성요소로 이루어진다. 본 시스템은 C 언어로 구성되었으며, 문자을 분석 학과 두 단어간의 의미 관계를 조사하며 어휘적 중의성을 해결한다.

움직임에서의 감성 효과 (The Effect of Sensibility on Motion)

  • 임은영;한광희
    • 한국인지과학회:학술대회논문집
    • /
    • 한국인지과학회 2002년도 춘계학술대회
    • /
    • pp.236-240
    • /
    • 2002
  • 기존의 감성 연구들은 주회 배색이나 형태등과 관련된 정적인 장면 위주로 수행되었다. 기술의 발달로 역동적인 디스플레이가 가능해지면서 동적인 장면을 대상으로 한 감성연구의 필요성이 요구된다. 본 연구에서는 움직임과 관련된 감성어휘를 추출하여 감성 차원을 밝히고 움직임과 관련된 속성을 살펴보았다. 다양한 방법을 통해 수집된 감성어휘를 적절성 평가를 통해 70개로 정리한 뒤 요인분석을 통해 각 요인을 대표하는 19개의 기본 감성 어휘를 추출하였다. 움직임 패턴을 제시하면서 19개의 감성어휘를 기초로 움직임에서 의 감성을 평정하도록 하였다. 다차원 척도법을 이용하여 분석한 결과 움직임에 대한 감성 차원은 '적극적이다-소극적이다'의 차원과 ‘밝다-어둡다’의 두 차원으로 대부분 설명 될 수 있음을 확인하였다. 움직이는 속도와 진행 경로를 변화시키면서 두 가지 감성 차원에 따라 움직임에서의 감성을 평가하도록 하였다. 움직이는 속도와 곡선 경로의 진폭이 움직임에서의 감성 차원을 결정하는 중요한 요소로 작용하는 경향을 보였다.

  • PDF

확률적 언어 모델을 위한 자료 기반 어휘 구축 (A data-driven approach for lexicon selection for probabilistic language model)

  • 류성호;김진형
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2002년도 제14회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.3-8
    • /
    • 2002
  • 한국어를 대상으로 하는 확률적 언어 모델에서는 대부분의 경우 형태소를 기본 어휘로서 사용하고 있다. 그러나, 이러한 모델들은 학습 및 검증을 위하여 사람에 의하여 형태소 분석이 이루어진 말뭉치를 필요로 한다. 또한, 형태소의 자동 분석은 현재 표준말을 중심으로 이루어져 있어 그 적용 분야에도 한계가 있다. 본 논문에서는 한국어의 특징을 고려하여 확률적 언어 모델의 구축에 적합한 어휘의 선택 기준에 대하여 고찰하고, 통계적인 기준을 통하여 확률적 언어 모델의 어휘를 구축하는 방법을 제안한다.

  • PDF

모바일 웹 기반의 면접 환경 개선을 위한 감성어휘 분석 모형 설계 (Design of Emotional Vocabulary Analysis Model for Interview Environment Enhancement Based on Mobile Web)

  • 김용우;박석천;홍석우;김태엽
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2013년도 추계학술발표대회
    • /
    • pp.1038-1041
    • /
    • 2013
  • 모바일의 발전과 확산으로 인해 모바일 웹의 필요성이 높아지고 있으며 사용성과 접근성이 용이한 웹 기반에서 인적자원 시스템이 구축되고 있는 사례가 많아지고 있다. 인적자원과 관련된 모바일 애플리케이션 개발과 활용성에 대한 연구가 여러 기업에서 진행 중이며 국내외 인적 자원 시스템을 개발하고 있는 기업들은 모바일을 활용하여 인적자원 시스템에 다양한 각도에서 접근하기 위해 노력하고 있다. 본 논문은 모바일 웹 기반의 인사 시스템에서 감성 어휘를 구축하여 면접자가 면접을 통해 받은 감성이나 인상에 대한 정보를 면접자의 모바일을 통해 설문지 형태로 모바일 웹 기반으로 한 채용 시스템에 입력하게 한다. 입력된 정보는 감성 어휘의 특정 형용사를 기준으로 구축된 감성 사전을 통해 면접 환경 개선에 필요한 정보들을 시각적으로 제공하는 모바일 웹 기반의 감성 어휘 분석 모형을 설계하여 면접 환경 개선을 할 수 있는 시각화 모델을 제안한다.