통합 검색 | Korea Science

U-WIN의 구문관계 자동구축 방법 (Automatic Construction of Syntactic Relation in U-WIN)

임지희;김동명;최호섭;윤화묵;옥철영
- 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
- /
- 한국정보과학회언어공학연구회 2007년도 제19회 한글 및 한국어 정보처리 학술대회
- /
- pp.84-90
- /
- 2007
일반적인 어휘망이 의미 관계에 의한 연결 구조를 중심으로 연구 개발된 것과는 달리, U-WIN은 의미관계를 비롯하여 개념 관계, 형태 관계, 구문 관계 등과 같이 의미 관계의 범위를 확장한 어휘 관계를 적용하여 구축하고 있다. 본 연구에서는 U-WIN의 어휘 관계 중의 하나인 구문관계를 자동으로 구축하는 방법을 제시하고자 한다. 먼저, 용언의 용례에서 문형정보를 기준으로 구문관계를 형성할 수 있는 후보명사를 추출하였으며, 추출한 후보명사는 용언의 세분화된 의미별로 정확하고 다양하게 추출할 수 있었다. 그러나 U-WIN은 다의어의 뜻풀이 하나하나를 개별적인 어휘로 구분하여 구축하였으므로, 어휘 간의 구문관계를 설정하기 위해서는 후보명사의 여러 의미 중에서 하나의 의미로 결정해야 한다. 그래서 본 연구에서는 용례 매칭 규칙, 구문패턴, 의미 유사도 등을 차례로 적용하여 후보명사의 의미를 분별하였으며, 또한 구문패턴의 빈도 정보를 이용하여 용례에 나타나지 않지만 구문관계를 형성할 수 있는 명사를 추출하여 구문관계를 확장하고자 하였다. 이러한 연구는 명사 중심의 어휘망이 용언과의 구문관계 구축을 통해 형태소 분석, 구문 분석, 의미 분석 등에 광범위하게 활용할 수 있는 어휘망의 기반을 다지는 작업이 될 수 있을 것이다.
PDF

웹 기반 소셜 네트워크에서 시맨틱 관계 추론 및 시각화 (Inferring and Visualizing Semantic Relationships in Web-based Social Network)

이승훈;김지혁;김흥남;조근식
- 지능정보연구
- /
- 제15권1호
- /
- pp.87-102
- /
- 2009
최근 Web 2.0 발달과 더불어 블로그나 온라인 카페 등 웹 상의 네트워크화 된 정보 공간에 사용자가 자신의 개인적인 정보를 자유롭게 게재할 수 있도록 하는 서비스가 증가하면서, 이 사용자들 간의 관계에 초점을 맞춘 소셜 네트워크 분야의 연구가 활발히 이루어지고 있다. 이와 같은 사용자들은 단순히 사회적인 측면뿐만 아니라 교육, 정치, 경제 등의 다양한 분야의 가상의 커뮤니티를 형성함으로서 현대 사회의 주요한 한 부분으로 자리매김하고 있다. 하지만 많은 소셜 네트워크 서비스가 정보자원을 컴퓨터가 처리할 수 있는 의미적인 정보로 표현하고 있지 않기 때문에 서로 다른 도메인 간에 공유와 재사용이 제대로 이루어지지 않고 있다. 또한 사회적 개체들 간의 관계가 명확하게 정의되어 있지 않아 알려져 있지 않은 의미적 관계를 발견해내는 소셜 네트워크 분석에 어려움이 있다. 본 논문에서는 가상 커뮤니티의 사용자들이 업로드 한 사진 데이터를 이용하여 사진 속의 개체나 소유자들 간의 사회적 관계를 분석하기 위해 시맨틱 웹 기반의 소셜 네트워크 분석 시스템을 제안한다. 온톨로지를 기반으로 사진에서 추출된 얼굴 개체간의 관계와 이미 인맥 관계를 형성하고 있는 사람들의 정보적 연결성을 명확하게 정의하고 도메인 규칙을 활용하여 의미 있는 사회적 연결 관계를 추론한다. 최종적으로 이를 그래프로 시각화하여 사용자에게 제공함으로써 온라인 상에서 형성된 커뮤니티 내에서 효율적인 소셜 네트워크 분석(Social Network Analysis)을 도모하고 이를 기반으로 다양한 응용 분야에 활용하는 방법을 모색한다.
PDF

기계 번역 의미 대역 패턴을 이용한 한국어 복합 명사 의미 결정 방법 (A Method of Word Sense Disambiguation for Korean Complex Noun Phrase Using Verb-Phrase Pattern and Predicative Noun)

양성일;김영길;박상규;나동렬
- 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
- /
- 한국정보과학회언어공학연구회 2003년도 제15회 한글 및 한국어 정보처리 학술대회
- /
- pp.246-251
- /
- 2003
한국어의 언어적 특성에 의해 빈번하게 등장하는 명사와 기능어의 나열은 기능어나 연결 구문의 잦은 생략현상에 의해 복합 명사의 출현을 발생시킨다. 따라서, 한국어 분석에서 복합 명사의 처리 방법은 매우 중요한 문제로 인식되었으며 활발한 연구가 진행되어 왔다. 복합 명사의 의미 결정은 복합 명사구 내 단위 명사간의 의미적인 수식 관계를 고려하여 머리어의 선택과 의미를 함께 결정할 필요가 있다. 본 논문에서는 정보 검색의 색인어 추출 방법에서 사용되는 복합 명사구 내의 서술성 명사 처리를 이용하여 복합 명사의 의미 결정을 인접 명사의 의미 공기 정보가 아닌 구문관계에 따른 의미 공기 정보를 사용하여 분석하는 방법을 제시한다. 복합 명사구 내에서 구문적인 관계는 명사구 내에 서술성 명사가 등장하는 경우 보-술 관계에 의한 격 결정 문제로 전환할 수 있다. 이러한 구문 구조는 명사 의미를 결정할 수 있는 추가적인 정보로 활용할 수 있으며, 이때 구문 구조 파악을 위해 구축된 의미 제약 조건을 활용하도록 한다. 구조 분석에서 사용되는 격틀 정보는 동사와 공기하는 명사의 구문 관계를 분석하기 위해 의미 정보를 제약조건으로 하여 구축된다. 이러한 의미 격틀 정보는 단문 내 명사들의 격 결정과 격을 채우는 명사 의미를 결정할 수 있는 정보로 활용된다. 본 논문에서는 현재 개발중인 한영 기계 번역 시스템 Tellus-KE의 단문 단위 대역어 선정을 위해 구축된 의미 대역패턴인 동사구 패턴을 사용한다. 동사구 패턴에 기술된 한국어의 단문 단위 의미 격 정보를 사용하는 경우, 격결정을 위해 사용되는 의미 제약 조건이 복합 명사의 중심어 선택과 의미 결정에 재활용 될 수 있으며, 병렬말뭉치에 의해 반자동으로 구축되는 의미 대역 패턴을 사용하여 데이터 구축의 어려움을 개선하고자 한다. 및 산출 과정에 즉각적으로 활용될 수 있을 것이다. 또한, 이러한 정보들은 현재 구축중인 세종 전자사전에도 직접 반영되고 있다.teness)은 언화행위가 성공적이라는 것이다.[J. Searle] (7) 수로 쓰인 것(상수)(象數)과 시로 쓰인 것(의리)(義理)이 하나인 것은 그 나타난 것과 나타나지 않은 것들 사이에 어떠한 들도 없음을 말한다. [(성중영)(成中英)] (8) 공통의 규범의 공통성 속에 규범적인 측면이 벌써 있다. 공통성에서 개인적이 아닌 공적인 규범으로의 전이는 규범, 가치, 규칙, 과정, 제도로의 전이라고 본다. [C. Morrison] (9) 우리의 언어사용에 신비적인 요소를 부인할 수가 없다. 넓은 의미의 발화의미(utterance meaning) 속에 신비적인 요소나 애정표시도 수용된다. 의미분석은 지금 한글을 연구하고, 그 결과에 의존하여서 우리의 실제의 생활에 사용하는 $\ulcorner$한국어사전$\lrcorner$ 등을 만드는 과정에서, 어떤 의미에서 실험되었다고 말할 수가 있는 언어과학의 연구의 결과에 의존하여서 수행되는 철학적인 작업이다. 여기에서는 하나의 철학적인 연구의 시작으로 받아들여지는 이 의미분석의 문제를 반성하여 본다.반인과 다르다는 것이 밝혀졌다. 이 결과가 옳다면 한국의 심성 어휘집은 어절 문맥에 따라서 어간이나 어근 또는 활용형 그 자체로 이루어져 있을 것이다.으며, 레드 클로버 + 혼파 초지가 건물수량과 사료가치를 높이는데 효과적이었다.\ell}$ 이었으며 , yeast extract 첨가(添加)하여 배양시(培養時)는 yeast extract 농도(濃度)가 증가(增加)함에 따라 단백질(蛋白質) 함량(含量)도 증가(增加)하였다. 7. CHS-13 균주(菌株)의 RNA 함량(
PDF

사전에 나타난 인지정보를 이용한 단어 개념의 지식표현 (Knowledge Representation of Concept Word Using Cognitive Information in Dictionary)

윤덕한;옥철영
- 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
- /
- 한국정보과학회언어공학연구회 2004년도 제16회 한글.언어.인지 한술대회
- /
- pp.118-125
- /
- 2004
인간의 언어지식은 다양한 개념 관계를 가지며 서로 망(network)의 모습으로 연결되어 있다. 인간의 언어지식의 산물 중에서 가장 체계적이며 구조적으로 언어의 모습을 드러내고 있는 결과물이 사전이라고 할 수 있다. 본 논문에서는 이러한 사전 뜻풀이 말에서 개념 어휘와 자동적인 지식획득을 통하여 의미 정보를 구조적으로 추출한다. 이러한 의미 정보가 추출되면서 동시에 자동적으로 개념 어휘의 의미 참조 모형이 구축된다. 이러한 것은 사전이 표제어 리스트와 표제어를 기술하는 뜻풀이말로 이루어진 구조의 특성상 가능하다. 먼저 172,000여 개의 사전 뜻풀이말을 대상으로 품사 태그와 의미 태그가 부여된 코퍼스에서 의미 정보를 추출하는데, 의미분별이 처리 된 결과물을 대상으로 하기 때문에 의미 중의성은 고려하지 않아도 된다. 추출된 의미 정보를 대상으로 정제 작업을 거쳐 정보이론의 상호 정보량(Ml)을 이용하여 개념 어휘와 의미 정보간에 연관도를 측정한 후, 개념 어휘간의 유사도(SMC)를 구하여 지식표현의 하나로 연관망을 구축한다.
PDF

SymCSN : 유연한 지식 표현 및 추론을 위한 기호-연결주의 모델 (SymCSN : a Neuro-Symbolic Model for Flexible Knowledge Representation and Inference)

노희섭;안홍섭;김명원
- 인지과학
- /
- 제10권4호
- /
- pp.71-83
- /
- 1999
기존의 기호주의 적 추론 시스템은 경직성 문제로 인하여 유연성을 결여하고 있다. 이는 기호주의 적 지식표현 체계가 지식의 유연한 의미구조를 충분히 반영하고 있지 못할 뿐 아니라 추론 방법도 논리를 바탕으로 하기 때문이다. 이러한 문제를 해결하기 위하여, 우리는 최근 인공 신경 망에 기반 한 유연한 지식표현과 추론을 위한 연결주의 적 의미 망(CSN)을 제안한 바 있다. CSN은 인간의 유사성과 연관성에 기반 하여 근사 추론과 상식추론을 수행할 수 있다. 그러나 CSN 모델에서는 상위개념간의 관계를 표현하는 데 있어서 단순한 전향 신경 망을 이용함으로써 상위개념간의 일반적이고 구조화된 관계를 표현하거나 변수의 표현 및 바인딩의 어려움과 같은 문제점이 있었다. CSN모델의 이런 문제점을 해결하기 위해 본 논문에서는 상위개념간의 일반적이고 구조화된 지식표현을 가능하게 하고 추론이 용이한 기호주의 표현 체계와 이 표현 체계 안에서 의미구조를 표현하고 학습할 수 있는 연결주의 학습 모델인 CSN을 결합한 기호-연결주의 통합 시스템 SymCSN(Symbolic CSN)을 제안하고, 실험을 통하여 제안한 시스템이 인간과 유사한 유연한 지식표현과 추론을 위한 모델임을 보인다.
PDF

데이터베이스 의미론을 위한 한국어 피동형의 전산적 처리 (Processing Korean Passives for Database Semantics)

홍정하;최승철;이기용
- 한국인지과학회:학술대회논문집
- /
- 한국인지과학회 2000년도 한글 및 한국어 정보처리
- /
- pp.411-418
- /
- 2000
Hausser (1999)와 이기용 (1999a, 1999c)에서는 데이터베이스 관리 시스템(DBMS)을 이용하여 자연언어의 의미를 다루는 데이터베이스 의미론을 제안하였다. 특히 이기용 (1999c)에서는 수형도(tree), 논리 형태(logical fomulas), 자질 구조(feature structure)와 같은 다양한 언어 표상 형식들을 관계형 데이터베이스 관리 시스템(DBMS)의 표상 형식인 테이블 형식으로 전환 가능함을 보임으로써 데이터베이스 의미론에 관계형 데이터베이스 관리 시스템을 도입할 수 있음을 제시하였다. 한편, Lee (2000)에서 제시한 데이터베이스 의미론 모형에서는 데이터베이스 관리 시스템과 사용자(end-user)를 연결하는 언어 정보 처리 시스템(LIPS; Linguistic Information Processing System)을 제안하였다. 이 언어 정보 처리 시스템은 사용자에 의해 입력된 언어 자료를 처리하여 그 분석 결과를 데이터베이스 관리 시스템에 전달하고, 이를 통해 구축된 데이터베이스에서 추출한 정보를 다시 사용자에게 전달하는 시스템이다. 이 논문은 한국어 '이, 히, 리, 기' 피동형을 전산처리 할 수 있도록, 데이터베이스 의미론에서 핵심 요소인 언어정보 처리 시스템과 데이터베이스 관리 시스템을 구현하는 것이 목적이다.
PDF

유전자 알고리즘을 이용한 통합의학언어시스템(UMLS)의 의미망 자동 군집 방법 (Semantic Network Automatic Clustering Method of the Unified Medical Language System Using Genetic Algorithm)

지영신;김태준;전혜경;정헌만;이정현
- 한국정보과학회:학술대회논문집
- /
- 한국정보과학회 2003년도 가을 학술발표논문집 Vol.30 No.2 (1)
- /
- pp.82-84
- /
- 2003
UMLS 의미망은 크기가 방대하고 복잡하여 사용자가 이해하기가 어렵고 화면상에 모든 의미망을 모두 표현할 수 없다는 단점을 가지고 있다. 이 문제를 해결하기 위해 의미망을 효율적으로 분할하기 위한 규칙들이 소개되고 있지만 이것은 UMLS 의미망이 수정될 때마다 규칙을 적용하여 수작업으로 분류를 해야한다는 단점이 있다. 이 문제점을 해결하기 위해 유전자 알고리즘을 이용한 UMLS 의미망의 자동 군집화 방법을 제안한다. 제안한 방법은 각각의 의미유형 간의 연결된 의미관계를 사용하여 의미망을 구조적으로 유사한 의미유형 집합들로 군집화하고 규칙에 의한 군집 방법의 결과 비교 평가한다.
PDF

시멘틱 검색 엔진 설계 및 구현 (A Design and Implementation of the Semantic Search Engine)

허선영;김은경
- 한국정보과학회:학술대회논문집
- /
- 한국정보과학회 2008년도 한국컴퓨터종합학술대회논문집 Vol.35 No.1 (C)
- /
- pp.331-335
- /
- 2008
시맨틱 웹은 정보의 의미를 개념으로 정의하고 개념들 간의 관계성을 표현함으로써, 문서들 간의 단순 연결이 아닌 의미 연결을 통해서 보다 정확하고 효율적인 정보 검색이 가능하게 된다. 이러한 시맨틱 웹의 비전이 구체화되기 위해서는 웹 온톨로지(Web Ontology)를 기반으로 의미 정보로 구성된 시맨틱 문서들에 대한 추론을 통해서 웹상에 존재하는 엄청난 정보들 간의 관련성을 파악하고 사용자가 요구하는 정보를 보다 효율적으로 검색할 수 있는 시스템이 필수적이다. W3C에서 제안한 OWL은 대표적인 온톨로지 언어이다. 시맨틱 웹 상에서 OWL 데이타를 효율적으로 검색하기 위해서는 잘 구성되어진 저장 스키마를 구축해야 한다. 본 논문에서는 Jena2의 경우, 단일 테이블에 문서의 정보를 저장하기 때문에 단순 선택 연산 (Simple Selection), 조인 연산이 요구되는 질의에 대한 성능이 저하되고 대용량의 OWL데이터의 처리에 있어 성능이 저하되는 문제를 해결하기 위하여 본 논문에서는 OWL 문서의 의미를 Class, Property, Individual로 분류하여 각각의 데이터 정보들을 테이블에 저장하기 위한 다중 변환기와 OWL 변환기 기능을 가진 시멘텍 검색 엔진을 설계 및 구현하였다. 본 검색 엔진을 테스트한 결과, 단순정보검색 질의 시 Jena2에서 비정규화된 테이블 구조로 저장할 때보다 질의 응답 속도를 향상 시킬 수 있었고, 조인 연산 시 두 테이블의 크기로 인한 조인비용이 발생하는 문제점을 해결함으로써 빠른 검색 및 질의 속도를 보장할 수 있었다.
PDF

Word2Vec과 WordNet 기반 불확실성 단어 간의 네트워크 분석에 관한 연구 (Network Analysis between Uncertainty Words based on Word2Vec and WordNet)

허고은
- 한국문헌정보학회지
- /
- 제53권3호
- /
- pp.247-271
- /
- 2019
과학에서 지식의 불확실성은 명제가 현재 상태로는 참도 거짓도 아닌 불확실한 상태를 의미한다. 기존의 연구들은 학술 문헌에 표현된 명제를 분석하여 불확실성을 의미하는 단어를 수동적으로 구축하고 구축한 코퍼스를 대상으로 규칙 기반, 기계 학습 기반의 성능평가를 수행해왔다. 불확실성 단어 구축의 중요성은 인지하고 있지만 단어의 의미를 분석하여 자동적으로 확장하고자 하는 시도들은 부족했다. 한편, 계량정보학이나 텍스트 마이닝 기법을 이용하여 네트워크의 구조를 파악하는 연구들은 다양한 학문분야에서 지적 구조와 관계성을 파악하기 위한 방법으로 널리 활용되고 있다. 따라서, 본 연구에서는 기존의 불확실성 단어를 대상으로 Word2Vec을 적용하여 의미적 관계성을 분석하였고, 영어 어휘 데이터베이스이자 시소러스인 WordNet을 적용하여 불확실성 단어와 연결된 상위어, 하위어 관계와 동의어 기반 네트워크 분석을 수행하였다. 이를 통해 불확실성 단어의 의미적, 어휘적 관계성을 구조적으로 파악하였으며, 향후 불확실성 단어의 자동 구축의 확장 가능성을 제시하였다.
https://doi.org/10.4275/KSLIS.2019.53.3.247 인용 PDF KSCI

텍스트 이해 모델에 기반한 정보 검색 시스템 (Text Undestanding System for Summarization)

송인석;박혁로
- 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
- /
- 한국정보과학회언어공학연구회 1997년도 제9회 한글 및 한국어 정보처리 학술대회
- /
- pp.1-6
- /
- 1997
본 논문에서는 인지적 텍스트 이해 모형을 제시하고 이에 기반한 자동 요약 시스템을 구현하였다. 문서는 정보의 단순한 집합체가 아닌 정형화된 언어 표현 양식으로서 단어의 의미적 정보와 함께 표현 양식, 문장의 구조와 문서의 구성을 통해 정보를 전달한다. 요약 목적의 텍스트 이해 및 분석 과정을 위해 경제 분야 기사 1000건에 대한 수동 요약문을 분석, 이해 모델을 정립하였고. 경제 분야 기사 1000건에 대한 테스트 결과를 토대로 문장간의 관계, 문서의 구조에서 요약 정보 추출에 사용되는 정보를 분석하였다. 본 텍스트 이해 모형은 단어 빈도수에 의존하는 통계적 모델과 비교해 볼 때, 단어 간의 관련성을 찾아내고, 문서구조정보에 기반한 주제문 추출 및 문장간의 관계를 효과적으로 사용함으로서 정보를 생성한다. 그리고 텍스트 이해 과정에서 사용되는 요약 지식과 구조 분석정보의 상관관계를 체계적으로 연결함으로서 자동정보 추출에서 야기되는 내용적 만족도 문제를 보완한다.
PDF

검색결과 374건 처리시간 0.025초

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

자세히 찾기

이미지 검색 (β)