• 제목/요약/키워드: 언어 식별

검색결과 161건 처리시간 0.025초

느낌만이 뜻인가? (Is feeling enough for-meanings?)

  • 이건원
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 1989년도 한글날기념 학술대회 발표논문집
    • /
    • pp.236-239
    • /
    • 1989
  • 뜻이 느낌만으로 충분한가를 살펴본다. 느낌이 보거나 들을 수 없다는 특성을 감안하여 보거나 들을 수 있는 또 다른 언어로 표현된 것에 의하여 고찰하는 것이 더 정확하다고 보아서 변역에 의하여 고찰하는 방법을 택한다. 한 표현p에 대한 느낌을 인지자i의 주관적인 작용에 따라 다르다는 것은 분명하나 그 다름을 식별하는 어려움이 있어서 변역에 의한다. 성급히 보편적인 뜻이 없다고는 못하나 실제로는 합의된 뜻이 사용된다. 합의는 절대적이지 않아서 절대적인 분식성과 개연성의 이분법을 받아들이지 않는다. 또 이러한 관점에서 양상논리의 삼분법보다는 다치논리가 더 엄밀하다고 본다. 그래서 함의된 뜻에서의 합의는 이분법이나 삼분법에 의한 합의가 아닌 확률적인 정도에 의존한다.

  • PDF

사전학습 언어모델과 GCN을 이용한 한국어 관계 추출 (Korean Relation Extraction Using Pre-Trained Language Model and GCN)

  • 이제승;김재훈
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2022년도 제34회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.379-384
    • /
    • 2022
  • 관계 추출은 두 개체 간의 관계를 식별하는 작업이며, 비정형 텍스트를 구조화시키는 역할을 하는 작업 중 하나이다. 현재 관계 추출에서 다양한 모델에 대한 연구들이 진행되고 있지만, 한국어 관계 추출 모델에 대한 연구는 영어에 비해 부족하다. 따라서 본 논문에서는 NE(Named Entity)태그 정보가 반영된 TEM(Typed Entity Marker)과 의존 구문 그래프를 이용한 한국어 관계 추출 모델을 제안한다. 모델의 학습과 평가 말뭉치는 KLUE에서 제공하는 관계 추출 학습 말뭉치를 사용하였다. 실험 결과 제안 모델이 68.57%의 F1 점수로 실험 모델 중 가장 높은 성능을 보여 NE태그와 구문 정보가 관계 추출 성능을 향상시킬 수 있음을 보였다.

  • PDF

다국어 음성 인식을 위한 자동 어휘모델의 생성에 대한 연구 (A Study on the Automatic Lexical Acquisition for Multi-lingustic Speech Recognition)

  • 지원우;윤춘덕;김우성;김석동
    • 한국음향학회지
    • /
    • 제22권6호
    • /
    • pp.434-442
    • /
    • 2003
  • 특정한 언어 (영어)로 구현된 소프트웨어를 다른 언어 (한국어, 중국어 등)에서 처리할 수 있도록 하는 과정인 소프트웨어의 국제화는 음성기술 분야에 적응할 때 매우 복잡해진다. 그 이유는 음성 자체가 언어와 많은 연관 관계를 갖기 때문이다. 그러나 어떠한 언어라 해도 그 나라의 언어표현은ASCII코드나 혹은 그 나라 고유의 코드 기반으로 소프트웨어를 처리한다. 영어의 경우는 ASCII코드의 코드체계로 이루어지지만 다른 나라 언어인 경우 다른 형태의 언어코드를 사용하는 것이 일반적이다. 음성 처리에서 언어의 본질적 특성은 어휘모델에 나타난다. 어휘모델은 문자집합, 음소집합, 발음규칙으로 구성된다. 본 논문에서는 다국어 음성인식처리를 위한 어휘모델을 자동으로 생성하기 위하여, 4단계로 나누어 처리하는 어휘모델 구축 방법을 제안한다. 우선 전처리 과정으로 특정한 언어로 표현한 단어를 유니코드로 변환한다. (1단계) 유니코드로부터 중간 형태 코드로의 변환 (2단계) 발음 형태를 기본으로 하는 표준화된 규칙 적용 (3단계) 음소 규칙들에 의한 문자소 구현 (4단계) 음운론을 적용하는 순서로 구성된다.

한글 문자의 전자계산조직에 적응하기 위한 특징추출에 관한 연구(I) (A Method For the Recognition of Printed Korean Characters)

  • 이주근
    • 대한전자공학회논문지
    • /
    • 제6권4호
    • /
    • pp.8-19
    • /
    • 1969
  • 우리 문자는 자모의 조합된 언어문자이기 때문에 그 수가 방대하여 수천개의 식별기구를 필요로 할 뿐만 dkl니라 재조가 복잡하며 대부분이 유이문자이기 때문에 Patttern 인식문제에 잇어서는 허다한 난점이 있다. 따라서 이들 재조상에서 오는 문제점을 분석, 평가하하여 최적조건을 결정하고, 특징추출에 노이적별함수의 적용은 다른 문자에서는 볼 수 없는 한글 문자에 관한 한 특수한 장점으로 나타난다는 것을 확인하여다. 이 특수점을 Systen의 서례에 최대한으로 적용하여 3분지 1이상의 System축소를 보았다. 인식방버버으로서는 표본 Pattern을 추출해 내서 Register에 기제한 다음 인식 Matrix에 의하여 식별하였다. 식별된 문자는 판정논리에 의하여 특수Parameter를 추출하였다. 이논적인 입증을 위한 몇가지의 실험적인 검사를 가하였으며 이 과정에서 얻어진 모든 자료들은 이 분양의 연구에 매우 유익한 기초자료를 제공할 것이로 보며, 한글문자의 Patterndlstlr에 관한 실마리가 잡혀졌다고 보겠다.

  • PDF

항공 통신, 항법, 식별장비 시험평가 (Test & Evaluation of Airborne Communication, Navigation, Identification Equipment)

  • 김성우;김민수;이영식;이병화;오우섭
    • 한국군사과학기술학회지
    • /
    • 제15권5호
    • /
    • pp.615-622
    • /
    • 2012
  • Airborne radio communications, navigation, and identification equipments are the basic equipment of airplane. Airborne radio communications, navigation, and identification equipments are characterized by user's many quantitative and qualitative requirements. These equipment look like simple test and evaluation, but they have many complex factors. This paper describe the test and evaluation of airborne radio communications, navigation, and identification equipments.

감성정보를 처리하는 상황인식 미들웨어의 구조 설계 (The Design of Context-Aware Middleware Architecture for Processing Emotional Information)

  • 김진봉
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2009년도 추계학술발표대회
    • /
    • pp.889-890
    • /
    • 2009
  • 유비쿼터스 컴퓨팅 환경에서 가장 핵심적인 부분은 상황(Context)을 인식하고, 그 상황에 따라서 최적의 서비스를 제공해 주는 것이다. 이러한 최적의 서비스를 제공하기 위해서는 최적의 상황을 인식하는 상황인식 컴퓨팅 기술 연구와 그 상황을 설계하는 모델링 기술들이 중요하다. 현재 대부분의 상황인식 컴퓨팅 기술은 지정된 공간에서 상황을 발생시키는 객체를 식별하는 일과 식별된 객체가 발생하는 상황의 인식에 주된 초점을 두고 있다. 또한, 상황정보로는 객체의 위치 정보만을 주로 사용하고 있다. 그러나 본 논문에서는 객체의 감성어휘를 상황정보로 사용하여 감성을 인식할 수 있는 상황인식 미들웨어로서 EIP-CAM의 구조를 제안한다. EIP-CAM 구조의 모델링은 상황인식 모델링과 서비스 모델링으로 구성된다. 또한, 감성어휘의 범주화 기술을 기반으로 온톨로지를 구축하여 객체의 감성을 인식한다. 객체의 감성어휘를 상황정보로 사용하고, 부가적으로 환경정보(온도, 습도, 날씨 등)를 추가하여 인식한다.. 객체의 감성을 표현하기 위해서 OWL 언어를 사용하여 온톨로지를 구축하였으며, 감성추론 엔진은 Jena를 사용했다.

얼굴표정정보를 처리하는 상황인식 미들웨어의 구조 설계 (The Design of Context-Aware Middleware Architecture for Processing Facial Expression Information)

  • 김진봉
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2008년도 추계학술발표대회
    • /
    • pp.649-651
    • /
    • 2008
  • 상황인식 컴퓨팅 기술은 넓게 보면 유비쿼터스 컴퓨팅 기술의 일부분으로 볼 수 있다. 그러나 상황인식 컴퓨팅 기술의 적용측면에 대한 접근 방법이 유비쿼터스 컴퓨팅과는 다르다고 할 수 있다. 지금까지 연구된 상황인식 컴퓨팅 기술은 지정된 공간에서 상황을 발생시키는 객체를 식별하는 일과 식별된 객체가 발생하는 상황의 인식에 주된 초점을 두고 있다. 또한, 상황정보로는 객체의 위치 정보만을 주로 사용하고 있다. 그러나 본 논문에서는 객체의 얼굴표정을 상황정보로 사용하여 감성을 인식할 수 있는 상황인식 미들웨어로서 CM-FEIP의 구조를 제안한다. CM-FEIP의 가상공간 모델링은 상황 모델링과 서비스 모델링으로 구성된다. 또한, 얼굴표정의 인식기술을 기반으로 온톨로지를 구축하여 객체의 감성을 인식한다. 객체의 얼굴표정을 상황정보로 사용하고, 무표정일 경우에는 여러 가지 환경정보(온도, 습도, 날씨 등)를 이용한다. 온톨로지를 구축하기 위하여 OWL 언어를 사용하여 객체의 감성을 표현하고, 감성추론 엔진은 Jena를 사용한다.

작성자 분석과 CNN을 적용한 소스 코드 작성자 식별 프레임워크 (The Identification Framework for source code author using Authorship Analysis and CNN)

  • 신건윤;김동욱;홍성삼;한명묵
    • 인터넷정보학회논문지
    • /
    • 제19권5호
    • /
    • pp.33-41
    • /
    • 2018
  • 최근 인터넷 기술이 발전함에 따라 다양한 프로그램들이 만들어지고 있고 이에 따라 다양한 코드들이 많은 사람들을 통해 만들어진다. 이러한 측면을 이용하여 특정 작성자가 작성한 코드들 그대로 가져가 자신이 작성한 것처럼 보여주거나, 참고한 코드들에 대한 정확한 표기 없이 그대로 사용하여 이에 대한 보호가 점차 어려워지고 있다. 따라서 본 논문에서는 작성자 분석 이론과 합성곱 신경망 기반 자연어 처리 방법을 적용한 작성자 식별 프레임워크룰 제안한다. 작성자 분석 이론을 적용하여 소스 코드에서 작성자 식별에 적합한 특징들을 추출하고 이를 텍스트 마이닝에서 사용하고 있는 특징들과 결합하여 기계학습 기반의 작성자 식별을 수행한다. 그리고 합성곱 신경망 기반 자연어 처리 방법을 소스 코드에 적용하여 코드 작성자 분류를 수행한다. 본 논문에서는 작성자 분석이론과 합성곱 신경망을 적용한 작성자 식별 프레임워크를 통해 작성자를 식별하기 위해서는 작성자 식별만을 위한 특징들이 필요하다는 것과 합성곱 신경망 기반 자연어 처리 방법이 소스 코드등과 같은 특수한 체계를 갖추고 있는 언어에서도 적용이 가능하다. 실험 결과 작성자 분석 이론 기반 작성자 식별 정확도는 95.1%였으며 CNN을 적용한 결과 반복횟수가 90번 이상일 경우 98% 이상의 정확도를 보여줬다.

한국어 학습자 작문 자동 평가를 위한 평가 항목 선정 (Evaluation Category Selection For Automated Essay Evaluation of Korean Learner)

  • 곽용진
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2017년도 제29회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.270-271
    • /
    • 2017
  • 본 연구는 한국어 학습자 작문의 자동 평가 시스템 개발의 일환으로, 자동 평가 결과에 대한 설명과 근거가 될 수 있는 평기 기준 범주를 선정하기 위한 데이터 구축과 선정 방법을 제시한다. 작문의 평가 기준의 영역과 항목은 평가체계에 대한 이론적 연구에 따라 다양하다. 이러한 평가 기준은 자동 평가에서는 식별되기 어려운 경우도 있고, 각각의 평가 기준이 적용되는 작문 오류의 범위도 다양하다. 그러므로 본 연구에서는 자동 평가 기준 선정의 문제는 다양한 평가 기준에 중 하나를 선정하는 분류의 문제로 보고, 학습데이터를 구축, 기계학습을 통해 자동 작문 평가에 효과적인 평가 기준을 선정 가능성을 제시한다.

  • PDF

재사용 소프트웨어 컴포넌트의 Statemate 모듈화 (Statemate-modulization of reusable software component)

  • 김창진;최진영
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2006년도 춘계학술발표대회
    • /
    • pp.203-206
    • /
    • 2006
  • Ada는 객체지향 특성과 소프트웨어 모듈화 및 일반화 메커니즘을 통해 프로그래밍 언어 차원에서 소프트웨어의 재사용성을 제공하고 있다. 그러나 특정 언어 자체를 이용하는 것만으로 소프트웨어의 재사용이 확보되지는 않으며 설계자가 컴포넌트간의 유기적인 관계를 파악하고 재사용을 통해 얻을 수 있는 장.단점을 판단할 수 있어야 한다. 본 논문은 재사용 가능한 소프트웨어 객체와 인터페이스를 식별하고 재사용 모듈의 설계에 필요한 요소들을 파악함과 동시에 소프트웨어 설계 시 적용할 수 있는 코딩 패턴을 제시한다. 또한 이들을 보다 효율적인 설계도구인 Statemate에서 재사용 모듈로 활용할 수 있도록 기존 generic chart의 한계를 고려한 확장 개념의 재사용 모듈을 작성한다.

  • PDF