• 제목/요약/키워드: 통제어휘

검색결과 63건 처리시간 0.023초

한국어 규칙 동사와 불규칙 동사의 심성 어휘집 접근 과정 (The Lexical Access of Regular and Irregular Korean Verbs in the Mental Lexicon)

  • 박희진;구민모;남기춘
    • 인지과학
    • /
    • 제23권1호
    • /
    • pp.1-23
    • /
    • 2012
  • 본 연구는 한국어 동사의 활용된 형태인 굴절 동사의 심성어휘집 접근 과정을 알아보기 위한 연구이다. 이를 위하여 차폐 점화 어휘 판단과제 실험을 실시하여 점화크기를 비교하였다. 한국어 규칙 동사와 불규칙 동사를 다섯 가지로 나누어 실험을 수행하였다. 활용의 종류는 1) 완전규칙 2) 발음변화규칙 3) 철자변화규칙 4) 어간변화 불규칙 5) 어미변화 불규칙으로 1), 2), 3)은 규칙 활용의 범주로 4), 5)는 불규칙활용의 범주이다. 기본형의 동사를 표적자극으로 사용하였고, 점화자극으로 총 세 가지 유형이 사용하였다. 점화자극으로 사용한 자극은 기본형의 어간의 변화가 없는 규칙활용, 기본형의 어간이 철자적, 음운적으로 변화하는 불규칙활용과, 의미 및 형태적으로 관련 없는 통제된 단어이다. 또한 단어재인의 처리에서 형태소 분해 정보처리의 시간대를 살펴보기 위하여 SOA의 간격을 43ms, 72ms, 230ms의 3가지로 나누어 실험하였다. 모든 동사가 모든 SOA에서 규칙활용과 불규칙활용이 통제단어에 비해 빠른 반응시간을 보임으로써 점화효과가 관찰되었다. 그러나 규칙활용과 불규칙활용에서 뚜렷이 점화효과의 차이가 관찰되지 않는다. 이러한 규칙활용과 불규칙활용의 범주의 구분 없이 비슷한 패턴을 보여주는 결과는 한국어가 단순히 규칙과 불규칙의 기준으로 나뉘어서 처리되지 않는다는 것을 시사한다. 또한 모든 SOA에서 촉진효과를 보임으로써 형태소 정보처리가 초기과정부터 일어남을 확인하였다.

  • PDF

분산 생물정보 DB 에 대한 GO 기반의 통합 시맨틱 질의 기법 (Integrated Semantic Querying on Distributed Bioinformatics Databases Based on GO)

  • 박형우;정준원;김형주
    • 한국정보과학회논문지:컴퓨팅의 실제 및 레터
    • /
    • 제12권4호
    • /
    • pp.219-228
    • /
    • 2006
  • 최근 여러 생물학 연구 집단들은 연구의 효율 향상을 위해 그들의 연구 결과를 서로 공유하기 위한 노력을 하고 있다. 뿐만 아니라, 공통의 어휘를 이용하여 유전자의 기능을 기술하기 위해 통제된 어휘들로 이루어진 Gene Ontology(GO) 라는 온툴로지를 구축하였다. 하지만 현재까지도 각 연구 집단들의 데이타는 분산되어 있고, 기존의 시스템들은 이처럼 분산된 데이타들에 대한 통합 질의를 지원하지 않고 있을 뿐 아니라, 각 연구 집단의 독자적인 어휘들과 GO 와의 대응 관계에 대한 의미가 명확하게 기술되어 있지 않아 통합 시맨틱 질의가 근본적으로 불가능한 상태이다. 본 논문에서는 대응 관계의 의미를 결정하는 기법과, 통합 시맨틱 질의를 지원하는 인터페이스를 제안하였다. 먼저, 문자열 규칙과 다중도 분석 등을 통해 이러한 대응 관계의 의미를 반자동으로 결정해 주고 이렇게 결정된 대응 관계의 의미를 GO 와 통합하여 통합 온톨로지를 생성해 주는 AutoGOA 시스템을 제안하였다. 또한, 대표적인 메타데이타 기술 모델인 RDF 모델을 이용하여 여러 데이타들을 통합하고 이렇게 생성된 통합 온툴로지를 이용하여 통합 시맨틱 질의를 지원하는 인터페이스인 GOGuide II 를 제안하였다.

구조화된 소셜 메타데이터를 활용한 이미지 자료의 시맨틱 검색에 관한 실험적 연구 (An Experimental Study on Semantic Searches for Image Data Using Structured Social Metadata)

  • 김현희;김용호
    • 한국문헌정보학회지
    • /
    • 제44권1호
    • /
    • pp.117-135
    • /
    • 2010
  • 본 연구는 이미지의 시맨틱 검색을 위해서 동등어, 동의어 및 관련어를 질의 확장시에 사용하여 태그를 통제한 구조화된 폭소노미 시스템의 모형을 제안하였다. 그런 다음 제안한 시스템의 효율성을 평가하기 위해서 실험을 통해서 이 시스템을 태그를 전혀 통제하지 않은 태그 기반 시스템과 검색 효율성(재현율과 정확률)과 만족도 측면에서 비교해 보았다. 이외에 검색 효율성이 질의 확장 방식에 따라서 어떤 차이를 보이는지 조사해 보았다. 실험 결과, 제안된 구조화된 폭소노미 시스템이 태그 기반 시스템 보다 재현율, 정확률 및 만족도에서 더 높게 나타났으며 그 차이도 통계적으로 유의미한 것으로 나타났다. 한편 질의 확장 방식에 따라서 재현율은 차이가 없었지만 정확률은 부분적으로 차이가 있는 것으로 나타났다. 본 연구 결과는 라이브러리 2.0 시대의 디지털 도서관 시스템에 적용되어 디지털 자원에 대한 접근성을 향상시킬 수 있을 것이다.

NLM Medical Text Indexer를 활용한 우리나라 의학문헌의 MeSH Semi Indexing 방안 (MeSH Semi Indexing of the Korean Biomedical Literature, using NLM Medical Text Indexer)

  • 정소나;이춘실
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 2010년도 제17회 학술대회 논문집
    • /
    • pp.21-28
    • /
    • 2010
  • 본 연구에서는 PubMed에 등재되었으나 Medical Subject Headings(MeSH)가 부여되지 않은 국내 의학학술지의 문헌을 대상으로 미국국립의학도서관 (NLM: National Library of Medicine)의 Medical Text Indexer(MTI)를 활용하여 MeSH 용어를 추천받은 후, PubMed 레코드의 유사주제문헌 (Relation Citations, PRC)에 부여된 MeSH와의 일치여부를 분석하였다. 또한 논문의 저자가 부여한 키워드(저자키워드)와 PRC MeSH의 일치여부도 비교하였다. PRC MeSH와 MTI MeSH 추천어의 일치율은 주표목이 21.1%였고, 체크태그는 18.1%, 부표목은 16.5%로 나타났다. 우리나라 의학논문에 나타난 저자키워드의 중요한 특징은 MeSH 주표목 위주이고, 체크태그와 부표목은 거의 사용하지 않는 것이다. 따라서 저자키워드와 PRC MeSH 주표목과의 일치율은 23.4%에 이르지만, 체크태그와 부표목의 일치율은 각각 1%, 2.1%였다. 색인전문가가 통제어휘를 사용하여 색인하는 과정에서 PRC와 MTI의 MeSH 주표목과 저자키워드가 일치하는 용어를 주표목으로 부여하고, PRC와 MTI가 추천하는 체크태그와 부표목을 활용하는 등 국내 의학문헌의 MeSH 용어 부여 작업을 반자동화(semi-indexing)하면, 정확하고 신속한 MeSH 부여 작업이 가능할 것이다.

  • PDF

학부 이수교과목 분석을 통한 현장 사서의 계속교육프로그램 개발에 관한 연구 (A Study on a Continuing Educational Program for Librarians - Based on Analysis of University Credits)

  • 안인자;노영희;최상기;김혜주
    • 한국도서관정보학회지
    • /
    • 제43권1호
    • /
    • pp.27-52
    • /
    • 2012
  • 본 연구의 목적은 사서의 전문성 강화를 위한 계속교육프로그램 교과내용을 제안하는 것이다. 문헌정보학과 졸업자가 학부에서 이수한 교과목 분석을 통하여 선행된 교육 이수 내역을 조사하였고, 국립중앙도서관의 계속교육프로그램을 분석하여 사서들의 교육 수요조사를 조사하였다. 외국의 계속교육프로그램으로는 ALA, SLA를 비교분석하였다. 새로이 개설되는 신규교과목 경향을 조사하였다. 그 결과 문헌정보학 주제분야별로 교육내용을 제시하였다. 제안되는 교과내용은 전자출판과 저작권, 도서관미래, 톡소노미 및 통제어휘, 특허정보, 과학정보리터러시, 오픈억세스프로그램, 도서관가치인식, 라이센스 이슈, 고객응대 등이다.

한국인의 한국어와 영어음절 분석 특성 (How do Koreans represent Korean and English Sub-syllabic Units\ulcorner)

  • 권혜원;윤여범;남기춘
    • 한국인지과학회:학술대회논문집
    • /
    • 한국인지과학회 2002년도 춘계학술대회
    • /
    • pp.131-136
    • /
    • 2002
  • 한국어 CVC 음절의 하위 단위는 초성자음과 모음을 포함하는 음절체(body)와 종성자음(coda)으로 이루어져 있고, 영어 음절은 초성(onset)과, 모음과 종성자음을 포함하는 각운(rime)으로 이루어져 있다고 한다. 본 연구에서는 한국인이 영어의 음절을 한국어 음절 정보처리 방법으로 정보처리 하는지를 알아보고자 하였다 실험 조건으로는 음절체 일치 조건(예, 각-감, cap-cat), 각운 일치 조건(예, 남감, pat-cat), 그리고 두 자음 일치 통제조건(예, 김-감, cut-cat)과 무관련 통제 조건(예, ***-감, ***-cat)이 사용되었다. 실험 과제로는 점화 어휘판단 과제(primed lexical decision task)를 수행하였다. 만약 음절체 일치 조건에서의 점화효과가 각운 일치 조건에서의 점화효과보다 크다면 한국인의 음절분절 단위가 음절체-종성(body-coda) 구조일 것으로 예상할 수 있고 각운 조건에서의 점화효과가 더 크다면 그 단위가 초성-각운(onset-rime)구조일 것으로 예상할 수 있다. 실험 결과, 한국어 음절의 경우 각운 일치 조건의 점화 효과가 음절체 일치 조건의 점화 효과보다 크게 나타나 음절체-종성 구조로의 하위 단위 분석을 지지했다. 그러나 영어의 경우에는 각운 일치 조건의 점화 효과가 음절체 일치 조건의 점화 효과보다 크게 나타나 초성-각운 구조로의 분석을 지지하였다. 따라서 한국인이 시각 단어를 재인할 때에는 언어 특정적인 분석을 수행한다는 결과를 얻었다.

  • PDF

검색용 MeSH 필터와 단어인접탐색 기법을 활용한 KoreaMed 검색 효율성 향상 연구 (A Study on the Retrieval Effectiveness of KoreaMed using MeSH Search Filter and Word-Proximity Search)

  • 정소나;정지나
    • 한국산학기술학회논문지
    • /
    • 제18권5호
    • /
    • pp.596-607
    • /
    • 2017
  • 의학학술문헌에는 해부학적 조직이나 기관명이 종양, 질환 또는 감염 용어들과 서로 조합하여 사용되는 언어적 특성을 가지고 있다. 의학학술문헌을 검색할 때 데이터베이스가 제공하는 통제어휘도구인 Medical Subject Headings (MeSH)를 활용하면 합성어, 동의어, 그리고 관련어를 추가로 검색할 수 있어 검색효율이 높다. 본 연구에서는 위암(Stomach Neoplasms) 어휘군을 검색용 필터로 추가하는 방법과 동시출현용어의 거리를 측정하여 단어인접탐색 기법으로 검색효율성을 향상시키는 연구를 수행하였다. 검색용 MeSH에 추가할 어휘군을 결정하기 위해 실험데이터로 PubMed에서 중심주제어가 "Stomach Neoplasms"인 2007년~2016년 논문 8,625편을 내려 받아 논문제목으로부터 Stomach와 Neoplasms 관련 용어의 동시출현여부를 분석하였다. 검색효율성은 KoreaMed에서 검색되는 MEDLINE 학술지를 대상으로 "Stomach Neoplasms"가 MeSH로 색인되어 있는 277편으로 검증하였는데 MEDLINE MeSH, MeSH on Demand, 그리고 KoreaMed MeSH Indexer의 "Stomach Neoplasms" 색인어 추출여부와 검색용 필터로 어휘군을 적용했을 때, 그리고 동시출현 용어의 단어인접검색 기법을 적용했을 때 "Stomach Neoplasms"의 매칭여부를 비교하였다. 가장 출현빈도가 높은 용어는 "Gastric Cancer"로 2,780회 출현하였다. "Gastric Adenocarcinoma", "Gastric MALT Lymphoma" 등과 같이 "Stomach" 용어와 "Neoplasms" 관련 조직학적 용어가 조합된 경우는 7,376개(88.51%)였다. 동시출현 거리가 2단어인 용어는 "Stomach"와 "Neoplasms"의 합성어로 5,234개(70.95%)였다. 연구 결과 MeSH용어를 제외하고 973개의 용어를 후보어휘군으로 선정하였다. MEDLINE MeSH와 KoreaMed MeSH Indexer의 MeSH 매칭률은 209편(75.5%)이었는데 검색필터를 적용한 결과 263편(94.9%)으로, 동시출현 용어의 13단어 단어인접탐색 기법을 적용한 경우 268편(96.7%)으로 매칭률이 향상되었다. 본 연구를 통해 자연어 검색에 있어서 검색효율을 향상시키는 수단으로 검색용 시소러스를 사용하면 색인비용에 대한 부담이 적고, 통제어의 망라적 장점과 자연어가 가지는 용어의 특정성을 유지할 수 있음을 증명하였다. 또한 불리안 검색보다는 단어인접탐색 기법을 활용하면 정확률을 높일 수 있어 검색 효율성이 향상됨을 알 수 있었다.

스키마 활성화가 영어 독해에 미치는 영향 -중학생을 중심으로- (Effect of Schema Activation on English Reading Comprehension -Focused on Middle School Students-)

  • 김경훈
    • 한국콘텐츠학회논문지
    • /
    • 제8권11호
    • /
    • pp.404-411
    • /
    • 2008
  • 이 연구의 목적은 스키마 활성화가 영어 독해에 미치는 영향에 대해서 연구하였다. 광주시내의 중학교 3학년 학생들 중 실험집단 36명 통제집단 32명 총 68명이 실험 대상 이었다. 이 학생들의 영어 능숙도는 사전 검사를 통해 동일한 집단임을 보였으며, 실험집단은 독해 전 활동으로 어휘제시와 이미지 자료를 제시하여 수업을 하였으며, 통제집단은 문법 번역식 수업으로 진행하였다. 설문지는 사전 사후 각각 영어 독해와 관련된 25문항으로 하였으며 자료 분석은 SPSS 12.0을 사용하였다. 그 결과는 독해 전 활동이 영어 독해 능력에 영향을 미친다는 것을 알 수 있었으며, 영어 능숙도에 따른 결과는 하위집단이 상위집단보다 더 효과적이었다. 스키가 활성화를 통한 영어 독해 학습을 함으로써 학생들은 수업에 흥미를 가지고 참여 하였으며 그 결과 실험 집단이 통제집단보다 더 높은 학업 성취도를 보였다.

한국어 단어 산출에서 음절 내 부호화 II (Within-syllabic Encoding in Korean Word Production II)

  • 구민모;남기춘
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2009년도 제21회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.73-76
    • /
    • 2009
  • 본 논문에서는 한국어 단어를 산출하는 과정에서 음절 내 부호화 과정을 규명하기 위해 2개의 단어번역과제 실험을 수행하였다. 한국어 산출에서 종성점화효과를 검증한 실험 1에서 종성 반복 조건과 통제조건 간에 단어번역시간에서 차이를 보이지 않았다. 반면에 실험 2에서는 11ms의 부적인 중성점화효과를 보였다. 구민모와 남기춘(2009)과 본 연구의 결과를 종합하면, 다음과 같은 결론에 도달한다: (1) 한국어 산출 어휘집에서 음절은 "음절체+종성"의 위계적인 내적 구조로 표상된다. (2) 음절 내 부호화는 음절체와 종성이 계열적인 순서로 진행된다. (3) 음절체를 구성하는 초성과 중성이 계열적인 순서로 음절구조에 삽입된다.

  • PDF

디지털 도서관을 위한 소셜 태깅의 의미: 이용자 협력을 활용한 디지털 지식 생성 (Implications of Social Tagging for Digital Libraries: Benefiting from User Collaboration in the Creation of Digital Knowledge)

  • 최윤선
    • 정보관리학회지
    • /
    • 제27권2호
    • /
    • pp.225-239
    • /
    • 2010
  • 본 연구는 이용자 협력에 의한 소셜 태깅(social tagging)이 웹 자원을 위한 디지털 지식 생성에 활용될 수 있으며, 태깅의 양질성(quality)과 효율성이 실증적으로 증명될 수 있는가를 다루었다. 이 논고는 특별히 소셜 태깅의 색인 일관성(indexing consistency)을 평가하고 전문가들의 색인 일관성과 비교하여 분석하였다. 많은 수의 색인자들 간의 색인 일관성을 측정하기 위해 벡터 공간 모델(Vector Space Model)에 기반한 두 가지의 유사성 측정 공식을 사용하였다. 본 연구는 웹자원 관리에 있어서 소셜 태깅의 활용성 증진에 공헌하며, 디지털 도서관 환경에서 새롭게 생성되는 자료들에 대한 보다 적합한 어휘를 개발하는 데에 있어 소셜 지식을 적극적으로 수용할 필요가 있다고 주장한다. 또한 두 가지 공식에 의한 비교분석은 두 공식에서의 비슷한 색인 경향을 보여주면서 보다 신뢰적인 결과를 제공하였다.