• 제목/요약/키워드: Keyword-based

검색결과 1,126건 처리시간 0.035초

사용자 의도 트리를 사용한 동적 카테고리 재구성 (Dynamic recomposition of document category using user intention tree)

  • 김효래;장영철;이창훈
    • 정보처리학회논문지B
    • /
    • 제8B권6호
    • /
    • pp.657-668
    • /
    • 2001
  • 기존에 단어의 빈도수를 근간으로 하는 문서 분류 시스템에서는 단일 키워드를 사용하기 때문에 사용자의 의도를 충분히 반영한 문서 분류가 어려웠다. 이러한 단점을 개선하기 위하여 우선 기존의 설명에 근거한 학습방법(explanation based learning)에서 한 예제만 있어도 지식베이스 정보와 함께 개념을 학습할 수 있다는 점에 착안하여 먼저 사용자 질의를 분석, 확장한 후 사용자 의도 트리를 생성한다. 이 의도 트리의 정보를 기존의 키워드 빈도 수에 근거한 문서분류 과정에 제약 및 보충 정보로 사용하여 사용자의 의도에 더욱더 근접한 웹 문서를 분류할 수 있다. 문서를 분류하는 측면에서 볼 때 구조화된 사용자 의도 정보는 단순한 키워드의 한계를 극복하여 문서 분류 과정에서 특정 키워드 빈도수의 임계값을 결정함으로서 잃게되는 문서 및 정보를 좀더 보유하고 재적용할 수 있게 된다. 질의에서 분석, 추출된 사용자 의도 트리는 기존의 통계 및 확률을 사용한 문서 분류기법들과 조합하여 사용자 의도정보를 제공함으로서 카테고리의 형성 방향과 범위를 결정하는데 높은 효율성을 보인다.

  • PDF

지식 간 내용적 연관성 파악 기법의 지식 서비스 관리 접목을 위한 정량적/정성적 고려사항 검토 (Quantitative and Qualitative Considerations to Apply Methods for Identifying Content Relevance between Knowledge Into Managing Knowledge Service)

  • 유기동
    • 한국전자거래학회지
    • /
    • 제26권3호
    • /
    • pp.119-132
    • /
    • 2021
  • 내용적 연관성에 기반한 연관지식의 파악은 핵심 지식에 대한 서비스와 보안의 기본적인 기능이다. 본 연구는 내용적 연관성을 기준으로 연관지식을 파악하는 기존의 방식, 즉 키워드 기반 방식과 워드임베딩 방식의 연관문서 네트워크 구성 성능을 비교하여 어떤 방식이 정량적/정성적 측면에서 우월한 성능을 나타내는가를 검토한다. 검토 결과 키워드 기반 방식은 핵심 문서 파악 능력과 시맨틱 정보 표현 능력 면에서 우월한 성능을, 워드임베딩 방식은 F1-Score와 Accuracy, 연관성 강도 표현 능력, 대량 문서 처리 능력 면에서 우월한 성능을 나타냈다. 본 연구의 결과는 기업과 사용자의 요구를 반영하여 보다 현실적인 연관지식 서비스 관리에 활용될 수 있다.

대용량 XML 문서의 키워드 검색을 위한 레이블링 기법 (A Labeling Methods for Keyword Search over Large XML Documents)

  • 선동한;황수찬
    • 정보과학회 논문지
    • /
    • 제41권9호
    • /
    • pp.699-706
    • /
    • 2014
  • XML 문서가 점차 복잡해지면서 XML문서의 구조를 알 필요 없이 키워드로만 검색을 하는 키워드 검색 방식이 많이 사용되고 있다. XML문서 내에서 키워드 검색 방식을 사용하기 위해서는 문서 내의 모든 키워드에 레이블을 부여해야 하며, 구조적인 정보 또한 레이블 내에 충분히 표현해야한다. 하지만 기존 레이블링 방법들은 색인을 위한 단순정보만 레이블링 하거나, 증가하는 XML문서의 크기에 대응하기 어려운 형태로 구조적인 정보를 표현한다. 이는 XML문서가 커질수록 키워드검색성능이 떨어지거나, 공간 사용량이 기하급수적으로 증가하는 문제를 야기한다. 따라서 본 논문에서는 대용량 XML문서에 대한 키워드 검색 시 기존 레이블링 방식이 가지고 있던 문제점을 보완하는 새로운 레이블링 방식인 RPLS(Repetitive Prime Labeling Scheme)을 소개한다. 이 방법은 기존 소수 레이블방식을 개선하여 상위 레벨의 소수를 하위 레벨에서 반복 사용할 수 있도록 하여 레이블링을 위해 생성해야하는 소수의 수를 감소시키도록 한 것이다. 본 논문에서는 대용량 XML 문서의 키워드검색에 대한 RPLS 스킴의 효율성 검증을 위해 기존 레이블링 기법들과의 성능 비교 실험 결과도 제시한다.

지식 간 내용적 연관성을 표현하는 키워드 기반 네트워크형 지식지도 개발 (Keyword-based networked knowledge map expressing content relevance between knowledge)

  • 유기동
    • 지능정보연구
    • /
    • 제24권3호
    • /
    • pp.119-134
    • /
    • 2018
  • 저장 및 관리하는 지식의 분류체계로서의 의미를 갖는 지식지도는, 문제해결을 위하여 지식을 조회 및 선택하는 사용자의 활동을 지원하고 보완할 수 있는 구조를 갖추어야 한다. 계층형 구조를 갖는 기존의 지식지도는, 관리하는 지식을 체계적으로 정리하는 데에는 이점이 있으나, 지식 사용자가 갖는 인지 및 활용의 논리를 반영하지 못할 뿐만 아니라 지식을 조회 및 추출하는 사용자의 활동을 지원하지 못한다. 본 연구는, 내용적 관련성을 갖는 연관지식을 연쇄적으로 조회 및 추출하는 사용자의 지식활용 패턴을 반영하는, 키워드 기반 네트워크형 지식지도를 구축하는 방법론을 제시한다. 즉, 지식 간 내용적 연관성을 파악하기 위하여 키워드를 추출하고 공통된 키워드를 갖는 지식 간 링크를 해당 키워드를 이용하여 정의한다. 키워드는 해당 지식의 내용을 대변하므로, 키워드를 기반으로 정의된 링크는 내용적으로 관련성이 있는 지식 간에 형성되며, 이를 종합하면 내용적 연관성을 지식 간의 네트워크, 즉 네트워크형 지식지도가 완성된다. 제시된 방법론의 적용 타당성을 검토하기 위해 50개의 연구논문을 이용하여 이들 간의 내용적 연관성을 표현하는 네트워크형 지식지도를 구현하였으며, 검토 결과 만족할만한 수준의 정밀도와 재현율을 보였다.

키워드 네트워크 분석을 활용한 지식은폐 연구동향 분석 (Exploration of Knowledge Hiding Research Trends Using Keyword Network Analysis)

  • 주재홍;송지훈
    • 지식경영연구
    • /
    • 제22권1호
    • /
    • pp.217-242
    • /
    • 2021
  • 본 연구의 목적은 키워드 네트워크 분석을 통해 조직 구성원의 지식은폐에 대한 국내외 연구 동향을 살펴보는 것이다. 조직 구성원이 자신의 지식을 공유하지 않는 것을 넘어 의도적으로 숨기는 등의 구성원의 지식은폐에 대한 연구가 확산됨에 따라 이에 대한 연구가 어떻게 이루어지고 있는지에 대한 논의가 필요하다. 본 연구는 키워드 네트워크 분석을 위해 국내외 지식은폐 관련 게재된 연구 120편을 수집하였으며 이를 통하여 346종 578개의 키워드를 수집하였다. 그리고 본 연구에서 설정한 데이터 표준화 기준에 따라 키워드를 코딩하여 최종적으로 86개 노드와 667개의 링크로 된 네트워크 분석을 실시하였다. 그리고 설정한 연구 목적을 달성하기 위해 국내외 지식은폐 관련 문헌 분석을 통해 개념적 모형을 개발하고 키워드 네트워크 분석을 통해 도출한 네트워크 구조를 비교하여 연구 동향을 심층적으로 분석하였다. 본 연구 결과는 다음과 같다. 첫째, 네트워크 중심성 분석 결과 지식공유, 창의성 그리고 성과 키워드가 연결정도 중심성, 매개 중심성 그리고 근접 중심성 모두 높게 나타났다. 둘째, 지식은폐의 이론적 기제와 관련이 있는 "심리적 주인의식"과 "개인의 정서"에 대한 에고 네트워크를 분석함과 개념적 모형과 비교를 통하여 심층적으로 변수 간 관계를 탐색하였다. 본 연구는 이상과 같이 연구 결과를 바탕으로 학문적 및 실무적 시사점을 제시하였으며, 본 연구의 한계점과 후속 연구에 대한 방향성을 제시하였다.

미래신호 탐지 기법을 활용한 위성산업 시장의 진입 전략 수립 연구 (A Study on Establishing a Market Entry Strategy for the Satellite Industry Using Future Signal Detection Techniques)

  • 김세형;박재형;이한솔;강주영
    • 지능정보연구
    • /
    • 제29권3호
    • /
    • pp.249-265
    • /
    • 2023
  • 우주 산업은 세계적으로 잠재력이 높은 산업 분야로 여겨지지만, 국내에서는 아직 글로벌 시장에 비해 비교적 관심이 저조한 실정이다. 국내에서도 최근 위성산업은 전통적인 정부 주도의 산업에서 벗어난 민간 주도의 '뉴스페이스(New Space)' 패러다임에 관심을 기울이고 있다. 따라서, 본 연구의 목적은 국내 위성산업 관련 민간 기업의 시장 진입 전략을 결정하는 데 도움이 될 수 있는 미래의 신호를 탐색하는 것이다. 이를 위해 본 연구에서는 미래신호 이론과 Keyword Portfolio Map 등의 이론적 배경을 활용하여, 키워드 성장률과 키워드 등장 빈도 등을 바탕으로 특허 문서 데이터 내 키워드 잠재력을 분석한다. 또한, 뉴스 데이터를 추가로 수집하여 미래신호를 각각 first symptom, early information으로 구분하였다. 이는 해당 키워드가 특허문서 이외에 어떻게 실질적인 잠재력을 드러내는지에 대한 해석적 지표로 활용된다. 본 연구는 미래신호 탐색을 위한 데이터 수집과 분석 과정을 수록하였고, 키워드 맵의 시각화 자료를 통해 어떤 형태로 활용될 수 있는지 구체적으로 시각화함으로써 수집된 문서의 각각의 키워드가 약신호에서 강신호로 발전하는 과정을 추적하는 일련의 과정을 수록하였다. 본 연구의 과정은 기존 미래신호에 관한 연구의 방법론적인 기여와 활용 범위의 확장에 기여할 수 있고, 결과물은 위성 산업에서의 신산업 기획 및 연구 방향성 수립에 기여할 수 있다.

키워드 네트워크 분석과 토픽모델링을 활용한 정보활용교육 연구 동향 분석 (Analysis of Research Trends in Information Literacy Education Using Keyword Network Analysis and Topic Modeling)

  • 임정훈
    • 정보관리학회지
    • /
    • 제39권4호
    • /
    • pp.23-48
    • /
    • 2022
  • 본 연구는 키워드 네트워크 분석과 토픽모델링을 활용하여 국내 정보활용교육 연구의 흐름을 살펴보고 향후 정보활용교육의 방향성을 모색하는데 목적이 있다. 이를 위하여 국내 문헌정보학 분야의 학술지에 게재된 정보활용교육과 관련된 논문 306편을 선정하고, 논문의 초록을 대상으로 전처리 과정을 거쳐 전체 키워드 출현 빈도, 시기별 키워드 출현 빈도, 키워드 동시출현 빈도분석을 수행하였다. 이어서 키워드 네트워크 분석을 통해 키워드의 연결중심성과 매개중심성, 위세중심성을 분석하였다. 또한 구조적 토픽모델링 분석을 활용하여 15개의 토픽(교육과정, 정보활용교육 효과, 정보활용교육 내용, 학교도서관 교육, 정보매체활용, 정보활용능력 평가 지표, 도서관 불안, 공공도서관 프로그램, 대학도서관 이용자교육, 건강정보 활용능력, 정보격차, 도서관활 용수업 개선, 연구 동향, 정보활용교육 모델, 교사 역할)을 도출하고, 토픽별로 비중의 변화를 확인하기 위해 연도별 토픽 추이를 분석하였다. 이러한 결과를 바탕으로 정보활용교육의 방향성과 후속 연구에 대한 제언을 제시하였다.

클라우드 환경에서 전사적 정보 연계를 위한 개념 망 기반의 검색 프레임워크 (Retrieval Framework for Enterprise Information Integration based on Concept Net in Cloud Environment)

  • 정계동;문석재
    • 한국정보통신학회논문지
    • /
    • 제17권2호
    • /
    • pp.453-460
    • /
    • 2013
  • 본 연구에서는 클라우드 환경에서 기하급수적으로 증가하는 전사적 정보 연계를 위한 시맨틱 기반 개념 망을 이용하여 전사적 데이터들의 효율적 연계와 활용이 가능하도록 프레임워크를 제안한다. 개념 망은 기존 온톨로지에 접근하는 방식은 유사하지만, 사용자가 보다 효율적으로 정보 연계 검색을 하고자 객체와 개념 사이의 연관성을 구축 한다. 본 논문에서는 개념 망을 3가지로 구분하여 제안 프레임워크에 적용한다. 본 연구의 개념 망은 마스터 정보 개념 망, 키워드 개념 망, 그리고 비즈니스 프로세스 개념 망을 기반으로 온톨로지 형태로 구축된다. 이 개념 망은 사용자 요구사항에 따라 데이터들 간의 연관성을 기준으로 하여 검색 및 활용을 가능하게 한다. 그리고 마스터 정보 개념과 키워드 개념이 결합되어 검색 키워드의 빈도 및 카테고리의 빈도 추적을 제공함으로써, 사용자의 검색의 편의성과 신속성을 향상시킬 수 있도록 하였다.

온톨로지 기반의 자연어 검색 시스템 설계 및 구현 (Design and Implementation of Ontology-Based Natural Language Search System)

  • 강래구;임동일;정채영
    • 한국정보통신학회:학술대회논문집
    • /
    • 한국해양정보통신학회 2007년도 추계종합학술대회
    • /
    • pp.875-878
    • /
    • 2007
  • 지금까지의 상품 검색 방법으로는 찾고자하는 정보를 검색할 때 주로 단어의 빈도수나 어휘 정보를 이용하는 키워드 기반의 검색이 주로 쓰이고 있었다. 키워드 기반의 검색에서는 사용자의 질의와 관련이 없는 문서들까지도 같은 결과로 나타내 주고 이로 인해 사용자는 제시된 결과를 한번 더 수동적으로 검색해야하는 부담을 않게 되었다. 이러한 문제점을 해결하기 위해 온톨로지가 대두되었다. 본 논문에서는 온톨로지를 이용한 상품 검색 시스템을 직접 구축하여 분류별 검색을 통해 얼마나 정확한 검색을 하는지 실험하였다. 실험을 위해 전국적으로 On/Off라인 할인점을 운영 중에 있는 A할인점의 상품 데이터 약 40,000여개를 데이터베이스로 구축하였고 User Interface 개발환경은 JSP와 PowerBuilder9.0을 사용하여 검색 시스템을 개발하여 실험하였다. 그 결과 본 논문에서 제안하고 설계한 상품 도메인 온톨로지를 이용한 검색 방법이 기존의 키워드 기반의 검색 방법보다 우수한 결과를 나타내고 있음을 입증하였다.

  • PDF

연구.학술정보 효율적 검색을 위한 온톨로지 기반의 주제 색인어 구조화 방안 연구 (A Study on Ontology-based Keywords Structuring for Efficient Information Retrieval)

  • 송인석
    • 정보관리연구
    • /
    • 제39권4호
    • /
    • pp.121-154
    • /
    • 2008
  • 본 연구에서는 정보검색도구 관점에서 지식조직체계로서 기존 시소러스 구축방안의 특성과 한계점을 검토하고, 대상 정보의 지식구조의 반영 및 정보 간의 의미관계 추론을 지원하는 온톨로지 기반의 주제 색인어 구조화 방안을 제시한다. 기존의 용어 중심의 시소러스와 달리, 단계별 연구프로세스 과정에서 수행되는 연구자의 정보행위 및 수요 분석에 때라 주제색인어의 개념을 식별 범주화하고, 인문사회과학 분야 학술논문의 지식체계를 구성하는 그 개념들 간의 유기적 관계정의를 통해 주제 색인어 집합의 의미구조를 정형화하였다. 이를 기반으로 각각의 온톨로지 기반 주제 색인어 집합은 구조화된 의미 색인으로서 대상 문서의 지식체계를 표현한다. 정보수요에 따라 정의된 공리나 추론규칙을 활용하여 이용자는 문제 해결에 적합한 정보를 대상 정보의 의미관계로 구성된 주제 도메인의 학술커뮤니케이션 네트워크상에서 분석적 정보탐색을 통해 효율적으로 검색 할 수 있다.