• 제목/요약/키워드: Concept-based Information Retrieval

검색결과 116건 처리시간 0.04초

연구자 중심 연구성과물 의미검색을 위한 인문사회 학술용어 온톨로지 적용 및 유지관리 체계 연구 (A Study on the Application and Management Framework of Social Science Scholarly Ontology for Semantic Information Navigation)

  • 유사라;이혜원;송인석
    • 한국문헌정보학회지
    • /
    • 제43권2호
    • /
    • pp.277-298
    • /
    • 2009
  • 한국학술진흥재단 기초학문자료센터(Korean Research Memory: KRM)의 기 구축된 인문사회 학술용어는 각 용어 및 연구 성과물간에 성립하는 의미관계의 분석을 통해 수요에 적합한 정보를 보다 효율적으로 탐색 활용할 수 있도록 연구성과물 메타데이터의 유기적 연동이 요구되었다. 본 연구에서는 첫째, 연구성과물의 핵심적 개념을 표현하는 주제 색인어로 구성된 인문사회 학술용어 온톨로지를 기반으로 각 해당 연구성과물 지식구조를 표현하는 개념모델를 정의하고, 둘째, 연구성과물 간에 성립하는 의미관계 정의를 통해, 연구성과물에 대응하는 연구자 정보수요를 분석하여 이에 맞춘 정보 탐색서비스 모델을 설계하였다. 셋째, 학술용어 온톨로지 및 연구성과물 DB의 유기적 연계통합 운영을 위한 기술적이고 관리적 체계 수립방안을 제시하였다.

개념 상승과 속성의 최적 감축에 의한 결정 규칙의 생성 (Generation of Decision Rules Bsed on Concept Ascension and Optimal Reduction of Attributes)

  • 정환묵
    • 한국지능시스템학회논문지
    • /
    • 제9권4호
    • /
    • pp.367-374
    • /
    • 1999
  • 본 논문은 대규모 데이터베이스에서 의사 결정을 위한 지식을 효율적으로 추출하기 위해 개념 상승과 속성 감축에 기반한 통합적 방법을 제안한다. 본 방법은 클리스터링 기법에 의해 개념 트리를 자동생성하고 개념 상승기법에 의해 데이터 베이스를 일반화하며 속성의 중요도를 사용한 속성 감축에 의해 최적감축을 하고 식별가능 행렬과 함수를 사용하여 효율적으로 속성값을 감축하여 최적의 최소결정 규칙을 유도한다. 본 방법은 투자 계획이나 가격 결정과 같은 의사결정 업무 각종 고장 진단이나 의료 진단을 위한 지식 베이스구축 마케팅 분석이나 실험 데이터 분석 고수준의 질의 에 의한 정보검색 등에 효과적으로 사용될수 있다.

  • PDF

온톨로지 기반 문서여과 및 질의확장에 의한 XML 정보검색 (XML Information Retrieval by Document Filtering and Query Expansion Based on Ontology)

  • 김명숙;공용해
    • 한국멀티미디어학회논문지
    • /
    • 제8권5호
    • /
    • pp.596-605
    • /
    • 2005
  • 기존의 XML 질의 방법은 단순 키워드 정합이나 단순 구조적 확장 등에 국한되므로 문서에 내재된 정보를 검색하기에 불충분할 뿐만 아니라,모든 문서에 질의를 인가함으로써 정보검객의 효율을 저하시킨다. 본 연구는 온톨로지로부터 생성한 포괄적 BTD에 의해 검객대상 문서를 사전에 미리 선별하는 문서여과 방법과 온톨로지의 개념구조와 개념 간 연관관계를 추론하여 질의를 확장하는 방법을 제안함으로써 XML정보검색의 효과를 증대 하고자 한다. 제안한 문서여과 및 질의확장 방법은 다양한 XML 문서를 대상으로 검색 효과를 실험하였다.

  • PDF

FRAD 개념 모형 기반의 학술논문 전거데이터 구조에 관한 연구 (A Study on the based on FRAD Conceptual Model based Authority Data Scheme for Academic Papers)

  • 이석형;곽승진
    • 한국문헌정보학회지
    • /
    • 제45권3호
    • /
    • pp.235-257
    • /
    • 2011
  • 본 연구의 목적은 국내 학술논문에 나타나는 저자명, 단체명, 학술지명 전거데이터 구조를 FRAD 개념 모형을 적용하여 설계하는데 있다. 학술정보에는 정보의 접근점이 되는 저자, 소속기관, 발행기관, 학술지 및 회의명과 같은 개체를 포함하고 있을 뿐만 아니라 이들 개체들간 여러 관계들이 존재하고 있다. FRAD 개념 모형에 따른 학술정보 전거데이터의 표현을 통해 학술정보의 체계적인 관리 및 정확한 정보 검색, 그리고 다양한 형태의 지식 표현이 가능할 것으로 판단된다. 본 연구에서 설계된 개체-관계형 학술정보 전거데이터는 학술문서와 연계되며, 개체 식별을 위한 여러 속성 정보 및 관계 정보를 포함한다.

웹 기반 독서전략 모형 연구 (A Study on Model of Web Based Reading Strategy)

  • 최영임
    • 한국비블리아학회지
    • /
    • 제25권2호
    • /
    • pp.41-57
    • /
    • 2014
  • 본 연구는 미래 사회에서 개인의 독서활동이 어떠한 방향으로 나아가야 할 것인가에 대한 방향을 제시하고, 매체 환경의 변화에 대한 적극적인 대응법으로 효과적인 독서 생활을 위한 정보 독해능력과 웹 3.0 개념의 이해와 특성을 바탕으로 한 "웹 기반 독서전략 모형"을 개발하는 것을 목적으로 하였다. 본 연구에서는 웹 플랫폼을 기반으로 한 6개의 독서전략 모형을 개발하였다. 이 6개의 독서전략은, 초인지 전략, 정보검색전략, 개인화 전략, 읽기 전략, 쓰기 전략, 그리고 해석 전략이다.

어휘관계 정보와 질의개념연관도를 반영한 정보검색 성능 향상 기법 (Information Retrieval Based on Word Relationships and Degree of Query Concept)

  • 김준길;이경순
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2010년도 춘계학술발표대회
    • /
    • pp.451-454
    • /
    • 2010
  • 정보검색 분야에서 어휘 불일치 문제를 해결하기 위해 질의에서의 어휘 사이의 관계를 반영하는 것은 필수적인 요구사항이 되었다. 본 논문에서는 문장-문장 번역쌍을 이용하여 어휘 번역확률을 계산하였고, 어휘관계 정보를 반영하는 번역기반 언어모델에 어휘와 질의 개념과의 연관 정도를 반영한 모델을 제안한다. 뉴스 컬렉션 집합인 TREC AP 컬렉션에 대한 비교실험을 하였다. 실험결과에서 언어모델보다 어휘 관계를 반영한 번역기반 언어모델의 성능이 향상되었고 어휘의 질의개념 연관도를 반영한 모델이 번역기반 언어모델보다 성능이 향상됨을 보였다.

컬러 분포와 WordNet상의 유사도 측정을 이용한 의미적 이미지 검색 (Semantic Image Retrieval Using Color Distribution and Similarity Measurement in WordNet)

  • 최준호;조미영;김판구
    • 정보처리학회논문지B
    • /
    • 제11B권4호
    • /
    • pp.509-516
    • /
    • 2004
  • 의미기반 이미지 검색에서의 의미적 내용 인식은 주석 위주의 텍스트 정보를 이용하는 것이 일반적이다. 이러한 텍스트 정보 기반 이미지 검색은 전통적인 검색 방법인 키워드 검색 기술을 그대로 사하여 쉽게 구현할 수 있으나, 텍스트의 개념적 매칭이 아닌 스트링 매칭이므로 주석 처리된 단어와 정확한 매칭이 없다면 검색할 수 없는 단점이 있었다. 이에 본 논문에서는 Ontology의 일종인 WordNet을 이용하여 깊이, 정보량, 링크 타입, 밀도 등을 고려한 단어간 의미 유사도를 측정하여 패턴 매칭의 문제점을 해결하고자 한다. 또한, 이미지의 컬러 분포 유사도를 측정하여 저차원 특징과 결합한 의미적 이미지 검색이 가능하도록 설계하였다. 제안된 검색 방안에 대해 'Microsoft Design Gallery Live'의 주석을 포함한 이미지를 대상으로 실험한 결과, 기존 의미기반 검색 시스템보다 향상된 결과를 확인하였다.

확장 불리언 질의에 대한 비용 기반 최적화 (Cost-based Optimization of Extended Boolean Queries)

  • 박병권
    • 정보관리학회지
    • /
    • 제18권3호
    • /
    • pp.29-40
    • /
    • 2001
  • 본 논문에서는 역색인 파일을 미용하여 학장 불리언 질의를 처리할 때 최소 비용의 질의 처리 방법을 구해 주는 질의 최적화 알고리즘을 제시한다. 확장 불리언 질의를 처리하는 방법은 질의를 구성하는 키위드의 처리 순서에 따라 여러 가지가 있을 수 있으므로 확장 불리언 질의 최적화 문제는 결국 최적 키워드 처리 순서를 구하는 문제로 귀결된다. 본 논문에서는 이 문제가 데이터베이스 질의 최적화에서 최적 조인 순서를 구하는 문제와 구조적으로 유사함을 보이고 이 분야의 연구 결과를 이용하여 문제를 해결한다. 즉, 확장 불리언 질의 처리에 대한 비용 모델을 수립하고 키워드 선택률과 역색인 파일 접근 비용을 이용하여 키워드 순위 개념을 도입한 후 이를 이용하여 최적 키워드 처리 순서를 구하는 알고리즘을 도출한다. 그리고 도출한 질의 최적화 알고리즘의 최적성을 증명하고. 실험을 통하여 실제로 최소비용의 질의 처리 방법을 구함을 보이고, 질의 최적화를 하지 않을 경우와 비교하였을 때 그 성능이 월등히 우수함을 보인다. 본 논문에서 제시한 질의 최적화 알고리즘은 정보검색시스템의 질의 처리 성능 향상에 큰 기여를 하리라 믿는다.

  • PDF

OWL 온톨로지 사용을 위한 SPARQL 쿼리 툴 (SPARQL Query Tool for Using OWL Ontology)

  • 조대웅;최지웅;김명호
    • 한국컴퓨터정보학회논문지
    • /
    • 제14권11호
    • /
    • pp.21-30
    • /
    • 2009
  • 시맨틱 웹에서는 RDF, RDFS, OWL과 같은 온톨로지 구축 언어를 이용하여 웹 리소스의 메타데이터를 정의한다. 이러한 시맨틱 웹 기술을 이용한 연구는 에이전트를 기반으로 한 온톨로지의 개념에 대한 관계 및 트리플을 추출하기 위한 목적으로 진행되고 있다. 하지만 에이전트 기반의 온톨로지의 개념에 대한 관계 및 트리플의 추출은 에이전트의 특성상 한정된 쿼리 문을 작성하게 된다. 이는 온톨로지 안의 다른 개념에 대한 관계 및 트리플을 추출하고자 할 때는 유연성이 떨어진다. 온톨로지 정보 자체에 대한 유연성 있는 정보 검색을 하기 위해서는 표준 온톨로지 언어에 접근 및 표준 쿼리 언어의 이용이 가능한 쿼리 툴이 필요 하다. 본 논문에서는 OWL 온톨로지에 HTTP 프로토콜을 이용하여 접근이 가능하고, 쿼리를 할 수 있는 SPARQL 쿼리 툴을 제안한다. 툴에 의해 생성되는 쿼리 결과는 SOAP 메시지 형태로 변환 출력함으로써 웹 서비스를 이용한 접근도 가능하다.

새로운 N-ary 관계 디자인 기반의 온톨로지 모델을 이용한 문장의미결정 (A Semantic Similarity Decision Using Ontology Model Base On New N-ary Relation Design)

  • 김수경;안기홍;최호진
    • 정보관리학회지
    • /
    • 제25권4호
    • /
    • pp.43-66
    • /
    • 2008
  • 시맨틱 웹 기술의 제안과 더불어 다양한 분야에 온톨로지의 특징을 적용한 기술 개발 연구가 많이 진행되고 있다. 인간이 소유한 개념을 가장 적절하게 표현하기 위해 현재에도 OWL, RDF와 같은 온톨로지 언어의 표현력을 확장시키기 위해 N-ary 관계나 모델-이론 의미론과 같은 개발이 진행되고있다. 본 연구는 한국어에 있어 문장이 내포하는 의미를 정확하게 결정하기 위해 문장의 구조에 따라 달라지는 단어의 의미를 연관할 수 있도록 N-ary 관계와 디자인 기반이 적용된 온톨로지의 지식 표현 방법을 연구하였다. 특히 다양한 지식 영역을 포함하는 다의어(polysemy)와 동의어(synonym)의 특징을 갖는 단어에 있어 각 지식 영역으로 분류되어 각 지식 영역에 있는 유사한 의미를 가진 단어로 확장되어 유사한 의미를 가진 단어가 포함된 문장의 경우 까지도 확장할 수 있는 표현 방법을 연구하였다. 연구의 검증을 위해 사용자가 입력한 병증 문장을 제안된 방법에 따라 구축된 온톨로지내 지식 관계와 의미 결정을 위한 추론 표현 방법을 이용하여 병증의 의미를 결정하고 그에 따른 진단을 제공하는 실험 시스템을 구현하였고, 한국어가 갖고 있는 문장의 유의성, 모호성, 복합성 의 특징을 보유한 증상문들의 실험 결과 의미 결정과 유사 의미 확장에 있어 우수한 성능을 보여주었다.