• 제목/요약/키워드: 내용기반 매칭

검색결과 84건 처리시간 0.026초

이미지 딥러닝 기반의 모바일 검색 서비스 구현 (Implementation of Mobile Search Services based on Image Deep-learning)

  • 송재오;조정현;권진관;이상문
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2017년도 제56차 하계학술대회논문집 25권2호
    • /
    • pp.348-349
    • /
    • 2017
  • 본 논문에서 제안하는 내용은 기존의 포털 검색의 키워드 입력 방식과는 달리, 검색하고자 하는 대상을 스마트폰과 같은 모바일 기기의 카메라로 촬영하면, 해당 촬영 이미지가 사용자 입장에서는 검색 키워드와 같이 동일한 역할을 할 수 있도록 이미지에 해당되는 검색 키워드를 추출 및 매칭하여 검색을 위한 질의어로 사용할 수 있도록 해주는 것을 목적으로 한다.

  • PDF

움직임 동사와 선-영역 위상간 관련성에 관한 연구 (A Study on Correlation between Line-Region Topology and Motion Verbs)

  • 조미영;송단;최준호;김원필;김판구
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2004년도 춘계학술발표대회
    • /
    • pp.177-180
    • /
    • 2004
  • 비디오 데이터베이스에서 움직임 정보를 가지고 있는 이동객체에 대한 모델링은 크게 두 가지 측면 즉, 공간적 혹은 시간적 관계성에 의해 다루어진다. 공간적 관계에서 위상 관계는 근접 그래프에 의한 모델링이 대부분이며, 이를 이용한 내용 기반 비디오 검색에서 자연어 형태의 질의어는 정형화된 위상 관계 표현으로 변환하는 과정을 거친다. 그러나 이 과정에서 위상 관계 표현이 인간이 사용하는 언어의 의미를 정확히 반영하는지는 알 수 없다. 이에 본 논문에서는 위상 관계 표현과 인간이 사용하는 움직임 동사간 의미의 차이를 줄이기 위해 위상 관계 표현과 실제 움직임 동사간의 매칭에 대해 연구했다.

  • PDF

인용논문 분석을 통한 학술 문서 추천 시스템 (A recommender of academic papers using the citation analysis)

  • 박상진;김윤현;이지현
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2011년도 춘계학술발표대회
    • /
    • pp.279-282
    • /
    • 2011
  • 인터넷의 급속한 보급으로 사용자가 정보와 지식의 접근이 용이 해진 반면, 방대한 정보의 과 부화로 인하여 데이터의 신뢰성이 문제시 되고 있다. 특히, 기존의 학술 연구와 관련된 논문 데이터 검색에 있어서, 사용자의 요구 사항에 정확히 부합하는 결과물을 제공하는 데는 많은 한계를 가진다. 본 연구는 기존의 단순 키워드 매칭 검색의 한계를 넘어서, 레퍼런스와 인용 논문을 활용한 내용 기반 검색 방법론을 제안 한다.

칼라 히스토그램 정제를 이용한 특징벡터 기반 영상 검색 알고리즘 (Image retrieval algorithm based on feature vector using color of histogram refinement)

  • 강지영;박종안;백정욱
    • 한국HCI학회:학술대회논문집
    • /
    • 한국HCI학회 2008년도 학술대회 1부
    • /
    • pp.376-379
    • /
    • 2008
  • 내용기반 영상검색(CBIR)에서 보다 효율적이고 빠른 영상검색을 위하여 본 논문에서는 칼라 히스토그램 정제를 이용한 특정벡터 기반 영상검색 알고리즘을 제안한다. RGB 칼라 이미지에서 각각의 R, G, B를 분할하고 히스토그램을 추출하여 16개의 영역(bin)으로 균일하게 분할한 다음 R, G, B 각각의 히스토그램에서 영역의 픽셀값을 계산하여 비교, 분석하고 그중 최고값을 추출한다. 그리고 R, G, B 각각의 영역의 최고값들을 이용하여 칼라 정보를 인덱스화 한 후 그 특정값을 이용한 영상 검색 기술을 수행한다. 본 논문에서 제안한 알고리즘은 효과적인 특정 추출을 위하여 각각의 R, G, B에서 추출 된 특정값을 특정벡터 테이블로 구성하여 입력 영상과 데이터베이스 영상을 비교하고 매칭도와 순위를 구하여 기존의 히스토그램만을 이용한 알고리즘 보다 더 나은 검색 결과를 확인하였다.

  • PDF

클라우드 환경에서 문서의 유형 분류를 위한 시맨틱 클러스터링 모델 (Semantic Clustering Model for Analytical Classification of Documents in Cloud Environment)

  • 김영수;이병엽
    • 한국콘텐츠학회논문지
    • /
    • 제17권11호
    • /
    • pp.389-397
    • /
    • 2017
  • 최근 시맨틱 웹 문서는 클라우드 기반으로 생성 및 유통되고 문서유형 분류에 따른 쉽고 신속한 정보 검색을 위해 지능형 시맨틱 에이전트를 요구하고 있다. 기존의 웹 문서의 검색은 키워드를 이용하여 해당하는 질의어가 포함된 문서 목록을 결과로 가져오며 사용자의 요구시에 내용을 제시하는 것이 일반적인 형태이다. 이는 웹 문서의 유사도와 시맨틱 관련성을 고려하지 않음으로써 사용자가 내용 검색과 분석에 많은 시간과 노력을 요구한다. 이의 해결을 위해서 빅 데이터 요소 기술인 하둡과 NoSQL을 활용하여 시맨틱 웹 문서에 포함된 키워드 빈도에 기반한 웹 문서의 유형 분류와 유사도를 제시하는 시맨틱 클러스터링 모델을 제안한다. 제안 모델은 실시간 데이터 처리가 요청되는 이종 모델을 가진 공공 데이터와 웹 데이터를 취합하여 일반 사용자가 쉽게 질의할 수 있는 대용량 지식 기반 시스템을 구축하는데 응용 모델로 활용될 수 있다.

구문 의미 이해 기반의 VOC 요약 및 분류 (VOC Summarization and Classification based on Sentence Understanding)

  • 김문종;이재안;한규열;안영민
    • 정보과학회 컴퓨팅의 실제 논문지
    • /
    • 제22권1호
    • /
    • pp.50-55
    • /
    • 2016
  • VOC(Voice of Customer)는 기업의 제품 또는 서비스에 대한 고객의 의견이나 요구를 파악할 수 있는 중요한 데이터이다. 그러나 VOC 데이터는 대화체의 특징으로 인해 내용의 분절이나 중복이 다수 존재할 뿐 아니라 다양한 내용의 대화가 포함되어 유형을 파악하는데 어려움이 있다. 본 논문에서는, 문서에서 중요한 의미를 갖는 키워드와 품사, 형태소 등을 언어 자원으로 선정하였고, 이를 바탕으로 문장의 구조 및 의미를 이해하기 위한 LSP(Lexico-Semantic-Pattern, 어휘 의미 패턴)를 정의하여 구문 의미 이해 기반의 주요 문장을 요약문으로 추출하였다. 요약문을 생성함에 있어 분절된 문장을 연결하고 중복된 의미를 갖는 문장을 줄이는 방법을 제안하였다. 또한 카테고리 별로 어휘 의미 패턴을 정의하고 어휘 의미 패턴에 매칭된 주요 문장이 속한 카테고리를 기반으로 문서를 분류하였다. 실험에서는 VOC 데이터를 대상으로 문서를 분류하고 요약문을 생성하여 기존의 방법들과 비교하였다.

근대 한국기독교 자료의 디지털 아카이브 시스템 구축에 관한 연구 (A Study on Constructing a Digital Archive System of the Modern Korean Christian Collections)

  • 양지안
    • 한국콘텐츠학회논문지
    • /
    • 제22권8호
    • /
    • pp.681-691
    • /
    • 2022
  • 본 연구는 우리나라 개화기 이후 해방될 때까지 근대 시기에 발행된 한국기독교 관련 자료를 다수 소장하고 있는 S대학교 한국기독교박물관의 자료목록을 분석하여 이를 대상으로 디지털 아카이브 시스템을 구축하는데 목적이 있다. 한국 근대 시기의 기독교자료에 관한 디지털 아카이브 시스템 구축을 위해 대상 자료에 대한 색인과 메타데이터를 형식에 맞게 작성하였다. 선별된 자료를 디지털화한 후, 메타데이터 정보를 이용하여 데이터베이스를 구축하였고, 실제 시스템은 웹 표준 기반의 관리시스템과 이용자서비스시스템으로 나누어 구축하였다. 디지털 아카이브의 원활한 이용을 위해 내용기반의 검색시스템을 구축하였으며, 한 글자 단위의 검색결과 매칭값을 제공하고 검색어 자동완성 기능을 구현함으로써 이용자의 편의성을 제고하였다. 이를 통해 원문접근이 어려운 박물관 자료를 손쉽게 이용할 수 있도록 디지털화하여 제공함으로써 인문학 콘텐츠의 장기적 발전의 토대를 마련하여 연구자 및 대중들의 자료 접근성 및 활용성을 제고할 수 있는 기반을 마련하였다.

NFA 표현을 사용한 문서-중심적 XML의 키워드 기반 필터링 기법 (A Keyword-based Filtering Technique of Document-centric XML using NFA Representation)

  • 이경한;박석
    • 한국정보과학회논문지:데이타베이스
    • /
    • 제33권5호
    • /
    • pp.437-452
    • /
    • 2006
  • XPath 명세는 XML 원소 내용을 필터링하기 위한 질의어 작성이 어렵다. 본 논문은 이러한 문제점을 해결하기 위해 SQL의 LIKE 연산자에서 사용되던 특별한 매칭 문자 '%'를 허용한 확장된 XPath 명세와 그것을 표준 질의어로 사용하는 문서-중심적 XML 필터링 기법인 Pfilter를 제안한다. Pfilter는 값-기반 술어(value-based predicate)에서 피연산자의 공통 앞부분 문자를 공유하여 값-기반 술어의 처리 성능을 향상시킨다. 또한 본 논문은 Pfilter와 대표적인 데이타-중심적 XML 필터링 기법인 Yfilter를 값-기반 술어 처리의 확장성과 효율성에 대해 비교하고 Pfilter의 값-기반 술어 삽입, 삭제, 처리 결과를 제공한다. 본 논문에서 제안한 Pfilter는 XML 필터링 시스템에서 XPath의 contains() 함수를 평가(evaluation)하기 위한 핵심 알고리즘으로 사용할 수 있으며, XML 기반의 분산 정보 시스템을 구축하기 위한 기초 연구로 활용될 수 있다.

초등학교 수학과 교육과정 성취기준의 역량 기반 개선 방안 탐색 : 한국과 호주 '수와 연산' 영역 비교를 중심으로 (Exploring the Improvement of Mathematics Curriculum Achievement Standards for Elementary School in Competency-Based: Focused on comparing 'Number and Arithmetic' in Korean and Australian Curriculum)

  • 이화영
    • 한국수학교육학회지시리즈C:초등수학교육
    • /
    • 제23권4호
    • /
    • pp.229-255
    • /
    • 2020
  • 본 연구에서는 OECD의 DeSeCo 및 2030 프로젝트의 동향을 고려하였을 때 역량을 기르는 교육과정이 더욱 강조될 것으로 예상하고 역량 기반의 교육과정 성취기준 개선 방안을 모색하였다. 이를 위해 OECD 2030 프로젝트에서 새롭게 강조하는 역량을 살펴보고, 호주 초등학교 수학과 교육과정에서 역량을 성취규준과 내용 해설에 어떻게 담아냈는지 고찰하였다. 우리나라 2015 개정 초등학교 수학과 교육과정과 호주 교육과정의 성취기준을 매칭하고 수와 연산 영역의 내용을 중심으로 심층적으로 비교 분석하였으며, 역량이 성취기준에 반영되어 있는 양상을 살펴보기 위하여 성취기준에 포함된 기능 동사를 분석하여 비교하였다. 분석한 결과를 토대로 수학과 교육과정에서 성취기준에 역량을 충실히 반영하기 위한 개선 방안과 시사점을 도출하였다.

등급에 따른 웹 유해 문서 분류 기술 (A Distinction Technology for Harmful Web Documents by Rates)

  • 김영수;남택용;원동호
    • 정보처리학회논문지C
    • /
    • 제13C권7호
    • /
    • pp.859-864
    • /
    • 2006
  • 웹의 개방성은 사람들로 하여금 언제, 어디서든 손쉽게 유용한 정보를 획득할 수 있게끔 하였다. 하지만 인터넷은 유용한 정보의 손쉬운 활용이라는 순기능과 더불어 사회적으로 통제를 필요로 하는 유해한 정보 역시 인터넷을 이용하는 이용자들에게 무차별적으로 제공함으로써 역기능을 발생시키고 있다. 성인 컨텐츠 같은 정보들은 모든 사용자들, 특히 청소년들에게 악영향을 미칠 수 있다. 또한, 변태적인 성인 사이트들이 담고 있는 컨텐츠들은 성인들의 정신 건강에도 해를 미치게 된다. 한편, 인터넷은 전 세계적으로 연결된 개방망이므로 유해정보 제공자를 각국의 법적, 제도적 장치를 이용하여 규제하는데 한계가 있다. 또한, 유해 사이트, 유해성 스팸 메일, P2P 등 다양한 경로를 통해 유해 정보를 접할 수 있기 때문에, 어떤 시스템에 특화된 유해정보 분류기술을 개발하는 것은 바람직하지 않다. 따라서, 유해정보의 내용 자체에 기반하여 유해 여부를 자동으로 판별할 수 있는 유해정보 판별 핵심 기술의 연구 및 개발의 중요성이 점차 부각되고 있다. 이에 본 논문에서는 내용 기반 기술을 이용한 효율적인 유해 웹 문서 텍스트 판별 시스템을 제시한다.