• 제목/요약/키워드: keyword

검색결과 2,066건 처리시간 0.025초

인터넷 검색기록 분석을 통한 쇼핑의도 포함 키워드 자동 추출 기법 (A Methodology for Extracting Shopping-Related Keywords by Analyzing Internet Navigation Patterns)

  • 김민규;김남규;정인환
    • 지능정보연구
    • /
    • 제20권2호
    • /
    • pp.123-136
    • /
    • 2014
  • 최근 온라인 및 다양한 스마트 기기의 사용이 확산됨에 따라 온라인을 통한 쇼핑구매가 더욱 활성화 되었다. 때문에 인터넷 쇼핑몰들은 쇼핑에 관심이 있는 잠재 고객들에게 한 번이라도 더 자사의 링크를 노출시키기 위해 키워드에 비용을 지불할 용의가 있으며, 이러한 추세는 검색 광고 시장의 광고비를 증가시키는 원인을 제공하였다. 이 때 키워드의 가치는 대체로 검색어의 빈도수에 기반을 두어 산정된다. 하지만 포털 사이트에서 검색어로 자주 입력되는 모든 단어가 쇼핑과 관련이 있는 것은 아니며, 이들 키워드 중에는 빈도수는 높지만 쇼핑몰 관점에서는 별로 수익과 관련이 없는 키워드도 다수 존재한다. 그렇기 때문에 특정 키워드가 사용자들에게 많이 노출된다고 해서, 이를 통해 구매가 이루어질 것을 기대하여 해당 키워드에 많은 광고비를 지급하는 것은 매우 비효율적인 방식이다. 따라서 포털 사이트의 빈발 검색어 중 쇼핑몰 관점에서 중요한 키워드를 추출하는 작업이 별도로 요구되며, 이 과정을 빠르고 효과적으로 수행하기 위한 자동화 방법론에 대한 수요가 증가하고 있다. 본 연구에서는 이러한 수요에 부응하기 위해 포털 사이트에 입력된 키워드 중 쇼핑의도를 포함하고 있을 가능성이 높을 것으로 추정되는 키워드만을 자동으로 추출하는 방안을 제시하고, 구체적으로는 전체 검색어 중 검색결과 페이지에서 쇼핑과 관련 된 페이지로 이동한 검색어만을 추출하여 순위를 집계하고, 이 순위를 전체 검색 키워드의 순위와 비교하였다. 국내 최대의 검색 포털인 'N'사에서 이루어진 검색 약 390만 건에 대한 실험결과, 제안 방법론에 의해 추천된 쇼핑의도 포함 키워드가 단순 빈도수 기반의 키워드에 비해 정확도, 재현율, F-Score의 모든 측면에서 상대적으로 우수한 성능을 보이는 것으로 나타남을 확인할 수 있었다.

개념 망을 이용한 키워드 기반의 효율적인 정보 검색 시스템 설계 (Design of an Efficient Keyword-based Retrieval System Using Concept lattice)

  • 마진;전인호;최영근
    • 인터넷정보학회논문지
    • /
    • 제16권3호
    • /
    • pp.43-57
    • /
    • 2015
  • 본 논문에서는 개념망을 이용한 효율적인 정보검색을 위한 방법을 제안한다. 본 논문은 일반적인 개념망을 기반으로 시스템을 설계하였기 때문에 온톨로지와 접근 방식은 같지만 사용자가 보다 효율적으로 정보검색을 하고자 하는 객체와 개념사이의 협업 관계를 구축하여 사용할 수 있도록 개념망을 제안한다. 제안한 시스템은 다음과 같다. 첫 번째, 입력 키워드 중심의 키워드 개념망과 전문가 그룹이 추천한 전문가 개념망 그리고 테마 개념망 이러한 세 종류의 개념을 이용하여 협업적 검색을 하며, 이를 기반으로 사용자가 원하는 정보를 검색할 수 있는 효율적인 검색 시스템을 제안한다. 그리고 전문가 개념과 키워드 개념이 결합되어 키워드의 빈도 및 카테고리의 빈도를 제공함으로써, 사용자가 입력한 검색어와 관련된 키워드를 추천하는 역할을 할 수 있다. 그리고 테마 개념망을 이용하여 사용자의 관심 테마에서 사용되는 키워드 또는 카테고리를 알려주는 기능도 제공한다. 두 번째, 사용자가 입력한 키워드가 없을 경우 2차 검색을 통해 입력 키워드와 관련 있는 키워드를 제공해줌으로써 관련키워드를 이용하여 검색의 목적달성이 가능하다. 세 번째, 이러한 정보들은 대부분 분산되어 관리되고 있기 때문에 이렇게 분산되어 관리되는 정보는 표현방식이 다를 뿐만 아니라 시간에 따라 정보가 변하게 된다. 따라서 분산된 정보의 효율적 데이터 접근 및 통합을 위해 XMDR(eXtended Mata-Data Registry)을 이용하였고, 본 논문에서는 분산된 데이터를 통합하기 위한 기법 및 검색 시스템을 제시한다.

소비자 키워드광고 탐색패턴에 나타난 촉진지향성이 온라인 여행상품 구매확률에 미치는 영향 (The Effect of Deal-Proneness in the Searching Pattern on the Purchase Probability of Customer in Online Travel Services)

  • 김현교;이동일
    • 한국경영과학회지
    • /
    • 제39권1호
    • /
    • pp.29-48
    • /
    • 2014
  • The recent keyword advertising does not reflect the individual customer searching pattern because it is focused on each keyword at the aggregate level. The purpose of this research is to observe processes of customer searching patterns. To be specific, individual deal-proneness is mainly concerned. This study incorporates location as a control variable. This paper examines the relationship between customers' searching patterns and probability of purchase. A customer searching session, which is the collection of sequence of keyword queries, is utilized as the unit of analysis. The degree of deal-proneness is measured using customer behavior which is revealed by customer searching keywords in the session. Deal-proneness measuring function calculates the discount of deal prone keyword leverage in accordance with customer searching order. Location searching specificity function is also calculated by the same logic. The analyzed data is narrowed down to the customer query session which has more than two keyword queries. The number of the data is 218,305 by session, which is derived from Internet advertising agency's (COMAS) advertisement managing data and the travel business advertisement revenue data from advertiser's. As a research result, there are three types of the deal-prone customer. At first, there is an unconditional active deal-proneness customer. It is the customer who has lower deal-proneness which means that he/she utilizes deal-prone keywords in the last phase. He/she starts searching a keyword like general ones and then finally purchased appropriate products by utilizing deal-prone keywords in the last time. Those two types of customers have the similar rates of purchase. However, the last type of the customer has middle deal-proneness; who utilizes deal-prone keywords in the middle of the process. This type of a customer closely gets into the information by employing deal-prone keywords but he/she could not find out appropriate alternative then would modify other keywords to look for other alternatives. That is the reason why the purchase probability in this case would be decreased Also, this research confirmed that there is a loyalty effect using location searching specificity. The customer who has higher trip loyalty for specificity location responds to selected promotion rather than general promotion. So, this customer has a lower probability to purchase.

아웃소싱된 클라우드 데이터의 프라이버시를 보호하기 위한 멀티 키워드 검색 프로토콜의 개선 (An Improved Multi-Keyword Search Protocol to Protect the Privacy of Outsourced Cloud Data)

  • 김태연;조기환;이영록
    • 정보처리학회논문지:컴퓨터 및 통신 시스템
    • /
    • 제6권10호
    • /
    • pp.429-436
    • /
    • 2017
  • 최근 클라우드 컴퓨팅 환경에서 민감하거나 중요한 데이터를 아웃소싱하는 경향이 늘어나고 있다. 하지만 아웃소싱된 데이터의 프라이버시 보호는 매우 중요하다. 지금까지 단일 데이터 소유자와 다수의 데이터 사용자로 구성된 클라우드 컴퓨팅 환경에서 안전하고 효율적인 멀티 키워드 검색 구조들이 다양하게 제안되었다. Zhang 등은 다수의 데이터 소유자들과 사용자들로 연결된 클라우드 컴퓨팅 환경에서 멀티 키워드를 기반으로 하는 검색 프로토콜을 제안하였다. 그들의 프로토콜은 두 가지 문제점을 동시에 안고 있다. 하나는 클라우드 서버가 키워드 인덱스와 사용자의 트랩도어를 통해 데이터 파일들 간의 연관성을 불법적으로 추론할 수 있다는 것이고, 다른 하나는 키워드 인덱스의 크기만큼 복잡한 연산을 수행해야 하기 때문에 사용자의 요청에 대한 응답이 지연된다는 것이다. 본 논문에서는 클라우드 서버를 전적으로 신뢰할 수 없는 노드라는 가정 하에서 우리는 아웃소싱된 데이터의 프라이버시가 보호되는 개선된 멀티 키워드 기반 검색 프로토콜을 제안한다. 그리고 제안된 프로토콜이 Zhang의 프로토콜보다 데이터 파일들 간의 연관성 추론 측면에서 더 안전하고, 처리 시간의 측면에서 더 효율성이 높음을 실험을 통해 보인다.

키워드기반 특허 네트워크 진화에 따른 동종성 분석 (Analysis of Assortativity in the Keyword-based Patent Network Evolution)

  • 최진호;김정욱
    • 인터넷정보학회논문지
    • /
    • 제14권6호
    • /
    • pp.107-115
    • /
    • 2013
  • 우리가 살고 있는 세계에는 다양한 네트워크들이 발견된다. 특히, 기술 및 학문과 밀접하게 관련 있는 지식 네트워크는 지식이 생산되는 방식을 이해하는데 도움을 주기 때문에 큰 의미를 갖는다. 이러한 중요성을 바탕으로 지금까지 지식 네트워크를 대상으로 한 많은 네트워크 분석들이 이루어져 오고 있다. 그 중에서 동종성 계수는 네트워크 내의 노드들이 비슷한 성향을 가진 노드들과 연결을 맺으려는 경향 수치로 나타낸다. 동종성 계수가 가지는 이러한 특성은 지식 네트워크로 간주 될 수 있는 키워드기반 특허 네트워크에서 기술이 어떻게 진화하는지 확인 하는데 도움을 줄 수 있다. 왜냐하면 지식 내트워크내 노드로 표현되는 키워드들 간의 관계들이 기술이 만들어지는 구조를 나타내기 때문이다. 본 연구에서는 키워드 네트워크에는 핵심 노드가 존재한다는 기존 연구 결과를 기반으로 두 가지 가설을 세우고 이에 대한 검증으로 동종성 분석을 수행 하였다. 첫 번째 가설은 키워드 기반 특허 네트워크는 시간 흐름에 따라 비동종성을 띌 것으로 예측 하며, 동종성 분석을 통해 특허 네트워크가 진화함에 따라 비동종성을 보이는 것을 확인 하였다. 다음으로, 키워드 기반 특허 네트워크가 비동종성을 보일수록 클러스터링 계수 또한 낮아 질 것으로 예측하는 두 번째 가설에 대한 동종성 분석 결과, 네트워크의 동종성 계수가 낮아질수록 클러스터링 계수 또한 낮아진다는 사실을 확인 할 수 있었다. 또한, 두 번째 가설의 검증과정에서 확인 한 흥미로웠던 결과로써, 동종성 계수가 감소함에 따라 클러스터링 계수가 낮아지는 정도는 네트워크가 동종성을 보일 때 보다 비동종성을 보일 때가 훨씬 높았다.

정규화 신뢰도를 이용한 핵심어 검출 성능향상 (Improvement of Keyword Spotting Performance Using Normalized Confidence Measure)

  • 김철;이경록;김진영;최승호;최승호
    • 한국음향학회지
    • /
    • 제21권4호
    • /
    • pp.380-386
    • /
    • 2002
  • Rahim의 논문 (M.G. Rahim, et al., PROC. of ICASSP96, 1996)과 같은 기존의 후처리 방법은 음소 모델과 반모델 (anti-model)의 유사도를 이용하여 음소 단위 신뢰도를 계산하고, 이들의 평균을 단어 단위 신뢰도로 정의한다. 그런데 음소단위의 신뢰도가 동일한 확률밀도함수를 갖는 것이 아니기 때문에 특정단어의 경우 계산된 신뢰도는 대체로 낮은 값을 갖는다. 이를 극복하기 위한 방법으로서, 본 논문에서는 기존의 신뢰도를 통계적으로 정규화한 신뢰도를 제안한다. 즉 음소단위의 신뢰도가 가우시안 분포를 갖는다고 가정한 후 트라이 폰(sri-phone) 단위로 정규화하여 동일한 정규분포를 갖도록 한다. 본 논문에서는 제안된 방법의 검증을 위하여 문맥종속 핵심어 모델과 문맥독립 필러 모델을 이용한 일반적인 핵심어 검출기를 사용하였다. 실험결과 제안된 정규화 신뢰도 (NCM: Normalized Confidence Measure)가 불검출율 (WDR: Missed Detection Rate) 8%정도에서 오검출율 (PAR: false alarm rate)을 0.44에서 0.33 FA/KW/HR (false alarm/keyword/hour)로 저하시켰다. 이것은 오검출율에서 성능이 25% 향상된 것이다.

대화 말뭉치 구축을 위한 반자동 의미표지 태깅 시스템 (A Semi-Automatic Semantic Mark Tagging System for Building Dialogue Corpus)

  • 박준혁;이성욱;임윤섭;최종석
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제8권5호
    • /
    • pp.213-222
    • /
    • 2019
  • 지능형 음성 대화 인터페이스 구현에 있어 핵심어의 의미표지는 사용자 의도 파악을 위한 중요한 요소이다. 대화시스템은 사용자 발화의 의도를 파악하기 위해 핵심어와 그 의미표지를 이용하여 발화의 의도를 결정한다. 하나의 핵심어는 여러 개의 의미표지를 가질 수 있는 중의성을 지닌다. 이러한 중의성을 지닌 핵심어를 사용자의 의도와 일치하는 의미표지로 결정하는 것은 단어 의미 분별 문제와 유사하다. 우리는 전사된 대화 말뭉치의 약 23%를 수동으로 의미를 부착하여 핵심어에 대한 의미표지 사전, 유의어 사전, 문맥벡터 사전을 먼저 구축한 후, 나머지 77% 대화 말뭉치에 존재하는 핵심어의 의미를 자동으로 부착한다. 중의성을 가진 핵심어는 문맥벡터 사전으로부터 문맥 벡터 유사도를 계산하여 의미를 결정한다. 핵심어가 미등록어인 경우에는 유의어 사전을 이용하여 가장 유사한 핵심어를 찾아 그 핵심어의 의미를 부착한다. 중의성을 가진 고빈도 핵심어 3개와 저빈도 핵심어 3개를 말뭉치에서 선정하여 제안 시스템의 성능을 평가하였다. 실험결과, 수동으로 구축한 말뭉치를 사용하였을 때 약 54.4%의 정확도를 얻었고, 반자동으로 확장한 말뭉치를 사용하였을 때 약 50.0%의 정확도를 얻었다.

동시출현단어 분석에 기초한 지적구조 분석에서 키워드 유형별 특성에 관한 연구 - 국외 오픈액세스 분야를 중심으로 - (A Study on the Characteristics by Keyword Types in the Intellectual Structure Analysis Based on Co-word Analysis: Focusing on Overseas Open Access Field)

  • 김판준
    • 한국문헌정보학회지
    • /
    • 제55권3호
    • /
    • pp.103-129
    • /
    • 2021
  • 본 연구는 동시출현단어 분석에 기초한 지적구조 분석에서 주제를 표현하는 두 가지 키워드 유형의 특성에 관하여 국외 오픈액세스 분야를 중심으로 살펴보았다. 구체적으로 문헌정보학 분야 LISTA 데이터베이스에서 추출한 키워드 집합을 두 가지 유형(통제키워드, 비통제키워드)으로 구분하고, 동시출현단어 분석에 기초한 지적구조 분석을 수행한 결과를 비교하였다. 그 결과, 각 키워드 유형별로 키워드 집합, 연구지도와 영향력, 그리고 시기에 따라 상당한 차이가 있는 것으로 나타났다. 따라서 동시출현단어 분석에 기초한 지적구조 분석에서는 연구 목적에 따라 키워드 유형별 특성을 고려하여야 한다. 즉 전체 학문분야 관점에서 특정분야의 전반적인 연구 동향을 살펴보는 목적으로는 통제키워드를, 해당 분야 관점에서 연구 영역별로 세부적인 동향을 파악하는 목적으로는 비통제키워드를 사용하는 것이 더 적절할 것이다. 또한 양자의 관점을 모두 반영하는 종합적인 지적구조 분석을 위해서는 통제키워드와 비통제키워드를 개별적으로 사용한 결과를 상호 비교하여 분석하는 것이 가장 바람직하다고 할 수 있다.

미래신호 탐지 기법을 활용한 위성산업 시장의 진입 전략 수립 연구 (A Study on Establishing a Market Entry Strategy for the Satellite Industry Using Future Signal Detection Techniques)

  • 김세형;박재형;이한솔;강주영
    • 지능정보연구
    • /
    • 제29권3호
    • /
    • pp.249-265
    • /
    • 2023
  • 우주 산업은 세계적으로 잠재력이 높은 산업 분야로 여겨지지만, 국내에서는 아직 글로벌 시장에 비해 비교적 관심이 저조한 실정이다. 국내에서도 최근 위성산업은 전통적인 정부 주도의 산업에서 벗어난 민간 주도의 '뉴스페이스(New Space)' 패러다임에 관심을 기울이고 있다. 따라서, 본 연구의 목적은 국내 위성산업 관련 민간 기업의 시장 진입 전략을 결정하는 데 도움이 될 수 있는 미래의 신호를 탐색하는 것이다. 이를 위해 본 연구에서는 미래신호 이론과 Keyword Portfolio Map 등의 이론적 배경을 활용하여, 키워드 성장률과 키워드 등장 빈도 등을 바탕으로 특허 문서 데이터 내 키워드 잠재력을 분석한다. 또한, 뉴스 데이터를 추가로 수집하여 미래신호를 각각 first symptom, early information으로 구분하였다. 이는 해당 키워드가 특허문서 이외에 어떻게 실질적인 잠재력을 드러내는지에 대한 해석적 지표로 활용된다. 본 연구는 미래신호 탐색을 위한 데이터 수집과 분석 과정을 수록하였고, 키워드 맵의 시각화 자료를 통해 어떤 형태로 활용될 수 있는지 구체적으로 시각화함으로써 수집된 문서의 각각의 키워드가 약신호에서 강신호로 발전하는 과정을 추적하는 일련의 과정을 수록하였다. 본 연구의 과정은 기존 미래신호에 관한 연구의 방법론적인 기여와 활용 범위의 확장에 기여할 수 있고, 결과물은 위성 산업에서의 신산업 기획 및 연구 방향성 수립에 기여할 수 있다.

키워드 네트워크 분석과 토픽모델링을 활용한 정보활용교육 연구 동향 분석 (Analysis of Research Trends in Information Literacy Education Using Keyword Network Analysis and Topic Modeling)

  • 임정훈
    • 정보관리학회지
    • /
    • 제39권4호
    • /
    • pp.23-48
    • /
    • 2022
  • 본 연구는 키워드 네트워크 분석과 토픽모델링을 활용하여 국내 정보활용교육 연구의 흐름을 살펴보고 향후 정보활용교육의 방향성을 모색하는데 목적이 있다. 이를 위하여 국내 문헌정보학 분야의 학술지에 게재된 정보활용교육과 관련된 논문 306편을 선정하고, 논문의 초록을 대상으로 전처리 과정을 거쳐 전체 키워드 출현 빈도, 시기별 키워드 출현 빈도, 키워드 동시출현 빈도분석을 수행하였다. 이어서 키워드 네트워크 분석을 통해 키워드의 연결중심성과 매개중심성, 위세중심성을 분석하였다. 또한 구조적 토픽모델링 분석을 활용하여 15개의 토픽(교육과정, 정보활용교육 효과, 정보활용교육 내용, 학교도서관 교육, 정보매체활용, 정보활용능력 평가 지표, 도서관 불안, 공공도서관 프로그램, 대학도서관 이용자교육, 건강정보 활용능력, 정보격차, 도서관활 용수업 개선, 연구 동향, 정보활용교육 모델, 교사 역할)을 도출하고, 토픽별로 비중의 변화를 확인하기 위해 연도별 토픽 추이를 분석하였다. 이러한 결과를 바탕으로 정보활용교육의 방향성과 후속 연구에 대한 제언을 제시하였다.