• 제목/요약/키워드: web Graph

검색결과 218건 처리시간 0.026초

IoT 기반 모바일 스마트 태양광 발전 모니터링 시스템 (IoT based Mobile Smart Monitoring System for Solar Power Generation)

  • 이재진;김기훈;박수빈;변형준;심규성;안병구
    • 전자공학회논문지
    • /
    • 제54권8호
    • /
    • pp.55-64
    • /
    • 2017
  • 본 논문에서는 IoT 기반의 모바일 태양광 발전 모니터링 시스템을 안전진단 관점에서 제안하고 구현한다. 본 논문의 특징 및 기여도는 다음과 같다. 첫째, 제안하는 시스템 모델은 일정 시간마다 스스로 태양광 발전 시스템 및 구조물 상태를 안전진단 관점에서 측정할 수 있다. 둘째, 제안된 시스템은 태양광 발전 구조물 상태를 자동적으로 측정한 데이터를 재가공하여 데이터-베이스에 저장한다. 셋째, 제안하는 시스템은 재 가공되어 저장된 정보를 활용하여, 관리자와 태양광 발전구조물 소유자에게 모니터링 정보를 웹페이지 형태로 제공하여, 직접 태양광 구조물에 가지 않고도 구조물의 상태를 안전진단 관점에서 측정할 수 있다. 넷째, 모니터링 정보를 위해서 제공되는 웹페이지는 장치에 상관없이 접속이 가능하다. 제안된 시스템의 성능평가 결과, 태양광 발전 구조물에 설치된 센서로부터 수신된 데이터를 일정시간마다 수집서버 내 데이터베이스에 효과적으로 저장한다. 그리고 저장된 데이터를 사용자와 관리자가 상시적으로 장소에 구애받지 않고 구축된 웹페이지에 모바일 폰과 데스크탑 컴퓨터에서 접속하여 구조물 상태에 대한 정보를 효과적인 그래프 형태로 제공할 수 있다.

다목적 및 고활용성을 위한 객체지향 모델링 기반의 전자 측량기준점 모니터링 S/W 구현 (A Implementation of Electronic Measurement Datum Point Monitoring S/W based on Object-Oriented Modeling for Multi Purpose and High Availability)

  • 정세훈;심춘보
    • 한국컴퓨터정보학회논문지
    • /
    • 제20권2호
    • /
    • pp.99-112
    • /
    • 2015
  • 표시점의 위치 및 고도를 표시하기 위한 기준점은 각종 측량에 유용하게 활용되는 장점을 가지고 있다. 그러나 기상 변화 및 지각 변화 등의 이유로 손 망실되는 사례가 급증하고 있으며, 무의미하게 방치되는 기준점이 늘어나고 있는 실정이다. 이에 본 논문에서는 기존 측량기준점의 활용성을 극대화할 뿐만 아니라 기준점 주변의 각종 환경 데이터 수집과 주변 지역의 지각변동 감지 기능 등이 포함된 다목적 전자 측량기준점 시스템모니터링 S/W를 설계 및 구현한다. 제안하는 S/W는 S/W의 재사용성 및 확장성을 충분히 지원할 수 있도록 객체지향 모델링 기법을 이용하여 설계하고 구현한다. 본 S/W에서는 전자측량 기준점 관리자를 위한 GUI 뿐만 아니라, 웹 및 모바일 사용자를 위한 GUI를 지원한다. 제공하는 GUI에서는 전자 측량기준점의 손 망실 예방 및 지각 변동을 감지하기 위해 측위된 위치정보 및 각종 센싱 정보를 데이터베이스에 실시간으로 저장하고 분석할 수 있도록 각종 데이터를 위한 그래프 GUI 지원한다. 아울러 QR-Code 및 RFID 인식 기능도 포함되어 있다. 마지막으로, 자이로센서를 이용한 지각 변화 감지 및 GPS 위치 오차율을 확인하기 위해 성능평가 결과를 제시한다.

Sentiment Analysis of Product Reviews to Identify Deceptive Rating Information in Social Media: A SentiDeceptive Approach

  • Marwat, M. Irfan;Khan, Javed Ali;Alshehri, Dr. Mohammad Dahman;Ali, Muhammad Asghar;Hizbullah;Ali, Haider;Assam, Muhammad
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제16권3호
    • /
    • pp.830-860
    • /
    • 2022
  • [Introduction] Nowadays, many companies are shifting their businesses online due to the growing trend among customers to buy and shop online, as people prefer online purchasing products. [Problem] Users share a vast amount of information about products, making it difficult and challenging for the end-users to make certain decisions. [Motivation] Therefore, we need a mechanism to automatically analyze end-user opinions, thoughts, or feelings in the social media platform about the products that might be useful for the customers to make or change their decisions about buying or purchasing specific products. [Proposed Solution] For this purpose, we proposed an automated SentiDecpective approach, which classifies end-user reviews into negative, positive, and neutral sentiments and identifies deceptive crowd-users rating information in the social media platform to help the user in decision-making. [Methodology] For this purpose, we first collected 11781 end-users comments from the Amazon store and Flipkart web application covering distant products, such as watches, mobile, shoes, clothes, and perfumes. Next, we develop a coding guideline used as a base for the comments annotation process. We then applied the content analysis approach and existing VADER library to annotate the end-user comments in the data set with the identified codes, which results in a labelled data set used as an input to the machine learning classifiers. Finally, we applied the sentiment analysis approach to identify the end-users opinions and overcome the deceptive rating information in the social media platforms by first preprocessing the input data to remove the irrelevant (stop words, special characters, etc.) data from the dataset, employing two standard resampling approaches to balance the data set, i-e, oversampling, and under-sampling, extract different features (TF-IDF and BOW) from the textual data in the data set and then train & test the machine learning algorithms by applying a standard cross-validation approach (KFold and Shuffle Split). [Results/Outcomes] Furthermore, to support our research study, we developed an automated tool that automatically analyzes each customer feedback and displays the collective sentiments of customers about a specific product with the help of a graph, which helps customers to make certain decisions. In a nutshell, our proposed sentiments approach produces good results when identifying the customer sentiments from the online user feedbacks, i-e, obtained an average 94.01% precision, 93.69% recall, and 93.81% F-measure value for classifying positive sentiments.

교육학 분야에서 CiteSpace에 기초한 구성주의 연구 동향 탐색 (A Dynamic exploration of Constructivism Research based on Citespace Software in the Filed of Education)

  • 장위신;송선희
    • 한국콘텐츠학회논문지
    • /
    • 제22권5호
    • /
    • pp.576-584
    • /
    • 2022
  • 구성주의는 인지심리학의 중요한 한 갈래로 현재 교육학 분야와 심리학 분야에 모두 커다란 영향을 미치고 있다. 본 연구는 CiteSpace 시각화 소프트웨어를 분석 도구로 사용하여 최근 35년간 교육분야에서 구성주의에 관한 연구문헌에 대한 지식지도 분석을 하였다. 이를 위하여 'WOS(web of science)' 데이터베이스를 기초로 국외문헌분석을 위하여 'WOS 핵심 데이터베이스'의 문헌들을 사용하였고, 국내문헌분석을 위하여 'KCI(Korean Journal Database)데이터베이스'의 문헌들을 분석하였다. 분석 방향은 발표연도, 연구가 이루어진 국가(지역), 연구자, 기관 또는 대학별 협력관계 분석, 주제어 분석이었다. 연구를 통해 얻은 결론은 세 가지이다. 첫째, 구성주의라는 주제에 관한 연구는 1986년부터 지금까지 이어지고 있으며 현재는 안정적인 발전단계이다. 둘째, 구성주의라는 주제로 연구가 많이 이루어진 국가는 미국, 캐나다, 영국, 호주, 네덜란드 순이다. 연구의 주요 기관과 연구자도 주로 이들 국가에 분포돼 있다. 셋째, 현재 구성주의 연구들의 주제어는 'instructional strategies(교수전략)' 집합에 집중되어 있으며, 과학기술의 발전이 개인 학습에 영향을 미치고 있다. 향후 교수전략은 구성주의 연구의 중점내용이 될 것이며, 교수공학의 발달로 새로운 교수모델 개발과 관련된 연구가 이루어질 필요가 있다.

클라우드 환경에서 MongoDB 기반의 비정형 로그 처리 시스템 설계 및 구현 (Design and Implementation of MongoDB-based Unstructured Log Processing System over Cloud Computing Environment)

  • 김명진;한승호;최운;이한구
    • 인터넷정보학회논문지
    • /
    • 제14권6호
    • /
    • pp.71-84
    • /
    • 2013
  • 컴퓨터 시스템 운용 간에 발생하는 많은 정보들이 기록되는 로그데이터는 컴퓨터 시스템 운용 점검, 프로세스의 최적화, 사용자 최적화 맞춤형 제공 등 다방면으로 활용되고 있다. 본 논문에서는 다양한 종류의 로그데이터들 중에서 은행에서 발생하는 대용량의 로그데이터를 처리하기 위한 클라우드 환경 하에서의 MongoDB 기반 비정형 로그 처리시스템을 제안한다. 은행업무간 발생하는 대부분의 로그데이터는 고객의 업무처리 프로세스 간에 발생하며, 고객 업무 프로세스 처리에 따른 로그데이터를 수집, 저장, 분류, 분석하기 위해서는 별도로 로그데이터를 처리하는 시스템을 구축해야만 한다. 하지만 기존 컴퓨팅환경 하에서는 폭발적으로 증가하는 대용량 비정형 로그데이터 처리를 위한 유연한 스토리지 확장성 기능, 저장된 비정형 로그데이터를 분류, 분석 처리할 수 있는 기능을 구현하기가 매우 어렵다. 이에 따라 본 논문에서는 클라우드 컴퓨팅 기술을 도입하여 기존 컴퓨팅 인프라 환경의 분석 도구 및 관리체계에서 처리하기 어려웠던 비정형 로그데이터를 처리하기 위한 클라우드 환경기반의 로그데이터 처리시스템을 제안하고 구현하였다. 제안한 본 시스템은 IaaS(Infrastructure as a Service) 클라우드 환경을 도입하여 컴퓨팅 자원의 유연한 확장성을 제공하며 실제로, 로그데이터가 장기간 축적되거나 급격하게 증가하는 상황에서 스토리지, 메모리 등의 자원을 신속성 있고 유연하게 확장을 할 수 있는 기능을 포함한다. 또한, 축적된 비정형 로그데이터의 실시간 분석이 요구되어질 때 기존의 분석도구의 처리한계를 극복하기 위해 본 시스템은 하둡 (Hadoop) 기반의 분석모듈을 도입함으로써 대용량의 로그데이터를 빠르고 신뢰성 있게 병렬 분산 처리할 수 있는 기능을 제공한다. 게다가, HDFS(Hadoop Distributed File System)을 도입함으로써 축적된 로그데이터를 블록단위로 복제본을 생성하여 저장관리하기 때문에 본 시스템은 시스템 장애와 같은 상황에서 시스템이 멈추지 않고 작동할 수 있는 자동복구 기능을 제공한다. 마지막으로, 본 시스템은 NoSQL 기반의 MongoDB를 이용하여 분산 데이터베이스를 구축함으로써 효율적으로 비정형로그데이터를 처리하는 기능을 제공한다. MySQL과 같은 관계형 데이터베이스는 복잡한 스키마 구조를 가지고 있기 때문에 비정형 로그데이터를 처리하기에 적합하지 않은 구조를 가지고 있다. 또한, 관계형 데이터베이스의 엄격한 스키마 구조는 장기간 데이터가 축적되거나, 데이터가 급격하게 증가할 때 저장된 데이터를 분할하여 여러 노드에 분산시키는 노드 확장이 어렵다는 문제점을 가지고 있다. NoSQL은 관계형 데이터베이스에서 제공하는 복잡한 연산을 지원하지는 않지만 데이터가 빠르게 증가할 때 노드 분산을 통한 데이터베이스 확장이 매우 용이하며 비정형 데이터를 처리하는데 매우 적합한 구조를 가지고 있는 비관계형 데이터베이스이다. NoSQL의 데이터 모델은 주로 키-값(Key-Value), 컬럼지향(Column-oriented), 문서지향(Document-Oriented)형태로 구분되며, 제안한 시스템은 스키마 구조가 자유로운 문서지향(Document-Oriented) 데이터 모델의 대표 격인 MongoDB를 도입하였다. 본 시스템에 MongoDB를 도입한 이유는 유연한 스키마 구조에 따른 비정형 로그데이터 처리의 용이성뿐만 아니라, 급격한 데이터 증가에 따른 유연한 노드 확장, 스토리지 확장을 자동적으로 수행하는 오토샤딩 (AutoSharding) 기능을 제공하기 때문이다. 본 논문에서 제안하는 시스템은 크게 로그 수집기 모듈, 로그 그래프생성 모듈, MongoDB 모듈, Hadoop기반 분석 모듈, MySQL 모듈로 구성되어져 있다. 로그 수집기 모듈은 각 은행에서 고객의 업무 프로세스 시작부터 종료 시점까지 발생하는 로그데이터가 클라우드 서버로 전송될 때 로그데이터 종류에 따라 데이터를 수집하고 분류하여 MongoDB 모듈과 MySQL 모듈로 분배하는 기능을 수행한다. 로그 그래프생성 모듈은 수집된 로그데이터를 분석시점, 분석종류에 따라 MongoDB 모듈, Hadoop기반 분석 모듈, MySQL 모듈에 의해서 분석되어진 결과를 사용자에게 웹 인터페이스 형태로 제공하는 역할을 한다. 실시간적 로그데이터분석이 필요한 로그데이터는 MySQL 모듈로 저장이 되어 로그 그래프생성 모듈을 통하여 실시간 로그데이터 정보를 제공한다. 실시간 분석이 아닌 단위시간당 누적된 로그데이터의 경우 MongoDB 모듈에 저장이 되고, 다양한 분석사항에 따라 사용자에게 그래프화해서 제공된다. MongoDB 모듈에 누적된 로그데이터는 Hadoop기반 분석모듈을 통해서 병렬 분산 처리 작업이 수행된다. 성능 평가를 위하여 로그데이터 삽입, 쿼리 성능에 대해서 MySQL만을 적용한 로그데이터 처리시스템과 제안한 시스템을 비교 평가하였으며 그 성능의 우수성을 검증하였다. 또한, MongoDB의 청크 크기별 로그데이터 삽입 성능평가를 통해 최적화된 청크 크기를 확인하였다.

시스템 다이내믹스 기법을 활용한 온라인 쇼핑몰의 전략에 관한 연구 : 소비자의 구매 및 재구매 행동을 중심으로 (A Study for Strategy of On-line Shopping Mall: Based on Customer Purchasing and Re-purchasing Pattern)

  • 이상근;민석기;강민철
    • Asia pacific journal of information systems
    • /
    • 제18권3호
    • /
    • pp.91-121
    • /
    • 2008
  • Electronic commerce, commonly known as e-commerce or eCommerce, has become a major business trend in these days. The amount of trade conducted electronically has grown extraordinarily by developing the Internet technology. Most electronic commerce has being conducted between businesses to customers; therefore, the researches with respect to e-commerce are to find customer's needs, behaviors through statistical methods. However, the statistical researches, mostly based on a questionnaire, are the static researches, They can tell us the dynamic relationships between initial purchasing and repurchasing. Therefore, this study proposes dynamic research model for analyzing the cause of initial purchasing and repurchasing. This paper is based on the System-Dynamic theory, using the powerful simulation model with some restriction, The restrictions are based on the theory TAM(Technology Acceptance Model), PAM, and TPB(Theory of Planned Behavior). This article investigates not only the customer's purchasing and repurchasing behavior by passing of time but also the interactive effects to one another. This research model has six scenarios and three steps for analyzing customer behaviors. The first step is the research of purchasing situations. The second step is the research of repurchasing situations. Finally, the third step is to study the relationship between initial purchasing and repurchasing. The purpose of six scenarios is to find the customer's purchasing patterns according to the environmental changes. We set six variables in these scenarios by (1) changing the number of products; (2) changing the number of contents in on-line shopping malls; (3) having multimedia files or not in the shopping mall web sites; (4) grading on-line communities; (5) changing the qualities of products; (6) changing the customer's degree of confidence on products. First three variables are applied to study customer's purchasing behavior, and the other variables are applied to repurchasing behavior study. Through the simulation study, this paper presents some inter-relational result about customer purchasing behaviors, For example, Active community actions are not the increasing factor of purchasing but the increasing factor of word of mouth effect, Additionally. The higher products' quality, the more word of mouth effects increase. The number of products and contents on the web sites have same influence on people's buying behaviors. All simulation methods in this paper is not only display the result of each scenario but also find how to affect each other. Hence, electronic commerce firm can make more realistic marketing strategy about consumer behavior through this dynamic simulation research. Moreover, dynamic analysis method can predict the results which help the decision of marketing strategy by using the time-line graph. Consequently, this dynamic simulation analysis could be a useful research model to make firm's competitive advantage. However, this simulation model needs more further study. With respect to reality, this simulation model has some limitations. There are some missing factors which affect customer's buying behaviors in this model. The first missing factor is the customer's degree of recognition of brands. The second factor is the degree of customer satisfaction. The third factor is the power of word of mouth in the specific region. Generally, word of mouth affects significantly on a region's culture, even people's buying behaviors. The last missing factor is the user interface environment in the internet or other on-line shopping tools. In order to get more realistic result, these factors might be essential matters to make better research in the future studies.

소의 경제형질 관련 유전자 네트워크 분석 시스템 구축 (Construction of Gene Network System Associated with Economic Traits in Cattle)

  • 임다정;김형용;조용민;채한화;박종은;임규상;이승수
    • 생명과학회지
    • /
    • 제26권8호
    • /
    • pp.904-910
    • /
    • 2016
  • 가축의 경제형질은 대부분 복합형질 상태이며, 많은 유전자와 생물대사회로에 의해 조절된다. 시스템 생물학은 생명현상을 하나의 복합체로 가정하고, 형질에 관여하는 유전자들에 대한 기능적 관계를 분석하는 학문이다. 유전자 네트워크는 시스템 생물학의 하나의 연구분야로써, 유전자 기능의 상관관계를 지도화하여 오믹스 데이터를 통합 분석하여 해석한다. 유전자 네트워크는 단백질-단백질 상호작용, 공발현, 조절인자, 유전자형 기반으로 다양한 유전자의 기능적 상호작용을 표현할 수 있다. 또한, 네트워크를 구성하기 위해서는 유전자 간 연결 정도에 가중치를 두거나, 인접한 유전자 수 계산 등의 네트워크 토폴로지 알고리즘이 적용된다. 가축에서는 이러한 연구가 단형질에 대한 유전자 발현, 단백질 상호작용 등에 국한되어 있는 실정이다. 본 논문에서는 유전자 공발현 네트워크와 단백질-단백질 상호작용 네트워크 분석법을 확립하고 소의 102개 경제형질에 대하여 유전자 네트워크 분석 결과에 대한 데이터베이스를 구축하였다. 102개의 경제형질은 Animal Trait Ontology (ATO) 명명법에 의하여 분류하여 제공하였다. 각 형질에 포함된 유전자 리스트는 Animal QTL database에서 제공하는 양적유전형질좌위의 물리적 위치에 존재하는 유전자군을 추출하였다. 유전자 공발현 네트워크는 R의 WGCNA 패키지를 활용하였으며, 단백질-단백질 상호작용 네트워크는 Human Protein Reference Database에서 사람과 소의 orthologous group에 포함된 유전자를 대상으로 단백질 상호작용 관계를 규명하였다. 네트워크 분석 결과는 관계형 테이블로 구축하였으며, 구축한 데이터베이스를 관련 연구진에게 공유하기 위하여 웹 기반의 유전자 네트워크 가시화 시스템을 구현하였다(http://www.nabc.go.kr/cg). 웹 데이터베이스 구현을 위하여 Ontle 프로그램을 활용하여 다양한 방식으로 유전자 네트워크 가시화 작업을 수행하였다. 이 시스템을 통하여 사용자는 관련 형질의 후보 유전자군 탐색, 유전자 네트워크 분석 결과, 유전자 사이의 기능적 연결관계를 손쉽게 살펴볼 수 있게 될 것이다.

영화 추천 시스템의 초기 사용자 문제를 위한 장르 선호 기반의 클러스터링 기법 (Clustering Method based on Genre Interest for Cold-Start Problem in Movie Recommendation)

  • 유띳로따낙;누르지드;하인애;조근식
    • 지능정보연구
    • /
    • 제19권1호
    • /
    • pp.57-77
    • /
    • 2013
  • 소셜 미디어는 모바일 어플리케이션과 웹에서 가장 많이 사용되는 미디어 중 하나이다. Nielsen사의 보고서에 따르면 소셜 네트워크 서비스와 블로그가 온라인 사용자의 주 활동 공간으로 사용되고 있으며, 미국인 중에서 온라인 활동이 왕성한 5명의 사용자중 4명은 매일 소셜 네트워크 서비스와 블로그를 방문하고 온라인 활동 시간의 23%를 소비한다고 집계하고 있다. 미국의 인터넷 사용자들은 야후, 구글, AOL 미디어 네트워크, 트위터, 링크드인 등과 같은 소셜 네트워크 서비스중 페이스북에서 가장 많은 시간을 소비한다. 최근에는 대부분의 회사들이 자신의 특정 상품에 대하여 "페이스북 페이지(Facebook Page)"를 생성하고 상품에 대한 프로모션을 진행한다. 페이스북에서 제공되는 "좋아요" 옵션은 페이스북 페이지를 통해 자신이 관심을 가지는 상품(아이템)을 표시하고 그 상품을 지지할 수 있도록 한다. 많은 영화를 제작하는 영화 제작사들도 페이스북 페이지와 "좋아요" 옵션을 이용하여 영화 프로모션과 마케팅에 이용한다. 일반적으로 다수의 스트리밍 서비스 제공업들도 영화와 TV 프로그램을 즐기며 볼 수 있는 서비스를 사용자들에게 제공한다. 이 서비스는 일반 컴퓨터와 TV 등의 단말기에서인터넷을 통해 영화와 TV 프로그램을 즉각적으로 제공할 수 있다. 스트리밍 서비스의 선두 주자인 넷플릭스는 미국, 라틴 아메리카, 영국 그리고 북유럽 국가 등에 3천만 명 이상의 스트리밍 사용자가 가입되어 있다. 또한 넥플릭스는 다양한 장르로 구성된 수백만 개의 영화와 TV 프로그램을 보유하고 있다. 하지만 수많은 콘텐츠로 인해 사용자들은 자신이 선호하는 장르에 관련된 영화와 TV 프로그램을 찾기 위해 많은 시간을 소비해야 된다. 많은 연구자들이 이러한 사용자의 불편함을 줄이기 위해 아이템에 대한 사용자가 보지 않은 아이템에 대한 선호도를 예측하고 높은 예측값을 갖는 아이템을 사용자에게 제공하기 위한 추천 시스템을 적용하였다. 협업적 여과 방법은 추천 시스템을 구축하기 위해 가장 많이 사용되는 방법이다. 협업적 여과 시스템은 사용자들이 평가한 아이템을 기반으로 각 사용자 간의 유사도를 측정하고 목적 사용자와 유사한 성향을 가진 사용자 그룹을 결정한다. 군집된 그룹은 이웃 사용자 집단으로 불리며 이를 이용하여 특정 아이템에 대한 선호도를 예측하고, 예측 값이 높은 아이템을 목적 사용자에게 추천해 준다. 협업적 여과 방법이 적용되는 분야는 서적, 음악, 영화, 뉴스 및 비디오 등 다양하지만 논문에서는 영화에 초점을 맞춘다. 이 협업적 여과 방법이 추천 시스템 내에서 유용하게 활용되고 있지만 아직 "희박성 문제"와 "콜드 스타트 문제" 등 해결해야 할 과제가 남아있다. 희박성 문제는 아이템의 수가 증가할수록 아이템에 대한 사용자의 로그 밀도가 감소하는 것이다. 즉, 전체 아이템 수에 비해 사용자가 아이템에 대해 평가한 정보가 충분하지 않기 때문에 사용자의 성향을 파악하기 어렵고, 이로 인해 사용자가 아직 평가하지 않은 아이템에 대해서 선호도를 추측하기 어려운 것을 말한다. 이 희박성 문제가 포함된 경우 적합한 이웃 사용자 집단을 형성하는데 어려움을 겪게 되고 사용자들에게 제공되는 아이템 추천의 질이 떨어지게 된다. 콜드 스타트 문제는 시스템 내에 새로 들어온 사용자 또는 아이템으로 지금까지 한 번도 평가를 하지 않은 경우에 발생한다. 즉, 사용자가 평가한 아이템에 대한 정보가 전혀 포함되어 있지 않거나 매우 적기 때문에 이러한 경우 또한 적합한 이웃 사용자 집단을 형성하는데 어려움을 겪게 되고 사용자가 평가하지 않은 아이템에 대한 선호도 예측의 정확성이 감소되게 된다. 본 논문에서는 영화 추천 시스템에서 발생될 수 있는 초기 사용자 문제를 해결하기 위하여 사용자가 평가한 영화와 소셜 네트워크 서비스로부터 추출된 사용자 선호 장르를 활용하여 사용자 군집을 형성하고 이를 활용하는 방법을 제안한다. 소셜 네트워크 서비스로부터 사용자가 선호하는 영화 장르를 추출하기 위해 페이스북 페이지의 '좋아요' 옵션을 이용하며, 이 '좋아요' 정보를 분석하여 사용자의 영화 장르 관심사를 추출한다. 페이스북의 영화 페이지는 각 영화를 위한 페이스북 페이지로 구성되고 있으며, 사용자는 자신의 선호도에 따라서 "좋아요" 옵션을 선택할 수 있다. 사용자의 페이스북 정보는 페이스북 그래프 API를 활용하여 추출되고 이로부터 사용자 선호 영화를 알 수 있게 된다. 시스템에서 활용되는 영화 정보는 인터넷 영화 데이터베이스인 IMDb로부터 획득한다. IMDb는 수많은 영화와 TV 프로그램을 보유하고 있으며, 각 영화에 관련된 배우 정보, 장르 및 부가 정보들을 포함한다. 논문에서는 사용자가 "좋아요" 표시를 한 영화 페이지를 이용하여 IMDb로부터 영화 장르 정보를 가져온다. 그리고 추출된 영화 장르 선호도와 본 시스템에서 제안하는 영화 평가 항목을 이용하여 유사한 이웃 사용자 집단을 구성한 후, 사용자가 평가하지 않은 아이템에 대한 선호도를 예측하고, 높은 예측 값을 갖는 아이템을 사용자에게 추천한다. 본 논문에서 제안한 사용자의 선호 장르 기반의 사용자 군집 기법을 이용한 시스템을 평가하기 위해서 IMDb 데이터 집합을 이용하여 사용자 영화 평가 시스템을 구축하였고 참가자들의 영화 평가 정보를 획득하였다. 페이스북 영화 페이지 정보는 참가자들의 페이스북 계정과 페이스북 그래프 API를 통해 획득하였다. 사용자 영화 평가 시스템을 통해 획득된 사용자 데이터를 제안하는 방법에 적용하였고 추천 성능, 품질 및 초기 사용자 문제를 벤치마크 알고리즘과 비교하여 평가하였다. 실험 평가의 결과 제안하는 방법을 적용한 추천 시스템을 통해 추천의 품질을 10% 향상시킬 수 있었고, 초기 사용자 문제에 대해서 15% 완화시킬 수 있음을 볼 수 있었다.