• 제목/요약/키워드: MovieLens

검색결과 74건 처리시간 0.023초

클러스터링 기반 사례기반추론을 이용한 웹 개인화 추천시스템 (A Web Personalized Recommender System Using Clustering-based CBR)

  • 홍태호;이희정;서보밀
    • 지능정보연구
    • /
    • 제11권1호
    • /
    • pp.107-121
    • /
    • 2005
  • 최근, 추천시스템과 협업 필터링에 대한 연구가 학계와 업계에서 활발하게 이루어지고 있다. 하지만, 제품 아이템들은 다중 값 속성을 가질 수 있음에도 불구하고, 기존의 연구들은 이러한 다중 값 속성을 반영하지 못하고 있다. 이러한 한계를 극복하기 위하여, 본 연구에서는 추천시스템을 위한 새로운 방법론을 제시하고자 한다. 제안된 방법론은 제품 아이템에 대한 클러스터링 기법에 기반하여 다중 값 속성을 팔용하며, 정확한 추천을 위하여 협업 필터링을 적용한다. 즉, 사용자간의 상관관계만이 아니라 아이템간의 상관관계를 고려하기 위하여, 사용자 클러스터링에 기반한 사례기반추론과 아이템 속성 클러스터링에 기반한 사례기반추론 모두가 협업 필터링에 적용되는 것이다. 다중 값 속성에 기반하여 아이템을 클러스터링 함으로써, 아이템의 특징이 명확하게 식별될 수 있다. MovieLens 데이터를 이용하여 실험을 하였으며, 제안된 방법론이 기존 방법론의 성능을 능가한다는 결과를 얻을 수 있었다.

  • PDF

개인화 추천 시스템에서 FP-Tree를 이용한 연관 군집 방법 (Method of Associative Group Using FP-Tree in Personalized Recommendation System)

  • 조동주;임기욱;이정현;정경용
    • 한국콘텐츠학회논문지
    • /
    • 제7권10호
    • /
    • pp.19-26
    • /
    • 2007
  • 협력적 필터링은 아이템에 대한 선호도를 기반으로 이웃 선정 방법을 사용하므로 내용을 반영하지 못할뿐만 아니라 희박성 및 확장성 문제를 가지고 있다. 이러한 문제를 개선하기 위하여 아이템 기반 협력적 필터링이 실용화되었으나 아이템의 속성을 반영하지는 못한다. 본 논문에서는 기존의 개인화 추천 시스템의 문제점을 해결하기 위하여 FP-Tree를 이용한 연관 군집 방법을 제안하였다. 제안된 방법으로는 FP-Tree를 이용하여 후보집합의 발생없이 빈발항목을 구성하고 연관규칙을 생성한다. 생성된 연관 규칙의 신뢰도에 따라서 $\alpha-cut$을 사용하여 효율적인 연관 군집을 한다. 성능평가를 위해 MovieLens 데이터 집합에서 Gibbs Sampling, EM, K-means와 비교 평가하였다.

연관 아이템 트리를 이용한 추천 에이전트 (A Recommender Agent using Association Item Trees)

  • 고수정
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제36권4호
    • /
    • pp.298-305
    • /
    • 2009
  • 협력적 여과 시스템은 내용 기반 여과 시스템과는 대조적으로 아이템에 대한 정보를 반영하지 않으며, 또한 사용자가 자신의 흥미에 대한 정보를 제공하지 않았을 경우 추천을 할 수 없다는 단점을 갖는다. 본 논문에서는 협력적 여과 시스템의 단점을 해결하기 위하여 연관 아이템 트리를 이용한 추천 에이전트를 제안한다. 제안된 방법은 벡터 공간 모델과 K-means 알고리즘을 이용하여 사용자를 군집시킨 후 그룹의 대표 평가값을 추출한다. 다음으로, 군집된 그룹별로 아이템간의 상호정보량을 계산하여 아이템간의 연관도를 파악하며, 이를 기반으로 연관 아이템 트리를 생성한다. 이와 같이 생성한 각 그룹의 연관 아이템 트리와 그룹의 대표 평가값을 이용하여 새로운 사용자에게 아이템을 추천한다. 제안된 추천 에이전트는 사용자 정보와 아이템 정보를 병합하여 새로운 사용자에게 아이템을 추천하며, 아이템간의 유사도를 계산하기 위하여 상호정보량을 사용하고 이를 기반으로 연관 아이템 트리를 생성함으로써 초기에 아이템에 대하여 평가한 정보가 부족한 사용자에게 정확도가 높은 아이템을 추천할 수 있다는 장점을 갖는다. 제안된 방법은 MovieLens 추천 시스템의 데이터 집합을 사용하여 기존의 방법과 비교하였다.

협력적 여과 시스템에서 산포도를 이용한 잡음 감소 (Reducing Noise Using Degree of Scattering in Collaborative Filtering System)

  • 고수정
    • 정보처리학회논문지B
    • /
    • 제14B권7호
    • /
    • pp.549-558
    • /
    • 2007
  • 협력적 여과 시스템의 사용자-아이템 행렬은 사용자들이 아이템에 대하여 평가할 경우 사용자들의 감정 상태가 일정하지 않음으로 인하여 평가 결과에 잡음을 포함할 가능성이 높다. 이러한 문제점을 해결하기 위해 본 논문에서는 산포도를 이용하여 추천 정보로서 이용하기에 부적당한 평가값들을 제외시킴으로써 사용자-아이템 행렬을 최적화시키고, 아이템 정보와 사용자 정보를 반영하여 고유의 사용자의 평가값을 기반으로 선호도를 예측하였을 때 발생하는 잡음을 감소시킨다. 산포도의 변이계수가 갖는 단점을 보완하기 위하여 백분위수를 이용하여 극한적인 평가값을 제거하고, 사용자의 변이계수와 아이템의 중위수를 병합하여 가중치가 부여된 사용자-아이템 행렬을 구성한다. 마지막으로 이를 기반으로 새로운 사용자의 선호도를 예측한다. 제안된 방법은 영화에 대해 평가한 MovieLens 시스템의 데이터베이스를 이용하여 평가되었으며, 기존의 방법보다 성능이 높음을 보인다.

협업 필터링 추천에서 대응평균 알고리즘의 예측 성능에 관한 연구 (A study on the Prediction Performance of the Correspondence Mean Algorithm in Collaborative Filtering Recommendation)

  • 이석준;이희춘
    • 경영정보학연구
    • /
    • 제9권1호
    • /
    • pp.85-103
    • /
    • 2007
  • 본 연구의 목적은 좀 더 정확한 고객 선호도 예측을 위한 협업 필터링 알고리즘의 예측 성능을 평가하기 위한 것이다. 고객 선호도 예측의 정확도를 비교하기 위하여 이웃 기반의 협업 필터링 알고리즘과 대응평균 알고리즘에 의한 고객 선호도 예측의 MAE를 비교하였다. 예측 알고리즘의 정확성을 분석하기 위하여 MovieLens 1 Million dataset을 이용하여 실험을 하였다. 각 예측 알고리즘에 사용된 유사도 가중치는 일반적으로 이용되는 피어슨 상관계수와 벡터 유사도를 이용하였으며 분석결과 대응평균 알고리즘의 예측 정확도가 이웃 기반의 협업 필터링 알고리즘의 예측 정확도 보다 우수한 것으로 나타났다. 두 알고리즘에 사용된 유사도 가중치인 피어슨 상관계수와 벡터 유사도는 두 고객이 특정 상품에 대하여 공통으로 평가한 선호도 평가치를 이용하여 계산된다. 이때 공통으로 평가한 선호도 평가치의 개수가 적으면 계산된 유사도 가중치가 과대 평가된다. 과대 평가된 유사도 가중치를 보정하여 고객 선호도 예측의 정확도를 높이기 위하여 기존의 연구에서 고려한 공통 평가 영화의 개수 보다 확대된 범위를 적용하였으며 각 예측 방법에 따라 서로 다른 개선 경향을 파악할 수 있었다.

연관관계 군집 분할 방법을 이용한 아이템 필터링 시스템 (Item Filtering System Using Associative Relation Clustering Split Method)

  • 조동주;박양재;정경용
    • 한국콘텐츠학회논문지
    • /
    • 제7권6호
    • /
    • pp.1-8
    • /
    • 2007
  • 전자상거래에서 많은 아이템 중에 사용자에게 적합한 아이템을 추천하기 위해서는 많은 시간과 노력이 소요된다. 그러므로 추천 시스템이 사용자들을 대신하여 적합한 아이템을 추천해줄 수 있다면 만족을 얻을 수 있다. 본 논문에서는 정확성과 확장성을 향상시키기 위해서 협력적 필터링에서 연관관계 군집 분할 방법을 제안하였다. 평가한 데이터를 사용하여 연관 아이템간의 향상도를 산출하고 연관관계 군집의 효율성을 높이기 위해서 아이템으로 구성된 노드 군집을 분할하였다. 이는 군집들 중 하나의 아이템만이 연관성을 달리하고, 나머지 아이템들은 군집의 연관성이 충족되어진다면 결합하는 방법이다. 성능을 평가하기 위해서 MovieLens 데이터 집합에서 K-means와 EM에 의한 군집과 비교 평가하였다.

잠재적 속성 선호도를 이용한 협업 필터링의 데이터 희소성 문제 개선 방법 (Method to Improve Data Sparsity Problem of Collaborative Filtering Using Latent Attribute Preference)

  • 권형준;홍광석
    • 인터넷정보학회논문지
    • /
    • 제14권5호
    • /
    • pp.59-67
    • /
    • 2013
  • 본 논문에서는 협업 필터링의 선호도 예측 정확성의 저하를 초래하는 전통적 문제점 중 하나인 데이터 희소성 문제에 강인한 잠재적 속성 선호도 기반 협업 필터링 방법(Latent Attribute Rating-based Collaborative Filtering, LAR_CF)을 제안한다. 기존의 협업 필터링은 객체의 유사성을 판단하기 위한 특징벡터로써 사용자가 명시적으로 평가한 선호도만을 이용하며, 해당 문제 개선을 위해 속성을 사용하는 연구들은 범용적으로 사용하기 어려웠다. 이웃 기반 필터링에 근본을 두는 LAR_CF는 기존의 명시적 선호도와 함께 유사도 평가의 대상이 되는 두 객체의 고유한 속성을 특징벡터로 삼기 때문에 명시적 선호도의 수가 적어서 발생하는 데이터 희소성 문제를 개선하여 선호도 예측 정확도를 향상시키며, 속성의 종류에 구애받지 않고 손쉽게 적용할 수 있는 장점을 가진다. LAR_CF의 유효성 평가를 위해서 MovieLens 100k 데이터세트 및 해당 데이터세트에 사용된 속성정보를 활용하여 일반적 성능 실험과 인공적 데이터 희소성 실험에서 선호도 예측 정확도를 평가한 결과, 제안하는 방법이 데이터 희소 조건에서 선호도 예측 정확도를 향상시킬 수 있음을 확인하였다.

자기 조직화 신경망(SOM)을 이용한 협력적 여과 기법의 웹 개인화 시스템에 대한 연구 (Collaborative Filtering System using Self-Organizing Map for Web Personalization)

  • 강부식
    • 지능정보연구
    • /
    • 제9권3호
    • /
    • pp.117-135
    • /
    • 2003
  • 개인화 된 정보를 제공하기 위한 협력 여과 기법에 대한 많은 연구가 이루어지고 있는데, 유사 사용자들을 찾는 과정에서 상관계수와 같은 유사성 척도를 이용하여 모든 사용자와의 유사성을 계산하는 과정을 거친다. 이때 사용자 수가 많아지게 되면, 계산의 복잡도가 지수적으로 증가하게 되는 규모의 문제가 발생한다. 본 연구는 협력 여과 기법에서 주로 사용하는 유사성 척도가 사용자 집단이 커짐에 따라 계산의 복잡도가 지수적으로 증가하는 문제를 해결하기 위한 방안을 제시하는 것이 주목적이다. 규모의 문제를 해결하기 위해 클러스터링 모델 기반 접근 방식을 사용하고 아이템의 선호도 계산을 위해 RPM(Recency, Frequency, Momentary) 기준의 사용을 제안한다. 먼저 SOM을 이용하여 전체 사용자를 사용자 집단으로 클러스터링하고 사용자 집단별로 RFM 기준에 의해 아이템의 점수를 계산하여 선호도가 높은 순으로 정렬하여 저장한다. 사용자가 로그인하면 학습된 SOM을 이용하여 대상 사용자 집단을 선정하고 미리 저장된 추천 아이템을 추천한다. 추천결과에 대해 사용자가 평가하면 그 결과를 이용하여 현 시스템의 개정 여부를 결정한다. 제안한 방안에 대해 MovieLens 데이터 셋에 적용하여 실험한 결과 기존의 협력적 여과 기법에 비해 추천 성능이 비교적 우수하면서도 추천 시스템 운용시의 계산 복잡도를 일정하게 유지시킬 수 있음을 보였다.

  • PDF

이웃크기를 이용한 사용자기반과 아이템기반 협업여과의 결합예측 기법 (A Combined Forecast Scheme of User-Based and Item-based Collaborative Filtering Using Neighborhood Size)

  • 최인복;이재동
    • 정보처리학회논문지B
    • /
    • 제16B권1호
    • /
    • pp.55-62
    • /
    • 2009
  • 협업여과는 추천시스템에서 널리 사용되는 기법으로 다른 사용자의 평가를 기반으로 아이템을 추천하는 기법이다. 사용자 데이터베이스를 이용하는 메모리기반 협업여과에는 사용자기반 기법과 아이템기반 기법이 있다. 사용자기반 협업여과는 유사한 선호도를 가지는 이웃사용자들의 선호도를 바탕으로 특정 아이템에 대한 선호도를 예측하는 반면, 아이템기반 협업여과는 아이템들의 유사도를 바탕으로 특정 사용자의 선호도를 예측한다. 본 논문에서는 추천의 성능을 향상시키기 위하여 이웃사용자와 이웃아이템 크기의 비율을 가중치로 하여 사용자기반 예측값과 아이템기반 예측값을 결합함으로써 최종 예측값을 생성하는 결합예측기법을 제안한다. MovieLens 데이터 셋과 BookCrossing 데이터 셋을 이용한 실험을 통해 본 논문에서 제안한 결합예측기법이 영화와 책에 대하여 사용자기반과 아이템기반보다 예측의 정확성을 향상시킴을 보인다.

Enhancing Recommender Systems by Fusing Diverse Information Sources through Data Transformation and Feature Selection

  • Thi-Linh Ho;Anh-Cuong Le;Dinh-Hong Vu
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제17권5호
    • /
    • pp.1413-1432
    • /
    • 2023
  • Recommender systems aim to recommend items to users by taking into account their probable interests. This study focuses on creating a model that utilizes multiple sources of information about users and items by employing a multimodality approach. The study addresses the task of how to gather information from different sources (modalities) and transform them into a uniform format, resulting in a multi-modal feature description for users and items. This work also aims to transform and represent the features extracted from different modalities so that the information is in a compatible format for integration and contains important, useful information for the prediction model. To achieve this goal, we propose a novel multi-modal recommendation model, which involves extracting latent features of users and items from a utility matrix using matrix factorization techniques. Various transformation techniques are utilized to extract features from other sources of information such as user reviews, item descriptions, and item categories. We also proposed the use of Principal Component Analysis (PCA) and Feature Selection techniques to reduce the data dimension and extract important features as well as remove noisy features to increase the accuracy of the model. We conducted several different experimental models based on different subsets of modalities on the MovieLens and Amazon sub-category datasets. According to the experimental results, the proposed model significantly enhances the accuracy of recommendations when compared to SVD, which is acknowledged as one of the most effective models for recommender systems. Specifically, the proposed model reduces the RMSE by a range of 4.8% to 21.43% and increases the Precision by a range of 2.07% to 26.49% for the Amazon datasets. Similarly, for the MovieLens dataset, the proposed model reduces the RMSE by 45.61% and increases the Precision by 14.06%. Additionally, the experimental results on both datasets demonstrate that combining information from multiple modalities in the proposed model leads to superior outcomes compared to relying on a single type of information.