• 제목/요약/키워드: 영화 평점

검색결과 53건 처리시간 0.023초

Word2Vec과 앙상블 합성곱 신경망을 활용한 영화추천 시스템의 정확도 개선에 관한 연구 (A Study on the Accuracy Improvement of Movie Recommender System Using Word2Vec and Ensemble Convolutional Neural Networks)

  • 강부식
    • 디지털융복합연구
    • /
    • 제17권1호
    • /
    • pp.123-130
    • /
    • 2019
  • 웹 추천기법에서 가장 많이 사용하는 방식 중의 하나는 협업필터링 기법이다. 협업필터링 관련 많은 연구에서 정확도를 개선하기 위한 방안이 제시되어 왔다. 본 연구는 Word2Vec과 앙상블 합성곱 신경망을 활용한 영화추천 방안에 대해 제안한다. 먼저 사용자, 영화, 평점 정보에서 사용자 문장과 영화 문장을 구성한다. 사용자 문장과 영화 문장을 Word2Vec에 입력으로 넣어 사용자 벡터와 영화 벡터를 구한다. 사용자 벡터는 사용자 합성곱 모델에 입력하고, 영화 벡터는 영화 합성곱 모델에 입력한다. 사용자 합성곱 모델과 영화 합성곱 모델은 완전연결 신경망 모델로 연결된다. 최종적으로 완전연결 신경망의 출력 계층은 사용자 영화 평점의 예측값을 출력한다. 실험결과 전통적인 협업필터링 기법과 유사 연구에서 제안한 Word2Vec과 심층 신경망을 사용한 기법에 비해 본 연구의 제안기법이 정확도를 개선함을 알 수 있었다.

빅데이터 분석을 통한 천만 관객 영화 예측 모델 (A Model of Predictive Movie 10 Million Spectators through Big Data Analysis)

  • 우종필;이응환
    • 한국빅데이터학회지
    • /
    • 제3권1호
    • /
    • pp.63-71
    • /
    • 2018
  • 최근 5년(2013~2017년) 연속 영화 총 관객 수가 2억 명이 넘는 국내 영화 산업에서 천만 관객을 돌파한 한국 영화 간에는 어떤 요인이 영향을 미쳤는지 분석해 보았다. 일반적으로 천만 관객 돌파에 영향을 주는 요인으로는 스크린 수와 평점을 중요하게 보는 시각이 많았다. 본 연구에서는 스크린 수, 평점을 포함하고 추가적으로 4가지 요인을 설정하여 가설을 수립하고 빅데이터 분석을 통해 천만 관객 돌파 유무와의 상관관계를 분석했다. 이를 통해 천만 관객 돌파 예측 정확도는 91%, 누적 관객 수 예측 정확도는 99.4%까지 맞추는 유의미한 결과를 얻었다.

Fuzzy-AHP와 Word2Vec 학습 기법을 이용한 영화 추천 시스템 (A Movie Recommendation System based on Fuzzy-AHP and Word2vec)

  • 오재택;이상용
    • 디지털융복합연구
    • /
    • 제18권1호
    • /
    • pp.301-307
    • /
    • 2020
  • 최근 추천 시스템은 5G 시대의 시작과 동시에 여러 분야에서 도입하고 있으며, 주로 도서나 영화, 음악 분야의 서비스에서 크게 두각을 나타내고 있다. 그러나 이러한 추천 시스템에서 사용자마다 선호하는 정도가 주관적이고, 불확실하여 정확한 추천 서비스를 제공하기가 어렵다. 추천 시스템의 성능을 향상시키기 위해서는 많은 양의 학습 데이터가 필요하며, 추론 기술이 보다 정확해야 한다. 이러한 문제점을 해결하기 위하여 본 연구에서는 Fuzzy-AHP와 Word2Vec 학습 기법을 이용한 영화 추천 시스템을 제안하였다. 본 시스템에서는 사용자의 선호도를 객관적으로 예측하기 위해 Fuzzy-AHP를 사용하였으며, 스크레이핑한 데이터를 분류하기 위해 Word2Vec 학습 기법을 사용하였다. 본 시스템의 성능을 평가하기 위해 그리드 서치를 이용하여 Word2Vec 학습 결과의 정확도를 측정하였고, 그 후 본 시스템이 예측한 평점과 관객들이 평가한 영화의 평점 간 차이를 비교하였다. 그 결과 최적의 교차 검증 정확도가 91.4%로 우수한 성능을 나타내었으며, 예측한 평점과 관객들이 평가한 영화의 평점 간 차이를 Fuzzy-AHP 시스템과 비교한 결과 10% 정도 우수함을 확인할 수 있었다.

영화흥행 영향요인 선택에 관한 연구 (A Study for the Drivers of Movie Box-office Performance)

  • 김연형;홍정한
    • 응용통계연구
    • /
    • 제26권3호
    • /
    • pp.441-452
    • /
    • 2013
  • 국내 영화 산업은 투자 배급사 멀티플렉스로 수직 계열화된 대기업 중심으로 온라인 구전 마케팅이 활발히 진행되고 있다, 최근에는 대기업 계열의 멀티플렉스 영화관 중심으로 3D 4D 영화포맷 복합상영을 통해 up-selling을 통한 흥행성과 극대화를 도모하고 있다. 영화산업 기술진보와 흥행여건 변화에 따라, 기존 관객 수 대신 매출액을 흥행성과로 정의하고, 국내 개봉 상업영화를 대상으로 축소추정기법을 포함한 여러 회귀모형을 적용하였다. 특히 LASSO회귀의 경우, 교차타당성 방법을 이용한 예측오차가 가장 적고 흥행성과에 설명력이 높은 변수 순으로 의미 있는 독립변수들을 빠르고 효율적으로 선택할 수 있었다. 2013년도 1분기 개봉 영화를 대상으로 실증분석 결과, 개봉 후 온라인 평점과 빈도 모두 영향력이 높았으나, 개봉 전에는 온라인 평점만 효과적인 것으로 나타났다. 상영포맷 또한 흥행성과에 유의한 영향을 미치는 것으로 나타났다.

유저의 장르 선호도를 반영한 추천 (Recommendation Reflecting User Preferences on Genres)

  • 이호종;황원석;김상욱
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2011년도 춘계학술발표대회
    • /
    • pp.1285-1286
    • /
    • 2011
  • MovieLens를 대상으로 하는 추천 시스템에 대한 연구 중 k-NN 추천 방법은 정확도가 비교적 높지만 평점을 예측할 수 없는 상황이 발생할 수 있다. 본 논문에서는 기존 방법의 문제점을 해결한 장르기반 추천 방법 제안하고, 실험을 통하여 제안하는 방법이 모든 영화에 대한 평점의 예측이 가능함을 검증한다.

영화 리뷰 감성분석을 위한 텍스트 마이닝 기반 감성 분류기 구축 (A Study on Analyzing Sentiments on Movie Reviews by Multi-Level Sentiment Classifier)

  • 김유영;송민
    • 지능정보연구
    • /
    • 제22권3호
    • /
    • pp.71-89
    • /
    • 2016
  • 누구나 본인이 사용한 제품이나, 이용한 서비스에 대한 후기를 자유롭게 인터넷에 작성할 수 있고, 이러한 데이터의 양은 점점 더 많아지고 있다. 감성분석은 사용자가 생성한 온라인 텍스트 속에 내포된 감성 및 감정을 식별하기 위해 사용된다. 본 연구는 다양한 데이터 도메인 중 영화 리뷰를 분석 대상으로 한다. 영화 리뷰를 이용한 기존 연구에서는 종종 리뷰 평점을 관객의 감성으로 동일시하여 감성분석에 이용한다. 그러나 리뷰 내용과 평점의 실제적 극성 정도가 항상 일치하는 것은 아니기 때문에 연구의 정확성에 한계가 발생할 수 있다. 이에 본 연구에서는 기계학습 기반의 감성 분류기를 구축하고, 이를 통해 리뷰의 감성점수를 산출하여 리뷰에서 나타나는 감성의 수치화를 목표로 한다. 나아가 산출된 감성점수를 이용하여 리뷰와 영화 흥행 간의 연관성을 살펴보았다. 감성분석 모델은 지지벡터 분류기와 신경망을 이용해 구축되었고, 총 1만 건의 영화 리뷰를 학습용 데이터로 하였다. 감성분석은 총 175편의 영화에 대한 1,258,538개의 리뷰에 적용하였다. 리뷰의 평점과 흥행, 그리고 감성점수와 흥행과의 연관성은 상관분석을 통해 살펴보았고, t-검정으로 두 지표의 평균차를 비교하여 감성점수의 활용성을 검증하였다. 연구 결과, 본 연구에서 제시하는 모델 구축 방법은 나이브 베이즈 분류기로 구축한 모델보다 높은 정확성을 보였다. 상관분석 결과로는, 영화의 주간 평균 평점과 관객 수 간의 유의미한 양의 상관관계가 나타났고, 감성점수와 관객 수 간의 상관분석에서도 유사한 결과가 도출되었다. 이에 두 지표간의 평균을 이용한 t-검정을 수행하고, 이를 바탕으로 산출한 감성점수를 리뷰 평점의 역할을 할 수 있는 지표로써 활용 가능함을 검증하였다. 나아가 검증된 결론을 근거로, 트위터에서 영화를 언급한 트윗을 수집하여 감성분석을 적용한 결과를 살펴봄으로써 감성분석 모델의 활용 방안을 모색하였다. 전체적 실험 및 검증의 과정을 통해 본 연구는 감성분석 연구에 있어 개선된 감성 분류 방법을 제시할 수 있음을 보였고, 이러한 점에서 연구의 의의가 있다.

메타데이터 개수 증가를 이용한 콘텐츠 기반 영화 추천 시스템의 정확도 향상 테스트 (Accuracy Improvement Test for Contents-based Movie Recommendation System by Increasing Metadata)

  • 최다정;서진경;백주련
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2022년도 제65차 동계학술대회논문집 30권1호
    • /
    • pp.35-38
    • /
    • 2022
  • 콘텐츠 기반 추천 시스템은 대표적인 추천 모델 방법 중 하나이다. 하지만 콘텐츠 기반 추천 시스템은 사용자 관련 메타데이터를 고려하기보다 내용 관련 메타데이터에만 의존하는 경향이 있다. 본 논문에서는 영화의 특징을 담고 있는 메타데이터를 이용해 추천 시스템을 간단히 구현하고, 추천한 영화와 사용자의 영화 평점을 이용해 추천 시스템의 정확도를 측정하였다. 영화 메타데이터 keywords, genres, cast의 개수를 늘려가며 정확도가 변화하는지 알아보았다. 메타데이터 각각의 개수가 증가하면 정확도도 향상할 것이라고 기대했으나 큰 차이가 나타나지 않았다. 모델 평가 결과, 미세한 차이지만 영화 메타데이터를 상위 3개씩 추출해 영화를 추천했을 때의 정확도가 1.2100318041248186으로 가장 높았다.

  • PDF

데이터마이닝과 텍스트마이닝을 활용한 영화 흥행 예측 (Box Office Hit Prediction Using Data mining and Text mining)

  • 조효정
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2021년도 춘계학술발표대회
    • /
    • pp.316-318
    • /
    • 2021
  • 영화 수익에 있어 영화의 흥행 여부는 중요한 영향을 끼친다. 영화 흥행 요인은 영화 산업의 규모가 커지면서 많은 제작사들 및 투자자들이 고려해야 하는 사항이 되었다. 따라서 영화의 흥행을 예측하기 위한 많은 모델이 연구되었다. 본 연구의 목적은 선행연구에서 흥행에 유의미한 영향을 끼친다고 밝혀진 스크린 수, 감독명, 제작사명 등의 내재적인 속성과 더불어 온라인 구전 변수를 사용하여 영화 흥행 예측 모델을 만드는 것이다. 이때 기사 수, 블로그 수와 같이 온라인 구전의 크기를 나타내는 변수들을 사용하는 대신 개봉 후 첫 주간의 관람객 리뷰를 텍스트마이닝을 이용하여 전체 리뷰 중 긍정 리뷰의 비율에 따라 점수를 매긴 후 독립변수로 사용한다. 그 후, 데이터 마이닝 기법을 활용하여 만든 모델에 앞서 언급한 독립변수를 입력 값으로 사용하여 영화의 흥행을 예측한다. 최종적으로 의사결정트리와 로지스틱회귀를 수행한 결과 영화 흥행에 영향을 주는 독립변수를 찾고 모델의 성능을 평가하였다. 로지스틱회귀의 결과 관객 수, 평점이 영화의 흥행에 특히 유의한 영향을 끼치는 변수로 선정되었고 리뷰 역시 유의한 변수로 선정되었다. 이때 만들어진 모델은 약 90%의 높은 수준의 정확도를 보여주었다. 의사결정트리의 결과 관객 수가 가장 중요한 변수로 선정되었다.

평점 기반 추천시스템을 위한 토픽 모델 협업필터링 (Collaborative Filtering Using Topic Models for Rating Based Recommender Systems)

  • 김광섭;정호경;이현종;김형준
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2012년도 한국컴퓨터종합학술대회논문집 Vol.39 No.1(B)
    • /
    • pp.381-383
    • /
    • 2012
  • 협업필터링은 지금까지 많은 추천시스템 연구에서 비교대상이 되거나 더 좋은 추천시스템 방법론을 개발하기 위해서 응용되고 있다. 일반적으로 협업필터링 기법은 명시적으로 관찰된 사용자들의 행동을 기반하는 방법이다. 본 연구에서는 LDA(Latent Dirichlet Allocation)을 이용해 사용자와 추천 대상이 되는 아이템의 숨겨진 특성을 추출하고, 이를 협업필터링기법에 응용했다. 영화 추천시스템 구축을 위한 실험에서, 사용자의 선호도는 다양한 영화 장르를 선호하는 비율로 나타난다는 가정(사용자기반)과 영화 또한 장르의 비율로 표현이 된다는 가정(아이템기반)을 했다. 이러한 가정을 토대로 사용자 사이와 영화 사이 간의 유사도를 정의하고, 협업필터링에 적용했을 때, 전통적인 협업필터링 기법보다 뛰어난 결과를 얻을 수 있었다.

감정어휘 평가사전과 의미마디 연산을 이용한 영화평 등급화 시스템 (Grading System of Movie Review through the Use of An Appraisal Dictionary and Computation of Semantic Segments)

  • 고민수;신효필
    • 인지과학
    • /
    • 제21권4호
    • /
    • pp.669-696
    • /
    • 2010
  • 본 논문은 한 문서의 전체 의미는 각 부분의미의 합성이라는 관점에서 미리 반자동으로 구축된 감정어휘 평가사전을 기반으로 한 시스템을 제안한다. 인간의 의사 결정 과정과 유사한 방식으로 의사 결정 과정을 모델링하려는 노력으로써 본 ARSSA 시스템은 개별 리뷰의 의미값 연산과 자료 분류를 통해 감정 표현이 나타난 영화평 리뷰의 자동 등급화에 대한 연구를 수행한다. 이는 {'평점' : '리뷰'} 이항구조로 이루어진 현재의 평점 부여 형식에서 발생하는 두 변항의 불연속성 문제를 해결해보려는 목적을 가진다. 이는 어휘 의미 합성 과정에서 반영된 추상적 의미들의 합성 함수를 통해 실현될 수 있다. 시스템의 성능 실험에서 네이버 무비에서 확보한 1000개의 리뷰에 대한 10-fold 교차 검증 실험이 수행되었다. 이 실험은 기존에 부여된 평점과 비교하여 감정어휘 평가사전을 이용하였을 때 85%의 F1 Score를 보였다.

  • PDF