• 제목/요약/키워드: 리뷰분석

검색결과 551건 처리시간 0.026초

영화 리뷰 감성분석을 위한 텍스트 마이닝 기반 감성 분류기 구축 (A Study on Analyzing Sentiments on Movie Reviews by Multi-Level Sentiment Classifier)

  • 김유영;송민
    • 지능정보연구
    • /
    • 제22권3호
    • /
    • pp.71-89
    • /
    • 2016
  • 누구나 본인이 사용한 제품이나, 이용한 서비스에 대한 후기를 자유롭게 인터넷에 작성할 수 있고, 이러한 데이터의 양은 점점 더 많아지고 있다. 감성분석은 사용자가 생성한 온라인 텍스트 속에 내포된 감성 및 감정을 식별하기 위해 사용된다. 본 연구는 다양한 데이터 도메인 중 영화 리뷰를 분석 대상으로 한다. 영화 리뷰를 이용한 기존 연구에서는 종종 리뷰 평점을 관객의 감성으로 동일시하여 감성분석에 이용한다. 그러나 리뷰 내용과 평점의 실제적 극성 정도가 항상 일치하는 것은 아니기 때문에 연구의 정확성에 한계가 발생할 수 있다. 이에 본 연구에서는 기계학습 기반의 감성 분류기를 구축하고, 이를 통해 리뷰의 감성점수를 산출하여 리뷰에서 나타나는 감성의 수치화를 목표로 한다. 나아가 산출된 감성점수를 이용하여 리뷰와 영화 흥행 간의 연관성을 살펴보았다. 감성분석 모델은 지지벡터 분류기와 신경망을 이용해 구축되었고, 총 1만 건의 영화 리뷰를 학습용 데이터로 하였다. 감성분석은 총 175편의 영화에 대한 1,258,538개의 리뷰에 적용하였다. 리뷰의 평점과 흥행, 그리고 감성점수와 흥행과의 연관성은 상관분석을 통해 살펴보았고, t-검정으로 두 지표의 평균차를 비교하여 감성점수의 활용성을 검증하였다. 연구 결과, 본 연구에서 제시하는 모델 구축 방법은 나이브 베이즈 분류기로 구축한 모델보다 높은 정확성을 보였다. 상관분석 결과로는, 영화의 주간 평균 평점과 관객 수 간의 유의미한 양의 상관관계가 나타났고, 감성점수와 관객 수 간의 상관분석에서도 유사한 결과가 도출되었다. 이에 두 지표간의 평균을 이용한 t-검정을 수행하고, 이를 바탕으로 산출한 감성점수를 리뷰 평점의 역할을 할 수 있는 지표로써 활용 가능함을 검증하였다. 나아가 검증된 결론을 근거로, 트위터에서 영화를 언급한 트윗을 수집하여 감성분석을 적용한 결과를 살펴봄으로써 감성분석 모델의 활용 방안을 모색하였다. 전체적 실험 및 검증의 과정을 통해 본 연구는 감성분석 연구에 있어 개선된 감성 분류 방법을 제시할 수 있음을 보였고, 이러한 점에서 연구의 의의가 있다.

영상 콘텐츠의 신뢰도 평가를 위한 언어와 비언어 통합 감성 분석 시스템 (Integrated Verbal and Nonverbal Sentiment Analysis System for Evaluating Reliability of Video Contents)

  • 신희원;이소정;손규진;김혜린;김윤희
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제10권4호
    • /
    • pp.153-160
    • /
    • 2021
  • IT 기술 발달에 따른 영상 콘텐츠 생산과 소비가 증가함에 따라 영상 콘텐츠를 통한 제품 리뷰 정보로 구매의사 결정이 빈번해졌다. 따라서, 리뷰 영상에 대한 신뢰성을 평가할 필요가 있다. 본 연구에서는 제품 리뷰 영상을 얼굴 표정 분석과 텍스트 마이닝을 통해 리뷰어의 표정과 음성을 분석하여 영상의 신뢰도를 분석한다. 영상 내 인물 표정의 감성 값을 추출하는 알고리즘을 활용하여 비언어 감성을 정량화하고, 유의미한 감정 변화 구간을 추출한다. 유의미한 감정 변화 구간의 리뷰어 음성을 텍스트화하여 표준어 및 비표준어 감성 사전 활용을 통해 긍정과 부정으로 리뷰에 대한 언어 감성 분석 후 수치화 한다. 비언어 감성 분석과 언어 감성 분석의 결과를 통합하여 일치 여부에 따라 신뢰도를 도출한다. 본 연구를 통해 영상 콘텐츠의 신뢰성 평가 방법을 제시한다.

온라인 리뷰어의 과소보고 편향에 관한 실증 연구: 온라인 게임 플랫폼 스팀을 중심으로 (An Empirical Study on the Under-reporting Bias of Online Reviewers: Focusing on Steam Online Game Platform)

  • 장주혁;백현미;이새롬;배성훈
    • 지식경영연구
    • /
    • 제23권2호
    • /
    • pp.229-251
    • /
    • 2022
  • 온라인 리뷰는 제품에 대한 이전 구매자들의 경험을 제공함으로써 다른 소비자들이 합리적인 구매 의사결정을 하는데 유용하게 활용되고 있다. 하지만 온라인 리뷰가 제품의 질과 특성을 정확히 반영하지 않고 편향되어 작성된다면 온라인 리뷰를 더이상 신뢰할 수 없는 문제가 발생한다. 따라서, 본 연구에서는 대표적인 온라인 리뷰의 편향 중 하나인 과소보고 편향의 특성을 실증 데이터를 통해 살펴보고자 한다. 구체적으로 온라인 게임 플랫폼인 스팀의 14,165개의 리뷰 데이터를 활용하여 과소보고하는 성향을 지니는 리뷰어의 특성을 살펴보고자 하였다. 분석결과, 과소보고하는 리뷰어는 주로 추천 의도를 담은 리뷰를 작성하고, 게임 출시일로부터 짧은 기간 안에 리뷰를 작성하나 다소 긴 시간동안 게임을 플레이한 후 리뷰를 작성하는 경향이 있으며, 높은 가격의 게임을 구매했을 때 리뷰를 작성하는 경향을 보였다. 본 연구는 과소보고하는 리뷰어의 특성을 탐색적으로 살펴보았기에 과소보고 편향에 대한 이해를 확장시키는 기초 연구로서 의미를 지닐 것이다.

밀키트 제품 리뷰 데이터를 이용한 텍스트 분석 사례 연구 (A Case Study on Text Analysis Using Meal Kit Product Review Data)

  • 최혜선;연규필
    • 한국콘텐츠학회논문지
    • /
    • 제22권5호
    • /
    • pp.1-15
    • /
    • 2022
  • 본 연구에서는 밀키트 제품 평가에 영향을 미치는 요인을 파악하기 위하여 밀키트 제품 리뷰 데이터에 대한 텍스트 분석을 수행하였다. 분석에 사용된 자료는 네이버 쇼핑 사이트에서 판매되고 있는 밀키트 제품에 대한 리뷰 334,498건을 스크래핑하여 수집하였다. 텍스트 자료에 대한 전처리 과정을 거쳐 제품 리뷰에 빈번히 등장하는 단어를 추출한 후 워드클라우드 및 감성분석을 수행하였다. 감성분석시 제품 리뷰에 대한 긍정 또는 부정의 레이블은 평점을 기준으로 설정하여 반응변수로 활용하였고, 입력변수로는 단어들의 정규화 단어빈도-역문서빈도 (TF-IDF) 값을 구하여 사용하였다. 리뷰의 극성을 판별하는 모형으로는 로지스틱 회귀모형, 서포트 벡터 머신, 랜덤 포레스트 알고리즘을 적용하였으며, 분류 정확도 및 해석가능성을 고려하여 로지스틱 회귀모형을 최종 모형으로 선택한 후 제품 범주별 감성분석 모형으로 사용하였다. 각 제품 범주별로 도출된 로지스틱 회귀모형으로부터 밀키트 제품 구매 후 긍·부정의 감성을 발생시킨 주요 요인들을 밝혀내었다. 결과적으로 텍스트 분석을 통해 밀키트 제품 개발 시 특정 카테고리, 메뉴, 재료에 대한 긍정 요소를 극대화하고 부정적 위험 요소를 제거할 수 있는 기반을 제공할 수 있음을 확인하였다.

온라인 판매촉진활동 분석을 통한 고객 리뷰평점 추천 및 예측에 관한 연구 : S사 Wearable 상품중심으로 (A Study on Customer Review Rating Recommendation and Prediction through Online Promotional Activity Analysis - Focusing on "S" Company Wearable Products -)

  • 신호철
    • 한국콘텐츠학회논문지
    • /
    • 제22권4호
    • /
    • pp.118-129
    • /
    • 2022
  • 본 논문에서는 국내 온라인 기업의 Wearable 제품을 선정하고 판매 데이터를 수집해 다양한 분석과 매출 예측을 통해 판촉 활동의 전략 모델을 연구하는 데 목적이 있다. 데이터 분석을 위해 여러 가지의 알고리즘을 사용하여 분석할 것이며, 최상의 모형으로 결과를 선택할 것이다. 최상의 결과로 선택된 모형인 Gradient Boosting 모델은 지도학습을 통해 종속변수 예측에 있어서 판촉 유형, 가격, 판매 수량, 성별, 모델, 판매경로, 제품 성능, 판매 날짜, 지역 등 9개의 독립변수를 투입할 수 있게 된다. 본 연구에서는 판매촉진 유형별로 종속변수로 설정된 리뷰 값을 앙상블 분석 기법을 통해 더욱더 세부적으로 학습하고 분석 및 예측이 주목적이며, 판매촉진 활동을 통한 고객에게 할인 혜택을 주어질 경우와 주어지지 않을 경우에 리뷰 평점을 연구하는 데 목적이 있다. 분석 결과로 본다면 평가 결과는 AUC 95% 수준이며, F1도 93% 정도이다. 결국 판매촉진 활동 유형 중 가치 부가 혜택이 리뷰 수와 리뷰 평점에 영향을 준다고 것을 확인할 수 있었으며, 주요 변인들이 리뷰와 리뷰 평점의 영향을 준다는 것도 확인할 수 있었다.

오피니언 마이닝을 이용한 음식점 리뷰 분석과 요약 (Restaurant Review Analysis and Summary using Opinion Mining Techniques)

  • 김상욱;김원영;김응모
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2009년도 추계학술발표대회
    • /
    • pp.735-736
    • /
    • 2009
  • 사용자의 참여를 강조하는 Web2.0 시대를 맞이하여 개인의 블로그나 까페에 올라오는 무수히 많은 리뷰들이 실제 소비자의 마음을 움직이는 데에 많은 영향을 미치고 있다. 하지만 많은 리뷰들이 상당히 길게 작성되어 있기 때문에 원하는 정보만을 찾아내는 것은 어려운 일이다. 본 논문에서는 다양한 종류의 리뷰들 중에서도 많은 부분을 차지하고 있는 음식점에 관한 리뷰들을 분석하여 사용자가 원하는 정보를 요약하여 제공하는 방법을 제안한다. 이러한 방법을 통해서 사용자는 객관적인 판단을 내릴 수 있고, 시간적인 측면에서의 효율성을 획득할 수 있을 것이다.

네이버 영화 리뷰 데이터를 이용한 의미 분석(semantic analysis) (Semantic analysis via application of deep learning using Naver movie review data)

  • 김소진;송종우
    • 응용통계연구
    • /
    • 제35권1호
    • /
    • pp.19-33
    • /
    • 2022
  • SNS의 등장으로 인터넷 이용자들이 온라인에 남기는 텍스트의 양이 방대해지고 그 중요성이 강조되고있다. 특히 네이버의 영화 탭에서 볼 수 있는 영화 평점이나 리뷰는 실제로 관객들이 영화를 보기 전 해당 영화를 볼 것인지 결정하는 데 주요 요인이 되기도 한다. 본 연구는 실제 네이버 영화 리뷰 데이터를 가지고 평점을 예측하는 분석을 수행했다. 영화 리뷰 데이터를 분석하기 위해 평점의 분포를 통해 데이터 특성을 살펴보았고, 텍스트의 의미를 분석하기 위해 형태소 분석을 통한 한국어 자연어처리를 수행했다. 또한 평점 예측에 활용할 모델 선택을 위해 2-Class와 multi-Class 문제들에 대해 머신러닝과 딥러닝, 회귀와 분류 분석을 비교했으며, 오분류의 원인을 영화 리뷰 데이터 특성과 연관시켜 서술했다.

텍스트 마이닝을 활용한 커넥티드 카 고객 리뷰의 감성 분석: 국내-해외 브랜드간 UX 요인 비교를 중심으로 (A Sentiment Analysis of Customer Reviews on the Connected Car using Text Mining: Focusing on the Comparison of UX Factors between Domestic-Overseas Brands)

  • 신유정;최준호;김성우
    • 문화기술의 융합
    • /
    • 제9권4호
    • /
    • pp.517-528
    • /
    • 2023
  • 이 연구의 목적은 국내외 자동차 브랜드의 커넥티드 카 서비스의 사용자 감성 경험 요인들을 비교 분석하여 차이점을 도출하고 스마트 카 UX의 기획 방향성을 도출하는 것이다. 텍스트 마이닝 방법론을 활용하여, 국내외 브랜드 간 사용자 고객 리뷰의 경험 요인별 긍정-부정 감성 지수를 비교하였다. 현대차 그룹 브랜드 리뷰 12만 건과 해외 브랜드(테슬라, BMW, 벤츠) 리뷰 19만 건을 수집하여 전처리 과정을 수행한 후, 추출된 키워드를 연결 시스템, 정보, 서비스 차원에서 모두 11개의 경험 요인으로 분류하여 국내-해외 브랜드를 비교 분석하였다. 국내 커넥티드 카의 고객 리뷰 분석 결과, 가장 높은 감성 지수가 도출된 경험 요인은 '안전성'이었다. 해외 브랜드의 감성 지수 분석 결과, '오락성'이 가장 긍정적인 경험 요인으로 나타났다.

온라인 리뷰의 제목과 내용의 일치성이 리뷰 유용성에 미치는 영향 (The Effect of Text Consistency between the Review Title and Content on Review Helpfulness)

  • 이청용;김재경
    • 지식경영연구
    • /
    • 제23권3호
    • /
    • pp.193-212
    • /
    • 2022
  • 많은 연구에서 온라인 리뷰 유용성에 영향을 미치는 다양한 요인을 발견하였다. 기존 연구에서는 주로 온라인 리뷰와 관련되는 정량적(예: 평점) 및 정서적(예: 감성점수) 요인이 리뷰 유용성에 미치는 영향을 조사했다. 온라인 리뷰는 제목과 내용을 동시에 포함하고 있지만, 기존 연구는 주로 리뷰 내용에 중점을 두고 있다. 그러나 리뷰 제목을 고려하지 않고 단순히 리뷰 내용만을 고려하면 리뷰 유용성에 영향을 미치는 요인을 조사할 때 한계가 존재한다. 이에 따라 리뷰 제목과 내용을 모두 고려하는 연구가 주목받고 있지만, 대부분의 연구는 리뷰 유용성에 대한 리뷰 내용과 제목의 영향을 독립적으로 조사하였다. 이는 리뷰 제목과 내용 간의 일치성이 리뷰 유용성에 미치는 잠재적인 영향을 간과할 수 있다. 따라서 본 연구에서는 단순 노출 효과 이론을 통해 리뷰 제목과 내용 간의 텍스트 일치성이 리뷰 유용성에 미치는 영향을 확인하고, 정보 선명성, 리뷰 길이 및 정보원 신뢰성의 역할도 고려하였다. 분석 결과, 리뷰 제목과 내용 간의 텍스트 일치성은 리뷰 유용성에 부정적인 영향을 미치는 것을 확인하였다. 또한, 정보 선명성과 정보원 신뢰성은 리뷰 유용성에 대한 텍스트 일치성의 부정적인 영향을 완화한다는 것을 발견했다.

딥러닝 기반 게임 리뷰 만족도 및 카테고리 분류 시스템 설계 및 개발 (Design and implementation of a satisfaction and category classifier for game reviews based on deep learning)

  • 양유정;이보현;김진실;이기용
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2018년도 추계학술발표대회
    • /
    • pp.729-732
    • /
    • 2018
  • 모바일 게임 산업의 발달로 많은 사용자들이 게임을 이용하면서, 그들의 만족감을 사용리뷰를 통해 드러낸다. 실제로 각 리뷰의 범주가 모두 다르지만 현재 구글 플레이 앱스토어(Google Play App Store)의 게임 리뷰 범주는 3가지로 매우 제한적이다. 따라서 본 연구에서는 빠르고 정확한 고객의 요구를 필요로 하는 게임 소프트웨어의 특성을 고려하여 게임 리뷰를 입력했을 때, 게임의 운영 및 시스템에 맞도록 리뷰의 카테고리를 세분화하고 만족도를 분석하는 시스템을 개발한다. 제안 시스템은 인공신경망 모델인 CNN을 평점을 기반으로 훈련시켜 리뷰에 대한 만족도를 도출한다. 또한 Word2Vec을 이용해 단어들 간의 유사도를 구하고, 이를 활용한 단어 배열을 이용하여 가장 스코어가 높은 카테고리로 배정한다. 본 논문은 제안한 리뷰 만족도 및 카테고리 분류 시스템이 실제 효과적으로 리뷰를 보다 의미 있는 정보로써 제공할 수 있음을 보인다.