• 제목/요약/키워드: 뉴스기사 분석

검색결과 360건 처리시간 0.023초

R 기반의 빅데이터 기술을 활용한 뉴스기사와 음원차트의 상관관계 분석 (Correlation Analysis between News Articles and Music Charts using Big Data Technologies based on R)

  • 하정철;강동훈;박재모;길준민
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2016년도 추계학술발표대회
    • /
    • pp.636-639
    • /
    • 2016
  • 빅데이터의 일종인 뉴스기사 중에 아이돌 그룹관련 뉴스기사는 아이돌 그룹의 대중적 인기에 힘입어 전체 연예계 기사 중에 점점 큰 비중을 차지하고 있다. 아이돌 그룹의 소속사는 여러 홍보 방법 중 뉴스기사의 노출을 통해 비교적 저렴한 비용으로 홍보하여 음원차트 순위 향상을 위해 노력하고 있다. 본 논문에서는 뉴스기사와 음원차트 간의 상관관계를 분석하여 뉴스기사의 노출이 효율적 홍보 수단 인지를 알아보기 위해 먼저 감성분석을 통해 긍정기사와 부정기사가 음원차트 순위에 미치는 영향을 분석하고, 뉴스기사의 수가 많을수록 음원차트 순위가 상승하는지에 대해 알아보고자 한다. 이를 위해 본 논문에서는 R 언어를 이용하여 데이터 수집을 위한 웹 크롤러 설계, 회귀분석을 이용한 감성사전 구축 및 감성분석, 마지막으로 피어스만 상관계수를 이용한 상관관계 분석을 수행한다.

온라인 저널리즘의 추천기사가 뉴스 이용자의 뉴스기사 선택에 미치는 영향 (Effect of the Recommendation Story in Online Journalism on the User's News Selection)

  • 박광순;안종묵
    • 한국산학기술학회논문지
    • /
    • 제16권3호
    • /
    • pp.1795-1805
    • /
    • 2015
  • 본 연구는 온라인 저널리즘의 추천기사가 대학생들의 뉴스기사 선택에 미치는 영향을 두 차원에서 분석하였다. 하나는 추천기사이고, 다른 하나는 이들 뉴스기사의 배치순위와 이용지수이다. 분석결과 11개의 추천기사 유형 중 7개 유형은 뉴스기사 선택에 긍정적인 영향을 미치는 것으로 나타난 반면, 4개 유형은 유의미하지 않은 것으로 나타났다. 뉴스기사 선택에 영향을 미치지 않은 것으로 나타난 추천기사 유형의 대부분은 댓글이나 SNS의 트윗과 관련된 것들이다. 또한 뉴스기사 및 검색어 배치순위는 뉴스기사 선택에 영향을 미치는 것으로 나타났으나 이용지수는 영향을 미치지 않은 것으로 나타났다. 한편, 뉴스기사 이용시간과 추천기사 유형 간 그리고 추천기사 유형 간 상관관계는 대부분 유의미한 것으로 나타났다. 분석결과를 종합하면, 뉴스기사 게재위치와 온라인 저널리즘의 추천기사와 같은 형식적 요인은 뉴스기사 헤드라인과 검색어 등의 내용과 더불어 뉴스 이용자들의 뉴스기사 선택에 긍정적인 영향을 미치는 것으로 결론지을 수 있다.

TF-IDF를 활용한 k-means 기반의 효율적인 대용량 기사 처리 및 요약 알고리즘 (Article Analytic and Summarizing Algorithm by facilitating TF-IDF based on k-means)

  • 장민서;오수진;김응모
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2018년도 춘계학술발표대회
    • /
    • pp.271-274
    • /
    • 2018
  • 본 논문에서는 뉴스기사 데이터를 활용하여 대규모 뉴스기사를 소주제로 분류하는 군집 분석 방법을 제안한다. 또한, 분류된 뉴스기사를 사용자가 빠르게 이해하고 접할 수 있도록 핵심 문장을 추출하여 제공하는 방법을 제안한다. 분석 데이터는 포털 사이트 점유율 1위인 네이버의 경제 분야 뉴스기사를 크롤링하여 수집한다. 뉴스기사의 분석을 위해 전 처리를 통해 특수문자, 조사, 어미, 구두점 등의 불 용어 처리를 수행한다. 또한, k-means 알고리즘을 이용하여 대용량의 뉴스기사를 주제 별로 분류하는 것을 진행하며 그것을 토대로 핵심 문장을 추출한다. 추출된 핵심 문장은 분류된 뉴스기사의 주제를 나타내며 사용자에게 빠르게 정보를 전달하기 위해 활용한다. 본 논문의 연구 내용이 여러 언론사 사이트에 반영되면 사이트 품질과 사용자 만족도 향상에 기여할 수 있을 것으로 보인다.

인터넷 미디어 뉴스기사 본문의 하이퍼링크에 대한 분석 -네이버, 다음, 야후를 중심으로- (Analysis on the Hyperlink of News Articles on the Internet Media : Focusing upon the Naver, Daum, Yahoo Site)

  • 박광순
    • 한국콘텐츠학회논문지
    • /
    • 제10권11호
    • /
    • pp.329-340
    • /
    • 2010
  • 본 연구는 포털사이트와 언론사닷컴 뉴스기사 본문의 하이퍼링크에 대한 분석을 통해 온라인 저널리즘의 뉴스서비스에 대한 특징을 파악하기 위해 실시되었다. 분석결과 뉴스기사 본문에 하이퍼링크 서비스가 제공된 뉴스기사 수는 언론사닷컴에 비해 포털사이트가 더 많았다. 그러나 하이퍼링크 서비스가 제공된 뉴스기사에서의 하이퍼링크 수는 포털사이트에 비해 언론사닷컴이 더 많았다. 포털사이트인 다음과 야후의 비교에서는 다음이 야후에 비해 하이퍼링크 서비스가 제공된 뉴스기사의 수와 1건의 기사에 제공된 하이퍼링크 수도 더 많았다. 하지만 하이퍼링크 서비스가 제공된 뉴스기사에서의 하이퍼링크 수는 야후가 더 많았다. 온라인 저널리즘의 뉴스기사 본문에 하이퍼링크 된 콘텐츠는 정보유형과 광고유형으로 구성되었다. 포털사이트 뉴스기사 본문에 하이퍼링크 된 모든 콘텐츠는 정보유형이었다. 반변 언론사닷컴 뉴스기사 본문에 하이퍼링크 된 콘텐츠는 약 92%가 광고유형이었다. 정보유형 콘텐츠는 뉴스기사에 사용된 용어의 의미와 관련된 것이지만, 광고유형의 콘텐츠는 뉴스기사의 내용과 관련이 없는 것들로 구성되었다.

인터넷신문의 뉴스기사 페이지 구성과 콘텐츠에 대한 분석 -네이버, 다음, 네이트, 야후를 중심으로- (An Analysis of the Contents and Make-up of the Page in a News Story of the Internet Newspaper -focusing on Naver, Daum, Nate, Yahoo-)

  • 박광순
    • 한국산학기술학회논문지
    • /
    • 제15권3호
    • /
    • pp.1345-1354
    • /
    • 2014
  • 본 연구는 인터넷신문의 뉴스기사 본문 페이지 구성과 뉴스기사 본문 주변 공간의 콘텐츠 유형을 비교 분석하였다. 분석결과 네이버 뉴스기사 본문 페이지의 포맷은 다음, 네이트, 야후의 뉴스기사 본문 페이지보다 더 복잡하게 구성되었다. 또한 네이버는 다른 세 포털에 비해 광고 수, 광고 유형, 오락 콘텐츠, 다양한 유형의 콘텐츠가 더 높게 게재되었다. 특히 연예인 관련 뉴스기사의 게재 비율이 다른 포털사이트에 비해 높았다. 뉴스기사 본문 페이지에 뉴스기사를 가장 많이 게재한 포털사이트는 다음이었으며, 광고를 가장 적게 게재한 포털사이트는 야후였다. 그러나 전체적으로 볼 때, 이들 세 포털사이트의 뉴스기사 페이지의 포맷과 콘텐츠는 매우 유사하게 구성되었다. 결론적으로 독자들의 광고회피와 뉴스기사의 다양성 측면에서의 뉴스기사 이용의 편리성은 포털사이트의 뉴스서비스가 언론사닷컴의 뉴스서비스 보다 더 높은 것으로 평가할 수 있다.

주요 신문사 뉴스 기사를 통해 살펴본 2020년도 대한민국의 긴급재난지원금 (Emergency Disaster Support Fund of Korea in 2020 confirmed through News Articles of Major Newspaper)

  • 권충훈;이형하
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2020년도 제62차 하계학술대회논문집 28권2호
    • /
    • pp.169-170
    • /
    • 2020
  • 본 연구는 코로나19 상황에서 대한민국 긴급재난지원금의 모습을 주요 신문사 뉴스 기사들을 통해 분석하고 그 결과를 제시하고자 한다. 분석대상은 2020년 3월 22일부터(긴급재난지원금 첫 보도) 5월 31일까지, 중앙일간지(11개 신문사)의 '긴급재난지원금' 관련 신문기사들이다. 신문기사 분석방법론은 관련 연구주제가 선행연구가 축적되지 않는 상황에서 나름 가치 있는 연구접근법이다. 본 연구에서는 뉴스기사 빅데이터 분석 서비스인 빅카인즈를 활용하여, 관련기사의 뉴스 트렌드, 연관어, 관계도 등을 분석하여 제시하였다. 본 연구는 향후 해당 분석대상을 가지고, 보다 밀도 있고 깊이 있는 언어네트워크(의미망) 분석으로 확장해 나갈 계획이다.

  • PDF

NOD(News On Demand) 데이터의 인기도와 생명주기를 이용하는 시간 윈도우에 기반한 캐시 재배치 기법 (Time Window based Cache Replacement Strategy using Popularity and Life of News-Demand Data)

  • 최태욱;박성호;김영주;정기동
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 1998년도 가을 학술발표논문집 Vol.25 No.2 (3)
    • /
    • pp.101-103
    • /
    • 1998
  • 뉴스기사를 구성하는 NOD데이터는 VOD(Video on Demand) 데이터와는 달리 미디어의 종류 및 크기, 시간적인 접근 지역성, 사용자와 상호 작용성 등의 차이점을 가질 뿐만 아니라 새로운 뉴스기사가 수시로 생성되고 사용자가 인기도가 높은 기사와 최신의 뉴스기사에 더 많이 접근하는 특성을 가진다. 본 논문에서는 현재 서비스중인 전자신문의 로그파일을 분석하여 NOD 뉴스기사의 인기도가 Zipf분포와 다름을 보이고, 뉴스기사의 생명주기Lifr Cycle)에 따른 접근 확률분포 제시한다. NOD 데이터의 접근 편기성으로 인하여 데이터 캐싱을 통한 NOD 서버의 성능 향상을 기대할 수 있으나 뉴스기사의 생명주기가 짧고 접근시간대별로 사용자 접근형태가 변하는 등의 이유로 단순히 인기도만 고려한 캐싱은 빈번한 데이터 재배치 문제로 인해 높은 캐시 관리비용을 야기한다. 따라서 본 논문에서는 뉴스 기사의 접근 편기성에 나타나는 인기도(popularity)와 생명주기를 조합한 척도를 제안하고 이를 이용한 재배치를 제안한다.

  • PDF

온라인 방송의 뉴스기사 유형에 대한 분석 -네이버 뉴스스탠드의 방송사 홈페이지를 중심으로- (Analysis of the Types of News Stories on the Online Broadcast -Focusing upon the Broadcasting Websites of NAVER Newsstand-)

  • 박광순
    • 디지털융복합연구
    • /
    • 제19권3호
    • /
    • pp.177-185
    • /
    • 2021
  • 본 연구는 네이버 뉴스스탠드의 9개 방송사 홈페이지 뉴스기사에 대한 분석을 통해 온라인 방송의 뉴스기사 유형은 어떻게 구성되고 있는가를 파악하기 위해 실시되었다. 분석을 위해 1개 방송 당 30일 분량으로 9개 방송을 대상으로 총 270일간의 샘플을 선정하였다. 분석방법은 방송사 간 차이검정을 위해 일원분산분석(One-way ANOVA) 기법을 이용하였다. 분석은 언어구성에 의한 뉴스기사 유형, 기사내용에 따른 장르 유형 등을 중심으로 이루어졌다. 분석결과 오프라인 방송에서는 모든 프로그램이 비디오기사 유형으로 제작·송신되고 있는 것에 반해 온라인 방송에서는 약 50% 정도가 사진기사와 텍스트기사로 구성되었다. 온라인 신문에서 비디오기사나 컴퓨터 그래픽을 이용한 동영상 중심의 새로운 기사 유형을 제작·공급하고 있으나 온라인 방송에서는 신문의 주요 기사유형인 사진과 텍스트기사를 적극적으로 활용하고 있었다. 이 같은 결과를 통해 온라인 미디어 환경에서의 미디어 간 경계가 더욱 불분명해지고 있으며, 방송기사 유형의 올드화 현상을 파악할 수 있었다.

포털 뉴스섹션의 편집요인이 뉴스 이용자의 기사선택에 미치는 영향에 대한 분석 (An Analysis of the influence of the Editorial Elements of Portal News Section on the News User's Choice of Articles)

  • 박광순
    • 한국산학기술학회논문지
    • /
    • 제13권5호
    • /
    • pp.2087-2095
    • /
    • 2012
  • 본 연구에 이용된 편집요인은 뉴스 카테고리, 사진기사, 굵은 활자체의 기사제목, 신문제호, 기사제목의 내용 등으로 구성되었다. 이 같은 요인 중 사진기사, 굵은 활자체의 기사제목, 기사제목의 내용 등 3개 요인만이 뉴스 이용자들의 기사선택에 영향을 미치는 것으로 나타났다. 이들 요인을 포털뉴스 이용시간의 차이에 따른 분석에서는 뉴스 카테고리, 굵은 활자체의 기사제목, 신문제호 등 3개 요인만이 영향을 미치는 것으로 나타났다. 뉴스 장르가 뉴스 이용자들의 기사선택에 미치는 영향에 대한 분석에서는 정치, 경제, 사회, 스포츠, 문화/연예, 국제, IT/과학 장르 중 사회, 문화/연예, 국제 등 3개 요인만이 이용자들의 기사선택에 영향을 미치는 것으로 나타났다. 이들 요인에 대한 남녀집단 간의 분석에서는 경제, 스포츠, 문화/연예, IT/과학 등 4개 장르에서 기사선택에 차이가 있는 것으로 나타났다. 본 연구는 오프라인 신문에 비해 다양한 방식으로 기사를 노출시키는 온라인 매체에서 전통적인 신문편집의 요소가 기사선택에 어떠한 영향을 미치는가를 파악하여 온 오프라인 신문 간 편집요소의 역할에 대한 차이와 온라인 매체에서의 효과적인 편집방안을 수립하는데 기초적인 단서를 제공할 목적으로 수행되었다.

토픽 모델링 기반 뉴스기사 분석을 통한 서울시 이슈 도출 (Identifying Seoul city issues based on topic modeling of news article)

  • 권민지
    • 한국방송∙미디어공학회:학술대회논문집
    • /
    • 한국방송∙미디어공학회 2019년도 추계학술대회
    • /
    • pp.11-13
    • /
    • 2019
  • 대중들에게 정보를 빠르고 정확하게 제공하는 대표 매체인 뉴스 기사는 일 평균 1만 5천 건 이상이 보도되고 있다. 특정 주제 또는 분야에 대한 전반적인 동향을 파악하고자 대량의 텍스트 데이터를 수집하여 텍스트 마이닝(Text mining)과 머신러닝 등을 적용하는 연구들이 활발하게 수행되고 있다. 본 연구에서는 서울시의 이슈 및 문제를 파악하고자 약 5년간 뉴스 기사를 수집하여 키워드 분석 및 토픽 모델링을 적용하였다. 분석 결과 5년간의 뉴스 기사에서 빈번하게 출현하는 키워드들을 도출하였고 연도별로 도출된 키워드들을 비교분석하였다. 또한 토픽 모델링 적용 결과 뉴스 기사를 구성하는 20개의 주제를 도출하였으며 이를 기반으로 서울시의 주요 이슈들을 파악할 수 있다. 본 연구는 연도별, 분야별 세부 내용 및 시계열 분석, 다른 도시들의 이슈 및 문제를 도출하는데 활용될 것으로 기대된다.

  • PDF