• 제목/요약/키워드: news topic

검색결과 234건 처리시간 0.037초

대선 관련 인터넷 뉴스의 댓글과 대댓글 간 비교를 통해 살펴본 온라인 토론의 진행 가능성 (The Comparison Between the Comments and the Replies on Korean President Election News: using Topic Modeling)

  • 이정
    • 지능정보연구
    • /
    • 제28권2호
    • /
    • pp.33-55
    • /
    • 2022
  • 본 연구는 온라인에서 토론이 제대로 이루어지는 지 알아보기 위해 대선 관련 인터넷 뉴스에 달린 댓글과 대댓글을 비교 분석하였다. 하버마스의 공론장 이론에 따르면 토론이란 참여자들이 자유로운 의사소통을 통해 숙의 과정을 거쳐 사회적 합의를 이루고자 하는 노력이다. 만약 인터넷 공간에서 댓글을 작성하는 행위를 통해 서로 상호작용과 토론이 일어난다면 댓글과 대댓글은 토론의 진행과정에 따라 구조적, 내용적 측면에서 일정한 차이를 보일 것이다. 본 연구는 그 차이를 가설로 설정하고 검증을 위해 다음뉴스 포털에서 4만여개의 댓글을 수집하였다. 관련 뉴스의 주제는 대통령 선거로 하였는데 이는 전국민이 관심을 갖고 있고 따라서 댓글이 활발하게 달리는 주제이기 때문이다. t검정과 토픽모델링을 이용하여 분석한 결과, 가설은 모두 채택되었으며 댓글을 통해 온라인 토론이 진행된다는 것을 보여주었다. 본 연구는 온라인 댓글이 사람들의 스트레스 해소를 위한 서로 연결성 없는 무질서한 발언들이 아니라, 일정한 방향성을 가지고 사회적 합의를 향해 나아가는 숙의과정이라는 것을 이론적, 실질적으로 보여주었다.

Comparing Social Media and News Articles on Climate Change: Different Viewpoints Revealed

  • Kang Nyeon Lee;Haein Lee;Jang Hyun Kim;Youngsang Kim;Seon Hong Lee
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제17권11호
    • /
    • pp.2966-2986
    • /
    • 2023
  • Climate change is a constant threat to human life, and it is important to understand the public perception of this issue. Previous studies examining climate change have been based on limited survey data. In this study, the authors used big data such as news articles and social media data, within which the authors selected specific keywords related to climate change. Using these natural language data, topic modeling was performed for discourse analysis regarding climate change based on various topics. In addition, before applying topic modeling, sentiment analysis was adjusted to discover the differences between discourses on climate change. Through this approach, discourses of positive and negative tendencies were classified. As a result, it was possible to identify the tendency of each document by extracting key words for the classified discourse. This study aims to prove that topic modeling is a useful methodology for exploring discourse on platforms with big data. Moreover, the reliability of the study was increased by performing topic modeling in consideration of objective indicators (i.e., coherence score, perplexity). Theoretically, based on the social amplification of risk framework (SARF), this study demonstrates that the diffusion of the agenda of climate change in public news media leads to personal anxiety and fear on social media.

LDA와 LSTM를 응용한 뉴스 기사 기반 선물가격 예측 (Futures Price Prediction based on News Articles using LDA and LSTM)

  • 주진현;박근덕
    • 산업융합연구
    • /
    • 제21권1호
    • /
    • pp.167-173
    • /
    • 2023
  • 경제지표를 분석하는 방법으로 회귀 분석이나, 인공지능을 활용하여 미래의 데이터를 예측하는 연구가 발표되었다. 본 연구에서는 토픽모델링을 사용하여 과거 뉴스 기사로부터 얻은 주제 확률 데이터를 이용한 인공지능으로 미래 선물 가격을 예측하는 시스템을 구상하였다. 과거 뉴스 기사로부터 비지도학습을 통한 문서의 주제를 추출할 수 있는 LDA 방법으로 각 뉴스 기사 주제 확률 분포 데이터를 얻을 수 있고, 해당 데이터를 인공지능의 RNN의 파생 구조인 LSTM의 입력 데이터로 활용함으로써 미래 선물 가격을 예측하였다. 본 연구에서 제안한 방법에서는 선물 가격의 추세를 예측할 수 있었고, 이를 활용하여 추후 옵션 상품 등의 파생 상품에 대한 가격 추세도 예측할 수 있을 것으로 보인다. 다만, 일부 데이터에 대해 오차가 발생하는 것이 확인되어 정확도 향상을 위한 추가적인 연구가 필요하다.

Major concerns regarding food services based on news media reports during the COVID-19 outbreak using the topic modeling approach

  • Yoon, Hyejin;Kim, Taejin;Kim, Chang-Sik;Kim, Namgyu
    • Nutrition Research and Practice
    • /
    • 제15권sup1호
    • /
    • pp.110-121
    • /
    • 2021
  • BACKGROUND/OBJECTIVES: Coronavirus disease 2019 (COVID-19) cases were first reported in December 2019, in China, and an increasing number of cases have since been detected all over the world. The purpose of this study was to collect significant news media reports on food services during the COVID-19 crisis and identify public communication and significant concerns regarding COVID-19 for suggesting future directions for the food industry and services. SUBJECTS/METHODS: News articles pertaining to food services were extracted from the home pages of major news media websites such as BBC, CNN, and Fox News between March 2020 and February 2021. The retrieved data was sorted and analyzed using Python software. RESULTS: The results of text analytics were presented in the format of the topic label and category for individual topics. The food and health category presented the effects of the COVID-19 pandemic on food and health, such as an increase in delivery services. The policy category was indicative of a change in government policy. The lifestyle change category addressed topics such as an increase in social media usage. CONCLUSIONS: This study is the first to analyze major news media (i.e., BBC, CNN, and Fox News) data related to food services in the context of the COVID-19 pandemic. Text analytics research on the food services domain revealed different categories such as food and health, policy, and lifestyle change. Therefore, this study contributes to the body of knowledge on food services research, through the use of text analytics to elicit findings from media sources.

토픽모델링을 활용한 한국과 미국의 산업수학 이슈 비교 (Comparison of Industrial Mathematics Issues between Korea and the US Using Topic Modeling)

  • 김성연
    • 한국콘텐츠학회논문지
    • /
    • 제22권7호
    • /
    • pp.30-45
    • /
    • 2022
  • 본 연구에서는 텍스트마이닝을 활용해 한국과 미국의 온라인 뉴스와 포럼에서 산업수학과 관련한 이슈를 파악하고, 그 결과를 비교 분석하였다. 이를 위해 한국의 주요 포털 사이트인 네이버의 뉴스 기사, 클리앙의 게시글과 댓글, 그리고 미국의 New York Times와 CNN의 뉴스 기사, Reddit의 게시글과 댓글에서 산업수학과 관련한 텍스트 데이터를 수집하여 구조적 토픽모델링 분석을 수행하였다. 주요 분석결과는 다음과 같다. 첫째, 한국의 뉴스는 산업수학의 필요성과 정부의 지원 측면에 대해, 미국에서는 산업수학이 활용되는 다양한 분야에 대해 다루는 것으로 나타났다. 둘째, 한국에서는 온라인 뉴스와 포럼에서 각기 다른 주제로 동일한 개수의 이슈가 나타났지만, 미국에서는 온라인 포럼보다 뉴스 기사에서 더 많은 이슈를 다루고 있는 것으로 나타났다. 이를 토대로 한국에서 산업수학이 정착하는 데 있어 연구자들에게는 학술적, 그리고 정부에는 실무적 시사점을 제시하였다.

Detecting Fake News about COVID-19 Infodemic Using Deep Learning and Content Analysis

  • Olga Chernyaeva;Taeho Hong;YongHee Kim;YoungKi Park;Gang Ren;Jisoo Ock
    • Asia pacific journal of information systems
    • /
    • 제32권4호
    • /
    • pp.945-963
    • /
    • 2022
  • With the widespread use of social media, online social platforms like Twitter have become a place of rapid dissemination of information-both accurate and inaccurate. After the COVID-19 outbreak, the overabundance of fake information and rumours on online social platforms about the COVID-19 pandemic has spread over society as quickly as the virus itself. As a result, fake news poses a significant threat to effective virus response by negatively affecting people's willingness to follow the proper public health guidelines and protocols, which makes it important to identify fake information from online platforms for the public interest. In this research, we introduce an approach to detect fake news using deep learning techniques, which outperform traditional machine learning techniques with a 93.1% accuracy. We then investigate the content differences between real and fake news by applying topic modeling and linguistic analysis. Our results show that topics on Politics and Government services are most common in fake news. In addition, we found that fake news has lower analytic and authenticity scores than real news. With the findings, we discuss important academic and practical implications of the study.

A Research on Difference Between Consumer Perception of Slow Fashion and Consumption Behavior of Fast Fashion: Application of Topic Modelling with Big Data

  • YANG, Oh-Suk;WOO, Young-Mok;YANG, Yae-Rim
    • 융합경영연구
    • /
    • 제9권1호
    • /
    • pp.1-14
    • /
    • 2021
  • Purpose: The article deals with the proposition that consumers' fashion consumption behavior will still follow the consumption behavior of fast fashion, despite recognizing the importance of slow fashion. Research design, data and methodology: The research model to verify this proposition is topic modelling with big data including unstructured textual data. we combined 5,506 news articles posted on Naver news search platform during the 2003-2019 period about fast fashion and slow fashion, high-frequency words have been derived, and topics have been found using LDA model. Based on these, we examined consumers' perception and consumption behavior on slow fashion through the analysis of Topic Network. Results: (1) Looking at the status of annual article collection, consumers' interest in slow fashion mainly began in 2005 and showed a steady increase up to 2019. (2) Term Frequency analysis showed that the keywords for slow fashion are the lowest, with consumers' consumption patterns continuing around 'brand.' (3) Each topic's weight in articles showed that 'social value' - which includes slow fashion - ranked sixth among the 9 topics, low linkage with other topics. (4) Lastly, 'brand' and 'fashion trend' were key topics, and the topic 'social value' accounted for a low proportion. Conclusion: Slow fashion was not a considerable factor of consumption behavior. Consumption patterns in fashion sector are still dominated by general consumption patterns centered on brands and fast fashion.

인터넷 기사와 Best Item 분석을 통해 살펴본 어린이 화장품 연구 (A Study on Children's Cosmetics Based on Analyzing Internet News and Best Items)

  • 심준영
    • 패션비즈니스
    • /
    • 제22권2호
    • /
    • pp.134-149
    • /
    • 2018
  • The number of children wearing make-up is increasing. "Children's cosmetics" is not a legal term though it is commonly used. The purpose of this study is to analyze discussions on children's cosmetics based on news articles found on the internet. This study also identifies what products are being distributed as children's cosmetics. Keyword searches were conducted using internet portal sites. Information was extracted from news articles and Best Item 100 for children's cosmetics. The results of analyzing news articles and Best Item 100 lists are as follows : 1. There were two main discussion topics in news articles. The first topic was related to marketing(the branding and trends of children's cosmetics). The other topic was about government regulations(side effects, harmful ingredients, control, regulations, attention, proper product usage, product categorization, and the overall safety of children's cosmetics). By 2014, many articles had covered government control and regulation. However, since 2017, news articles have focused on the product categorization and the concern for overall safety has dramatically increased. 2. Three different product categories have appeared in the Best Item 100; they are cosmetics, toys, and other products. In market, consumers recognized children's cosmetics as cosmetics and also as toys. Between 2017 and 2018's Best Item, other products are dramatically down, color cosmetics and single cosmetics are on the rise, and the purchase of domestic products has increased.

뉴스 빅데이터를 활용한 코로나19 언론보도 분석 :토픽모델링 분석을 중심으로 (COVID-19 News Analysis Using News Big Data : Focusing on Topic Modeling Analysis)

  • 김태종
    • 한국콘텐츠학회논문지
    • /
    • 제20권5호
    • /
    • pp.457-466
    • /
    • 2020
  • 본 연구의 목적은 최근 확산되고 있는 코로나19의 뉴스 빅데이터를 활용하여 언론을 통해 사회적으로 형성되고 있는 주요 의제가 무엇이며 어떻게 변화하는지 파악해, 추후 언론보도의 방향성을 제안하는 것이다. 이를 위해 2019년 12월 31일부터 2020년 3월 11일까지 보도된 47,816건의 뉴스 빅데이터를 감염병 위기경보 4단계(관심-주의-경계-심각)를 기준으로 4개 시기로 구분하여 토픽모델링 분석을 실시해, 총 20개의 토픽을 도출하였다. 토픽 모델링 분석 결과를 토대로, 본 연구에서는 다음 사항들을 제안하였다. 첫째, '불안', '공포' 등의 자극적인 표현을 자제하고 중립적이고 객관적인 보도용어 사용이 필요하다. 둘째, 단순 사건보도식 뉴스제작을 탈피하여, 더욱 심층적이고 맥락적인 뉴스 제작이 요구된다. 셋째, 감염병 관련 상황별 세부 위기커뮤니케이션 매뉴얼 마련이 필요하다. 넷째, 시민주도의 위기 극복노력을 중점적으로 조명하는 보도가 필요하다. 본 연구는 코로나19 뉴스 빅데이터를 토픽모델링 분석방법을 활용하여 분석한 최초의 논문이라는 학술적 의의와 국가 위기커뮤니케이션 정책개발의 기초자료로 활용될 수 있는 정책적 의의를 가진다.

온라인 텍스트문서의 계층적 트리 기반 주제탐색 기법 (A Novel Technique of Topic Detection for On-line Text Documents: A Topic Tree-based Approach)

  • 현만;김한준
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2012년도 추계학술발표대회
    • /
    • pp.396-399
    • /
    • 2012
  • Topic detection is a problem of discovering the topics of online publishing documents. For topic detection, it is important to extract correct topic words and to show the topical words easily to understand. We consider a topic tree-based approach to more effectively and more briefly show the result of topic detection for online text documents. In this paper, to achieve the topic tree-based topic detection, we propose a new term weighting method, called CTF-CDF-IDF, which is simple yet effective. Moreover, we have modified a conventional clustering method, which we call incremental k-medoids algorithm. Our experimental results with Reuters-21578 and Google news collections show that the proposed method is very useful for topic detection.