• 제목/요약/키워드: 다이나믹 토픽 모델링

검색결과 7건 처리시간 0.025초

다이나믹토픽모델링을 활용한 문헌정보학 분야의 토픽 변화 분석 (Analysis of Research Topic Trend in Library and Information Science Using Dynamic Topic Modeling)

  • 김선욱;양기덕;이혜경
    • 한국도서관정보학회지
    • /
    • 제53권2호
    • /
    • pp.265-284
    • /
    • 2022
  • 본 연구는 2001년부터 2020년까지 문헌정보학 SSCI 85종 학술지에 게재된 55,442편의 학술논문의 논문제목과 초록을 기반으로 다이나믹토픽모델링을 수행하여, 문헌정보학 분야의 연도별 흐름에 따른 연구 주제 추이를 분석하였다. 그 결과, 10개의 토픽에서 도서관경영(장서개발 및 관리, 도서관평가, 도서관 지식경영, 기획 및 활성화), 정보학(계량정보학, 정보이용행태·이용자연구, 의료정보, 정보시스템), 도서관 서비스(도서관교육·정보리터러시), 도서관체계(도서관 시책 및 정책)에 따른 4개의 대분류를 파악하였다. 연도별 흐름에 따라 정보학 영역의 경우, 계량정보학 연구 주제가 학술지단위에서 논문단위로 변화되고 있었으며, 최근 도서관경영 영역의 경우, 이용자의 의견과 감정에 관련한 연구가 최근 등장하였다. 도서관서비스 연구영역은 20년간 안정적인 연구 주제로 그 양상이 보다 심화되고 견고해졌음을 확인할 수 있었다. 그리고 최근에는 모바일과 소셜미디어와 관련한 연구가 진행 중인 것으로 나타났다. 한편, 정보학영역 하위주제로 의료정보와 관련한 연구가 비중 있게 등장해, 문헌정보학의 간학문적인 특징이 잘 나타난 결과라 판단하였다.

다이나믹 토픽 모델을 활용한 D(Data)·N(Network)·A(A.I) 중심의 연구동향 분석 (Investigation of Research Trends in the D(Data)·N(Network)·A(A.I) Field Using the Dynamic Topic Model)

  • 우창우;이종연
    • 한국융합학회논문지
    • /
    • 제11권9호
    • /
    • pp.21-29
    • /
    • 2020
  • 최근 디지털 사회의 도래로 다양한 데이터가 폭발적으로 증가하고, 그중 문헌 내 주제어를 도출하는 토픽 모델링에 관한 연구가 활발히 진행되고 있다. 본 논문의 연구목표는 토픽 모델링 방법 중 하나인 DTM(Dynamic Topic Model) 모델을 적용해 D.N.A.(Data, Network, A.I) 분야에 대한 연구동향을 탐색하는데 있다. 실험 데이터는 최근 6년간(2015~2020) ICT(Information and Communication Technology) 분야 중 기술대분류가 SW·AI에 해당하는 연구과제 1,519개 사업에 대해 DTM 모델을 적용하였다. 실험결과로, D.N.A. 분야의 기술 키워드 Big data, Cloud, Artificial Intelligence와 확장된 의미의 기술 키워드 Unstructured, Edge Computing, Learning, Recognition 등이 매년 연구에 표출되었으며, 해당 키워드 들이 특정 연구과제에 종속되지 않고 다른 연구과제에서도 포괄적으로 연구되고 있음을 확인하였다. 끝으로 본 논문의 연구결과는 향후 D.N.A. 분야에 대한 정책기획·과제기획 등 연구개발 기획 과정과 기업의 기술 확보전략·마케팅 전략 등 다양한 곳에 활용될 수 있을 것으로 기대한다.

부동산 정책 관련 트위터 게시물 분석을 통한 대중 여론 이해 (Understanding Public Opinion by Analyzing Twitter Posts Related to Real Estate Policy)

  • 김규리;오찬희;주영준
    • 한국문헌정보학회지
    • /
    • 제56권3호
    • /
    • pp.47-72
    • /
    • 2022
  • 본 연구는 시간의 흐름에 따른 부동산 정책의 주제 동향과 부동산 정책에 대한 대중의 감성 여론을 파악하고자 하였다. 부동산 정책 관련 키워드('부동산정책', '부동산대책')를 이용하여 2008년 2월 25일부터 2021년 8월 31일까지 13년 6개월 동안 작성된 총 91,740개의 트위터 게시물을 수집하였다. 데이터를 전처리하고 공급, 부동산세, 금리, 인구 분산으로 범주화 하여 총 18,925개의 게시물에 대하여 감성 분석과 다이나믹 토픽 모델 분석을 진행하였다. 범주별 키워드는 공급 범주(임대주택, 그린벨트, 신혼부부, 무주택자, 공급, 재건축, 분양), 부동산세 범주(종부세, 취득세, 보유세, 다주택자, 투기), 금리 범주(금리), 인구 분산 범주(세종, 신도시)와 같다. 감성 분석 결과, 한 명이 평균 하나 또는 두 개의 긍정 의견을 게시한 걸로 확인되었고, 부정, 중립 의견의 경우, 한 명이 두 개 또는 세 개의 게시물을 게시한 걸로 확인되었다. 또한 일부 대중들은 부동산 정책에 일관된 감정을 가지고 있지 않고 긍정, 부정, 중립의 의견을 모두 표현하는 것을 유추할 수 있었다. 다이나믹 토픽 모델링 결과, 부동산 투기 세력, 불로소득 주제에 대한 부정적인 반응이 꾸준히 파악되었으며, 긍정적인 주제로는 주택 공급 확대와 무주택자들의 부동산 구입 혜택에 대한 기대감을 확인할 수 있었다. 본 연구는 기존 선행연구들이 특정 부동산 정책의 변화와 평가에 초점을 맞춰 분석한 것과는 달리, 소셜미디어 플랫폼 중 하나인 트위터에서 게시물을 수집하고 감성 분석, 다이나믹 토픽 모델링 분석을 활용하여 부동산 정책 평가자인 대중의 감성과 여론을 알아보고 시간의 흐름에 따른 부동산 정책에 관한 잠재적 주제와 동향을 파악했다는 것에 학술적 의의가 있다. 또한, 본 연구를 통해 부동산 정책에 대한 대중의 여론에 기반한 새로운 정책 제정에 도움을 주려고 한다.

다이나믹 토픽모델링 및 네트워크 분석 기법을 통한 블록체인 관련 국내 연구 동향 분석 (Analyzing Research Trends in Blockchain Studies in South Korea Using Dynamic Topic Modeling and Network Analysis)

  • 김동훈;오찬희;주영준
    • 정보관리학회지
    • /
    • 제38권3호
    • /
    • pp.23-39
    • /
    • 2021
  • 본 연구에서는 국내 블록체인 연구의 전반적인 동향 및 시간에 따른 주제를 파악하기 위해 대학 및 기관 협력 네트워크 분석, 키워드 동시출현 네트워크 분석, 다이나믹 토픽모델링 기법을 활용한 시계열 주제 분석을 실시하였다. 대학 및 기관 협력 네트워크 분석 결과, 숭실대학교, 순천향대학교, 고려대학교, 한국과학기술원 등이 블록체인 연구의 주요 대학으로 나타났으며 대학 이외의 기관으로는 국방부, 한국철도기술연구원, 삼일회계법인, 한국전자통신연구원 등이 주요 연구기관으로 나타났다. 키워드 동시출현 네트워크 분석 결과, 가상자산(암호화폐, 비트코인, 이더리움, 가상화폐), 블록체인 기술(분산원장, 분산원장기술), 금융(스마트계약), 정보보안(보안, 프라이버시, 개인정보) 등에 대한 키워드들이 주요하게 나타났으며, 모든 네트워크 중심성 지표에서 스마트계약이 가장 높은 수치를 나타내어 주요한 주제임을 확인할 수 있었다. 마지막으로 시계열 주제분석 결과, 블록체인기술, 블록체인생태계, 블록체인 적용분야1(무역, 온라인투표, 부동산), 블록체인 적용분야2(식품, 관광, 유통, 미디어), 블록체인 적용분야3(경제, 금융) 등 다섯 개의 주요 주제들을 도출하였으며, 각 주제별 대표 키워드들의 비율변화를 통해 주제별 변화를 관찰할 수 있었다. 본 연구는 기존의 국내 블록체인 연구동향 연구들과 크게 세 가지 관점(데이터, 방법론, 해석)에서 차이점을 나타내고 있다. 1) 최근 2년 사이 급증한 블록체인 연구를 포함하였고, 2) 대학 및 기관 네트워크 분석과 시계열 주제분석이라는 새로운 분석기법 및 연구방법을 활용하였으며, 3) 이를 통해 블록체인 연구를 주도하는 대학 및 기관을 식별하고 국내 블록체인 연구 트렌드를 파악하였다. 끝으로, 연구결과가 블록체인 관련 연구 협력 및 정책 수립과 관련 기술 개발 계획에 활용될 수 있다는 점에서 실질적인 함의를 시사한다.

트위터에서의 COVID-19와 관련된 반시민성 주제 탐색: 혐오 대상 및 키워드 분석 (Investigating Topics of Incivility Related to COVID-19 on Twitter: Analysis of Targets and Keywords of Hate Speech)

  • 김규리;오찬희;주영준
    • 정보관리학회지
    • /
    • 제39권1호
    • /
    • pp.331-350
    • /
    • 2022
  • 본 연구는 코로나바이러스감염증-19 (이하 코로나19)로 인해 생겨난 코로나19 반시민성 주제와 코로나19 혐오 정서를 파악하기 위해 소셜미디어 중 하나인 트위터의 코로나19 관련 게시물을 분석하였다. 2019년 12월 1일부터 2021년 8월 31일까지 21개월 동안 작성된 코로나19 관련 혐오 대상별(지역, 공공시설 혐오, 특정 인구 집단 혐오, 종교 혐오) 게시물 수집 및 전처리를 진행하여 총 63,802개의 게시물을 분석하였다. 혐오 대상별 빈도 분석, 다이나믹 토픽 모델링, 키워드 동시 출현 네트워크 분석 기법을 통하여 혐오 대상별 반시민성 주제와 혐오 키워드를 파악하였다. 첫째, 빈도 분석 결과, 지역, 공공시설 혐오는 상대적으로 증가하는 추세를 보이고 특정 인구 집단과 종교 혐오는 상대적으로 감소하는 추세를 확인할 수 있었다. 둘째, 다이나믹 토픽 모델링 분석 결과, 지역, 공공시설 혐오는 '대구, 경북지방 혐오', '지역 간 혐오', '공공시설 혐오'로 나타났고, 특정 인구 집단 혐오는 '중국 혐오', '바이러스 전파자', '실외(야외)활동 제재'로 나타났으며, 종교 혐오는 '신천지', '기독교', '종교 내 감염', '방역 의무 거부', '확진자 동선 비난'으로 나타났다. 셋째, 키워드 동시 출현 네트워크 분석 결과, 지역, 공공시설 혐오(코로나, 대구, 확진자, 신천지, 경북, 지역), 특정 인구 집단 혐오(코로나바이러스, 우한폐렴, 우한, 중국, 중국인, 사람, 입국, 금지), 종교 혐오(신천지, 코로나, 교회, 대구, 확진자, 감염) 등을 핵심 키워드로 확인할 수 있었다. 본 연구는 소셜 미디어를 활용한 국내 코로나19 혐오 대상 및 키워드 파악을 통해 코로나19 관련한 대중의 반시민성 여론을 파악하고자 하였다. 특히 기존의 선행연구에서 시도하지 않았던 주제인 코로나19 관련 혐오에 데이터 마이닝기법을 이용하여 소셜 미디어에서 표출하는 대중의 반시민성 주제와 혐오 정서 탐색은 대중들의 여론을 파악하는 것이 의의가 있다. 더불어 본 연구 결과는 포스트 코로나 시대를 대비하는 문화적 소통 방안의 제도 및 정책 수립 기여를 위한 기본 자료에 기초할 수 있다는 점에서 실질적 함의를 시사한다.

네이버 뉴스 댓글을 이용한 산업 분야별 담론의 감성에 기반한 주제 트렌드 및 여론의 변화와 주가 흐름의 연관성 분석 (Analyzing Topic Trends and the Relationship between Changes in Public Opinion and Stock Price based on Sentiment of Discourse in Different Industry Fields using Comments of Naver News)

  • 오찬희;김규리;주영준
    • 정보관리학회지
    • /
    • 제39권1호
    • /
    • pp.257-280
    • /
    • 2022
  • 본 연구에서는 대한민국 정부가 지정한 국가전략기술 사업인 반도체, 이차전지, 바이오 산업에 대한 여론을 파악하고 여론의 변화와 주가 흐름의 연관성을 분석하기 위해 각 산업별 대표 기업에 대한 기사의 댓글을 분석하였다. 반도체 산업에서 '삼성전자', 'SK하이닉스', 이차전지 산업에서 '삼성SDI', 'LG화학', 바이오 산업에서 '삼성바이오로직스', '셀트리온'을 선정하여 이를 제목에 포함하고 있는 2020년 1월 1일부터 2020년 12월 31일까지 발행된 네이버 뉴스 기사의 댓글 47,452개를 수집하고 분석하였다. 먼저, 해당 댓글을 긍정, 중립, 부정의 감성으로 나누고 각 감성 그룹에서의 시간의 흐름에 따른 댓글의 동적인 주제를 분석하여 각 산업별 여론의 트렌드를 파악하였다. 분석 결과 반도체 산업 분야의 경우 투자, 코로나19관련 이슈, 삼성전자라는 대기업에 대한 신뢰, 정부 정책 변화로 인한 타격에 대한 언급이 주제 토픽으로 나타났다. 이차전지 산업체의 경우 투자, 배터리, 기업 이슈에 대한 언급이 주제 토픽으로 나타났다. 바이오 산업체의 경우 투자, 코로나19 관련 이슈 및 기업 이슈에 대한 언급이 주제 토픽으로 나타났다. 다음으로, 댓글의 감성이 실제 주가와 연관성이 있는지를 알아보고자 각 대표 기업 별 주가의 변화와 댓글의 감성 점수 변화를 시각적 분석기법을 이용하여 비교 분석하였다. 분석 결과, 댓글의 감성 점수와 주가의 변화 흐름이 매우 유사하게 나타남을 통해 여론의 감성 점수 변화와 주가의 흐름에는 연관성이 있음을 확인하였다. 본 연구는 주가와의 연관성이 높은 뉴스 기사 댓글을 분석했다는 점, 수집 시기를 코로나19로 선정하여 코로나19라는 특수한 상황에서의 여론 트렌드 변화를 파악했다는 점, 국가전략기술제도에 속하는 산업 기업에 대한 여론을 분석하여 정부기관의 관련 정책 제정에 객관적인 근거를 제공하였다는 점에서 의의를 지닌다.

트위터 오피니언 마이닝을 통한 코로나19 기간 대학 비대면 수업에 대한 의견 고찰 (Exploring Opinions on University Online Classes During the COVID-19 Pandemic Through Twitter Opinion Mining)

  • 김동훈;강정;주영준
    • 한국문헌정보학회지
    • /
    • 제55권4호
    • /
    • pp.5-22
    • /
    • 2021
  • 본 연구는 코로나바이러스감염증-19 (이하 코로나19) 확산 이후 대학의 부분 또는 전면 비대면 수업으로의 전환에 대해 소셜 미디어 플랫폼 중 하나인 트위터에서 이를 어떻게 생각하고 논의하고 있는지를 파악하기 위해 진행되었다. 이를 위해 트위터에서 비대면 수업 관련 트윗을 수집한 후 감성분석 및 시계열 주제 분석을 실시하였다. 감성분석결과, 전반적으로 긍정적인 여론보다 부정적인 여론이 많았지만 시간이 지남에 따라 점차 부정적인 여론이 줄어드는 경향이 나타남을 확인하였다. 또한 월별 감성점수분포를 통해 학기 중이 방학기간보다 감성점수 분포의 폭이 넓음을 확인하였고, 이를 통해 학기 중일 때가 방학 때보다 비대면 수업에 대해 더 다양한 감정과 의견을 교환한다는 사실을 확인할 수 있었다. 다음으로 긍정트윗과 부정트윗을 구분하여 시계열 주제 분석을 실시한 결과, 긍정트윗에서는 수업환경 및 장비, 긍정적인 감정 표현, 강의시청장소, 언어수업, 시험 및 과제와 같은 다섯 가지 주요한 주제가 나타났으며, 부정트윗에서는 시간(수업시간, 쉬는시간), 시험 및 과제, 부정적인 감정 표현, 수업환경 및 장비와 같은 네 가지 주요한 주제가 나타남을 확인하였다. 또한 각 주제별 대표 키워드들의 비율을 통해 시간에 따른 주제의 변화를 파악함으로써 비대면 수업에 대한 여론의 트렌드를 살펴 보고자 하였다. 본 연구는 기존 비대면 수업 관련 연구들과는 달리 소셜 미디어 중 하나인 트위터를 활용하여 국내 대학의 비대면 수업에 대한 전반적인 의견을 파악하고자 하였으며, 감성분석과 시계열 주제 분석을 활용하여 비대면 수업에 대한 긍부정 여론을 나누어 식별 및 시간의 흐름에 따른 트렌드의 변화를 파악하였다는 점에서 학문적 함의를 지닌다. 또한 연구결과는 국내 대학에서의 비대면 수업에 대한 구성 및 개선방안 등에 활용될 수 있으며, 비대면 수업을 설계하는 대학 및 교수자들에게 도움이 될 수 있다는 점에서 실질적인 함의를 지닌다.