• 제목/요약/키워드: 텍스트 네트워크

검색결과 536건 처리시간 0.029초

텍스트 마이닝 분석 기법을 활용한 월경주기측정 애플리케이션 사용자 경험 평가 (User Experience Evaluation of Menstrual Cycle Measurement Application Using Text Mining Analysis Techniques)

  • 정우경;신동희
    • 정보관리학회지
    • /
    • 제40권4호
    • /
    • pp.1-31
    • /
    • 2023
  • 본 연구는 여성의 건강과 밀접한 관련이 있는 모바일 월경주기 측정 애플리케이션을 대상으로 토픽모델링 기법과 함께 다양한 텍스트 마이닝 기법을 도입하여 사용자 경험 평가를 실시하였으며 그 결과를 허니콤(Honeycomb)모델과 결합하여 분석하였다. 월경주기측정 애플리케이션 리뷰에서 드러난 사용자 경험을 평가하기 위해 월경주기측정 애플리케이션의 한국어 리뷰 47,117개를 수집하였다. 리뷰에서 드러난 사용자 경험에 관한 전체적인 담론 확인을 위해 토픽모델링 분석을 실시하였고, 각 토픽 별 구체적인 경험을 확인하고자 동시출현 네트워크 관계로 구축한 텍스트 네트워크 분석을 실시하였다. 또한 사용자의 정서적 경험을 파악하기 위해 감정분석(Sentiment Analysis)을 실시하였다. 이를 기반으로 월경주기측정 애플리케이션의 개발 전략을 정확도, 디자인, 모니터링, 데이터관리 및 사용자관리 측면에서 제시하였다. 연구 결과, 애플리케이션의 월경주기측정 정확도 및 모니터링 기능을 개선해야 함이 확인되었으며 다양한 디자인적 시도가 필요함이 관찰되었다. 또한 개인정보와 사용자의 생체 데이터 관리방법에 대한 보완의 필요성도 확인되었다. 본 연구는 월경주기측정 애플리케이션의 사용자 경험(UX)을 심층적으로 탐색하여 이용자들이 경험한 다양한 요인을 밝히고 더 나은 경험을 제공하기 위한 실질적인 개선점을 제시하였다. 또한 사용자 경험을 평가하는 과정에서 방대한 양의 리뷰 데이터를 연구자가 면밀하게 파악할 수 있도록 토픽모델링과 텍스트 네트워크 분석 기법을 결합하여 방법론을 제시하였다는 점에서 의의가 있다.

텍스트 마이닝을 활용한 국가 R&D과제 동향 분석: ICT 분야와 스마트시티 중심으로 (A Study on the Analysis of ICT R&D using Text Mining Method: Focused on ICT Field and Smart City)

  • 김성순;양명석
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2021년도 추계학술발표대회
    • /
    • pp.462-465
    • /
    • 2021
  • 본 연구는 최근 ICT분야 R&D 동향을 파악하기 위하여 NTIS에서 제공하는 국가연구개발사업 과제정보를 텍스트 마이닝 기법을 통해 분석하였다. 2017년부터 2020까지의 과제 정보에서 키워드를 추출하고 연결 관계 마이닝을 통해 키워드 네트워크를 시각화하였다. 분석 결과는 다음과 같다. 첫째, 정보통신 각 분야에서 핵심 연구주제가 기술의 발전에 따라 변화하고 있음을 관찰하였다. 둘째, 키워드 네트워크 상에서 허브 역할을 하는 키워드를 통해 분야 간 융합의 매개 기술을 파악할 수 있었다. 마지막으로, 연도별 키워드 네트워크를 비교·분석함으로써 새롭게 등장하거나 연결 상태의 변화를 보이는 이머징(Emerging) 키워드를 통해 미래 유망 기술이나 최신 연구 방향성을 감지할 수 있음을 보였다.

트랜스포머 기반 MBTI 성격 유형 분류 연구 : 소셜 네트워크 서비스 데이터를 중심으로 (Research on Transformer-Based Approaches for MBTI Classification Using Social Network Service Data)

  • 정재준;임희석
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2023년도 제68차 하계학술대회논문집 31권2호
    • /
    • pp.529-532
    • /
    • 2023
  • 본 논문은 소셜 네트워크 이용자의 텍스트 데이터를 대상으로, 트랜스포머 계열의 언어모델을 전이학습해 이용자의 MBTI 성격 유형을 분류한 국내 첫 연구이다. Kaggle MBTI Dataset을 대상으로 RoBERTa Distill, DeBERTa-V3 등의 사전 학습모델로 전이학습을 해, MBTI E/I, N/S, T/F, J/P 네 유형에 대한 분류의 평균 정확도는 87.9181, 평균 F-1 Score는 87.58를 도출했다. 해외 연구의 State-of-the-art보다 네 유형에 대한 F1-Score 표준편차를 50.1% 낮춰, 유형별 더 고른 분류 성과를 보였다. 또, Twitter, Reddit과 같은 글로벌 소셜 네트워크 서비스의 텍스트 데이터를 추가로 분류, 트랜스포머 기반의 MBTI 분류 방법론을 확장했다.

  • PDF

소셜미디어 데이터를 활용한 중앙정부와 지방정부 간 지하공간의 주요 이슈 고찰 (Analysis of Issues on Underground Space between Central and Local Governments Utilizing Social Media Data)

  • 최해옥;백성준
    • 지적과 국토정보
    • /
    • 제46권1호
    • /
    • pp.75-86
    • /
    • 2016
  • 본 연구는 중앙정부와 지방정부 간 지하공간에 관한 주요 이슈를 파악하기 위해 소셜미디어 데이터를 활용하였다. 또한 이를 빅데이터 분석방법론을 통해 분석하였다. 연구방법론으로 사회네트워크분석의 키워드 네트워크 방법을 사용하였고 트위터를 통해 얻어진 텍스트 데이터를 텍스트마이닝 기법을 사용하여 분석하였다. 특히 지하공간은 2014년 잠실 싱크홀 사건 이후 사회적으로 관심을 가지고 있는 이슈로서 키워드 네트워크 분석을 통해 계량적으로 분석을 시도하였다. 네트워크의 속성을 파악하기 위해 중심성 지수, 그룹밀도 분석을 통해 지하공간과 관련된 이슈를 파악하였다. 이러한 분석 결과 중앙정부의 정책 관련 항목은 지자체 정책과 관련이 있음을 확인하였다. 중앙정부는 예방차원에서 특별법을 바탕으로 예방체계를 구축하여 지자체가 지하공간에 관련된 문제에 대해 대응 관리하도록 법에 근거한 예방체계를 구축하고 있다. 이와 같은 결과는 앞으로 중앙 정부가 연구관련 분야를 강화함으로써 지하공간 관련 안전대책을 구축하는 데 법과 기술이 서로 협력하여 발전해야 함을 시사해 준다.

문자 수준 컨볼루션 뉴럴 네트워크를 이용한 추천시스템에서의 행렬 분해법 개선 (Improving on Matrix Factorization for Recommendation Systems by Using a Character-Level Convolutional Neural Network)

  • 손동희;심규석
    • 정보과학회 컴퓨팅의 실제 논문지
    • /
    • 제24권2호
    • /
    • pp.93-98
    • /
    • 2018
  • 추천시스템은 기업의 매출을 최대화 하기 위해, 사용자에게 관심도가 높은 제품을 제공해준다. 행렬 분해법은 추천시스템에서 자주 사용되는 방법으로 불완전한 사용자-제품 평점 행렬을 기반으로 한다. 하지만 제품과 사용자의 수가 점점 많아지면서, 데이터의 희소성문제로 인해 정확한 추천이 힘들어졌다. 이러한 문제점을 극복하기 위해, 제품과 관련된 텍스트 데이터를 사용하는 행렬 분해법 알고리즘이 최근에 제시되었다. 이런 행렬 분해법 알고리즘 중, 단어 수준 컨볼루션 뉴럴 네트워크를 사용하는 방법이 단어수준 특징들을 추출하여 텍스트 데이터를 효과적으로 반영한다. 하지만 단어수준 컨볼루션 뉴럴 네트워크에서는 학습해야 하는 파라미터의 수가 많다는 문제점이 있다. 그러므로 본 논문에서는 텍스트 데이터로부터 문자 수준 특징들을 뽑아 내기 위해 문자 수준 컨볼루션 뉴럴 네트워크를 사용하는 행렬분해법을 제안한다. 또한 제안하는 행렬 분해법의 성능을 검증하기 위해 실제 데이터를 이용하여 실험을 진행하였다.

강화학습 기반의 제로샷 텍스트 분류 (Zero-shot Text Classification based on Reinforced Learning)

  • 장송밍 ;조인휘
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2023년도 추계학술발표대회
    • /
    • pp.439-441
    • /
    • 2023
  • 전통적인 텍스트 분류 방법은 상당량의 라벨링된 데이터와 미리 정의된 클래스가 필요해서 그 적용성과 확장성이 제한된다. 그래서 이런 한계를 극복하기 위해 제로샷 러닝(Zero-shot Learning)이 등장했다. 텍스트 분류 분야에서 제로샷 텍스트 분류는 모델이 대상 클래스의 샘플을 미리 접하지 않고도 인스턴스를 분류할 수 있도록 하는 중요한 주제이다. 이 문제를 해결하기 위해 정책 네트워크를 활용한 심층 강화 학습(DRL) 기반 접근법을 제안한다. 이러한 방법을 통해 모델이 새로운 의미 공간에 효과적으로 적응하면서, 다른 모델들과 비교하여 제로샷 텍스트 분류의 정확도를 향상시킬 수 있었다. XLM-R 과 비교하면 최대 15.9%의 정확도 향상이 나타났다.

코로나19 이후 공급사슬 리스크에 대한 현황연구: 네트워크 분석을 중심으로 (A Study on the Current Status of Supply Chain Risks after COVID-19: Focusing on Network Analysis)

  • 정의범;오건택
    • 한국산업정보학회논문지
    • /
    • 제28권4호
    • /
    • pp.77-92
    • /
    • 2023
  • 본 연구는 코로나19 이후 공급사슬 리스크에 대한 주요 이슈와 연구 동향을 살펴보기 위해 해외 및 국내 저널을 바탕으로 키워드 네트워크 분석을 수행하였고, 뉴스와 기사를 대상으로 네트워크 텍스트 분석을 실시하였다. 선행연구에서 상대적으로 부족했던 코로나19 이후에 대한 공급사슬 리스크를 분석한 결과, 코로나19 이후 해외 및 국내 저널, 나아가 뉴스 기사에서 이전 선행연구와는 다른 공급사슬 리스크 회복, 대응 및 민생 등과 같은 연구 동향을 알 수 있었고, 기업에 있어 공급사슬 리스크에 대한 실무적 전략 및 통찰력을 제안할 수 있었다.

소셜 네트워크 분석을 이용한 4차 산업혁명 기술 분야의 연구 동향 분석 (The Analysis of Research Trends in Technology to the Fourth Industrial Revolution using SNA)

  • 김홍광;안종욱
    • 지적과 국토정보
    • /
    • 제49권1호
    • /
    • pp.113-121
    • /
    • 2019
  • 본 연구에서는 국내 외 4차 산업혁명 관련 기술 분야의 연구 동향을 분석하기 위해서 웹 기반의 텍스트 마이닝 및 소셜 네트워크 분석 기법을 이용하였다. 이를 위해 2014년 1월 1일부터 2018년 12월 31일까지 국내 외 4차 산업혁명 관련 기술에 대한 연구 논문 및 보고서의 제목 텍스트와 날짜를 대상으로 하여 텍스트 마이닝을 수행하였다. 이후 개념적인 차원에서의 키워드 간 연관성을 분석하기 위해서 형태소 분석을 통한 대표 키워드를 도출하였다. 이후 사회 연결망 분석을 활용하여 핵심 키워드 및 연관 키워드 등을 도출하였다. 그 결과, 우리나라에서는 4차 산업혁명 기술 관련 연구 개발 및 법 제도적 완화 등에 대한 초점을 두고 있다고 유추할 수 있다. 반면, 국외는 단위 서비스 형태로의 접근을 통해 도시에 대한 실질적 적용 기술에 초점을 두고 있음을 파악할 수 있었다.

텍스트 마이닝과 소셜 네트워크 분석 기법을 활용한 소비자의 의복 맞음새(Fit)평가에 영향을 미치는 특성 (Using Text Mining and Social Network Analysis to Identify Determinant Characteristics Affecting Consumers' Evaluation of Clothing Fit)

  • 황수현;박주연
    • 감성과학
    • /
    • 제26권1호
    • /
    • pp.101-114
    • /
    • 2023
  • 본 연구의 목적은 텍스트 마이닝과 소셜 네트워크 분석을 활용한 소비자 맞음새 평가의 주요 특징을 규명하는 것이다. 이를 위해 SNS에서 수집된 소비자의 2,000여건의 의복 맞음새 평가 후기로부터 의복 맞음새 관련된 텍스트 데이터를 추출하고 의미연결망 분석과 CONCOR 분석을 수행하였다. 연구 결과, '팬츠'와 '스커트'가 많은 맞음새평가어를 공유하며 다양한 형태로 평가되는 것을 확인하였고 의복의 길이가 가장 많이 평가되었다. 인체부위 중 '허리'는 다양한 의복의 맞음새를 평가하는 가장 중요한 부분이며 의복 맞음새평가어 중 '넓은', '큰', '와이드한', '긴' 등이 가장 많이 사용되는 것으로 나타났다. 본 연구는 소비자 맞음새 평가에 사용된 언어의 구조적 관계와 의미를 구체적으로 규명하고 의복 맞음새의 향상을 위한 실증적 기초 자료를 제공하는데 의의가 있다.