• 제목/요약/키워드: 트윗

검색결과 169건 처리시간 0.03초

트윗 감정 분류를 위한 비어휘자질의 사용 (Using Non-Lexical Features for Tweet Sentiment Classificaion)

  • 홍초희;김학수
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2012년도 제24회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.160-162
    • /
    • 2012
  • 문서를 대상으로 한 다양한 감정 분류 연구가 진행되어 왔으며, 최근에는 트윗 감정 분류에 그대로 적용되고 있다. 그러나 트윗은 일반 문서와 다르게 몇 가지의 독특한 특징을 갖고 있어 좋은 성능을 보이지 못하고 있다. 본 논문에서는 기계학습을 기반으로 트윗의 특징과 트윗 사용자 정보 자질을 사용한 실험으로 트윗 감정 분류 성능의 영향을 확인하였다. 실험 결과 트윗에 포함된 이모티콘 감정 극성과, 사용자 성향 극성 자질은 트윗 감정 분류 모델의 성능 향상에 기여를 하는 것을 알 수 있었다.

  • PDF

트윗의 내용과 기능 그리고 관여도가 트윗 신뢰도와 태도에 미치는 영향 (Influence on the Tweet Credibility and Attitude Toward Tweet of Tweet Content, Function and Involvement)

  • 이현지;정동훈
    • 한국콘텐츠학회논문지
    • /
    • 제13권6호
    • /
    • pp.137-147
    • /
    • 2013
  • 본 연구에서는 타인의 트윗을 볼 때 어떠한 변인이 트윗 신뢰도와 태도에 영향을 주는지 살펴보고자 내용(정보/의견), 기능(없음/URL/RT) 그리고 관여도(저/고)를 독립변인으로 하여 실험연구를 했다. 설문지, 인터뷰 그리고 유저빌리티 테스팅 소프트웨어 등 세 가지 연구방법을 이용한 결과, 유저빌리티 소프트웨어를 통한 직접관찰에서는 실험 참여자들이 트윗 내용, 기능 그리고 관여도가 읽는 순서, URL 클릭여부, RT시 원래 트윗 작성자 확인여부 등에 영향을 주지 않음을 확인하였고, 트윗 신뢰도에서는 내용에서만 유의미한 차이를 그리고 트윗 태도에서는 트윗 내용, 기능 그리고 관여도 간에 유의미한 상호작용 효과가 있는 것으로 나타났다. 마지막으로 인터뷰를 통해서 의견 보다는 정보가, 그리고 URL>RT>아무 것도 없는 정보나 의견 순으로 더 신뢰할 만하다는 결과가 나왔는데, 그 이유는 개인 의견에 대한 한계와 URL과 RT 등을 통한 정보원에 대한 신뢰 때문인 것으로 보인다. 수많은 트윗 가운데 제한된 트윗에 노출될 수밖에 없는 상황에서 이러한 결과는 트윗 송신자들의 메시지 작성 형태에 대한 중요한 함의를 보여준다.

학술문헌을 인용하는 트윗의 기능 분석 연구 (Function Classification of tweets Citing Scholarly Articles)

  • 김병규;강지훈
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2018년도 제58차 하계학술대회논문집 26권2호
    • /
    • pp.83-84
    • /
    • 2018
  • 개별논문 평가를 위해 제안된 altmetric가 주목받고 있다. altmetrics에서는 개별 논문의 트윗의 건수를 평가요소 중 하나로 활용한다. 그러나 여러가지 목적으로 작성된 트윗을 단일하게 처리하는 것은 문제가 있다. 본 논문은 과학 논문에 달린 트윗들을 분석하여 기능의 범주를 정의하고 분류체계를 제시하였으며, 기존의 논문의 인용기능 분류 실험을 실시하여 그 결과와 비교 분석을 수행하였다. 향후 도출한 트윗 기능 분류에 대한 개선과 추가적인 연구를 수행할 계획이다.

  • PDF

소셜 사건에 대한 사용자의 행동 분석에 기반한 신뢰성 높은 사용자의 트윗 추출 (Extracting Reliable User's Tweet for Social Events Based on User Behavior in Twitter)

  • 촐몽 바야르;이경순
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2012년도 추계학술발표대회
    • /
    • pp.608-611
    • /
    • 2012
  • 소셜 사건이 일어나면 그 사건과 관련된 트윗이 폭발적으로 증가하는데 트윗 일부 내용을 살펴보면 스팸, 광고와 같은 트윗이 많이 포함되어 있다. 수 많은 트위터 데이터에서 사용자가 사건과 직접 관련된 신뢰성 높은 트윗을 찾아 읽는데 시간이 많이 걸릴 수 있다. 이러한 문제를 해결하기 위해 본 논문에서 트위터의 리트윗 정보, 사용자 신뢰도 측정 및 활동 분석, 팔로잉과 팔로워간의 정보 등 사용자의 행동 분석을 이용하여 소셜 사건과 직접 관련된 신뢰성 높은 사용자의 트윗을 추출하는 방법을 제안한다. 제안 방법의 유효성을 검증하기 위해 소셜 이슈 4 개에 대한 트윗 데이터에서의 실험을 통하여 상위 100 개의 결과에서의 정확률(P@100) 76.6%의 성능을 보였다. 실험을 통해 제안 방법이 신뢰성 높은 사용자의 트윗을 추출하는데 효과적인 방법임을 알 수 있다.

토픽 기반의 트윗 분류를 위한 해시태그 분석 기법 (Hashtag Analysis Scheme for Topic based Tweet Categorization)

  • 김용성;전상훈;유제혁;황인준
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2014년도 추계학술발표대회
    • /
    • pp.737-740
    • /
    • 2014
  • 최근 SNS 사용자가 급증하면서 매우 다양하고 방대한 양의 글이 여러 종류의 SNS를 통해 생성되고 있다. 그중 트위터는 정보의 전달 및 확산에 상당히 유용한 도구로 사용되고 있다. 이러한 트위터의 사용자 트윗은 뉴스, 음악, 사진, 여행 등 다양한 형태로 등장한다. 또한 트위터는 해시태그라는 사용자 정의 태그를 사용하는데 이는 트윗의 키워드 및 핵심을 쉽게 표현할 수 있도록 해주는 효과적인 수단이다. 최근 상당히 많은 양의 트윗의 생성에도 불구하고 이를 다양한 카테고리별로 분류할 수 있는 연구가 많이 진행되지 않았다. 따라서 본 논문에서는 해시태그를 이용해 트윗의 핵심을 파악하고 수많은 트윗을 다양한 토픽별로 분류할 수 있는 기법을 제안한다. 우선 다양한 카테고리의 인기 해시태그가 포함된 트윗을 수집하고 수집한 트윗에서 해시태그별 키워드를 추출한다. 그리고 코사인 유사도를 통해 해시태그별 내용 유사도를 파악하여 각 카테고리 내의 해시태그가 얼마나 유사한 내용을 지니고 있는지 파악한다. 마지막으로 사용자 트윗이 입력되면 모든 카테고리와 유사도를 비교하여 가장 유사도가 높은 카테고리를 찾아 추천해준다. 제안된 기법을 바탕으로 프로토타입을 구현하고 실험을 통해 성능을 평가한다.

자연어 처리 기반 맞춤형 트윗 추천 시스템 (Natural Language Processing-based Personalized Twitter Recommendation System)

  • 이현창;유동필;정가빈;남용욱;김용혁
    • 한국융합학회논문지
    • /
    • 제9권12호
    • /
    • pp.39-45
    • /
    • 2018
  • 트위터 사용자는 팔로우, 리트윗 등을 사용하여 자신이 관심 있어 하는 트윗을 찾는다. 하지만 사용자가 3억여 명에 달하는 트위터에서 사용자가 관심 있는 트윗을 찾기는 힘든 일이다. 이를 해결하기 위해 본 논문에서는 사용자 맞춤형 트윗 추천 시스템을 개발하였다. 우선, 사용자에게 추천할 수 있을 만한 가치가 있는 트윗을 수집하기 위해 현재 트랜드를 수집하고, 트랜드에 대해 이야기하는 인기 있는 트윗들을 수집한다. 이후 사용자를 분석하고 맞춤형 트윗을 추천하기 위해 사용자의 트윗과 수집한 트윗을 범주화한다. 최종적으로 웹서비스를 이용하여 사용자에게 본인과 카테고리가 일치하는 트윗과 관심사가 일치하는 사용자를 추천해준다. 결과적으로 67.2%로 적절한 트윗을 추천하였다.

소셜 빅데이터 모니터링을 통한 재난정보 위치공개 트윗 현황 분석 (A Status Analysis of Location Disclosure Tweet of Disaster Information using Social Bigdata Monitoring)

  • 이보람;배병걸;최선화
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2014년도 추계학술발표대회
    • /
    • pp.900-901
    • /
    • 2014
  • 최근 정보처리기술의 비약적인 발전은 소셜미디어를 통해 생산되는 종합정보의 처리를 용이하게 하였으며 광역적 의사소통을 가능하게 하였다. 이와 같은 기술의 발전을 재난관리에 적극 활용하려는 움직임이 확산되고 있으며, 이는 국내외의 여러 사례들을 통해 그 필요성이 입증되고 있다. 본 연구에서는 국립재난안전연구원에서 개발한 실시간 소셜 빅데이터 모니터링 시스템인 '소셜빅보드(Social Big Board)'를 활용하여 대상 기간 동안의 지역별 위치공개 트윗 현황을 조사하였다. 이를 위해 전체 재난 안전관련 트윗 중 위치정보공개 트윗을 대상으로 분석을 수행 하였으며 그 결과, 분석기간에 따른 전체 트윗과 지역별 위치정보공개 트윗은 재난상황의 발생과 피해규모에 따라 발생의 정도가 다르게 나타나는 것을 확인하였다. 향후, 재난 안전과 관련된 위치정보공개 트윗의 지속적인 모니터링 수행을 통해 신뢰성 있는 재난 대응체계 구축이 가능할 것으로 기대된다.

유사 트윗 분석에 기반한 트위터 해시태그 추천기법 (Twitter HashTag Recommendation Scheme based on Similar Tweet Analysis)

  • 전민아;전상훈;황인준
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2013년도 추계학술발표대회
    • /
    • pp.962-963
    • /
    • 2013
  • 트위터 해시태그(#, HashTag)는 트윗(Tweets)에서 특정 키워드나 내용을 주제별로 분류하고 검색을 보다 효율적으로 사용하기 위한 사용자 정의 태그이다. 사용자가 정의하기에 따라 다양한 형태로 작성되기 때문에 오히려 검색의 효율성이 떨어질 수 있으며, 사용자는 자신이 작성한 트윗에 어떤 해시태그를 추가해야 하는지에 대한 궁금증이 생기는 경우가 발생한다. 본 논문에서는 이러한 문제를 해결하기 위해 사용자가 작성한 트윗에 적합한 해시태그를 추천하는 기법을 제안한다. 수집한 트윗과 해시태그의 키워드를 추출하고 트윗의 유사도를 계산하기 위해 TF-IDF와 Cosine Similarity를 적용하여 유사한 트윗을 갖는 해시태그를 추천한다. 본 논문에서 제안된 기법을 검증하기 위한 실험으로 추천의 정확성을 평가했다.

시공간 정보를 사용한 개선된 트윗 봇 검출 (Improved Tweet Bot Detection Using Spatio-Temporal Information)

  • 김효상;신원용;김동건;조재희
    • 한국정보통신학회논문지
    • /
    • 제19권12호
    • /
    • pp.2885-2891
    • /
    • 2015
  • 온라인 소셜 네트워크 서비스 중 하나인 트위터는 가장 보편적으로 사용되는 마이크로 블로그인데, 트위터의 개방적 구조로 인해 자동화 프로그램인 트윗 봇이 많이 생성되고 있다. 이 트윗 봇은 적법한 봇과 악성 봇으로 분류되는데, 이 중 악성 봇은 일반 사용자들에게 많은 양의 스팸 정보나 유해한 컨텐츠를 배포하기 때문에 트윗 봇을 검출하는 작업은 반드시 필요하다. 기존 연구에서는 시간적 정보를 활용하여 사람과 트윗 봇을 분류하였다. 본 논문에서는 사용자들의 고 정밀 위치 정보를 알려주는 공간 태그된 트윗 정보를 활용하여 트위터 사용자들의 정확한 위치와 트윗 전송시각을 알아낸 후, 각 사용자의 시공간 엔트로피를 계산하여 트윗 봇을 검출하는 개선된 두 단계 알고리즘을 제안한다. 주요 결과로써, 시간 정보만을 이용한 기존 연구결과보다 각 신뢰도별 봇 검출 확률 및 거짓 경보 확률이 모두 우수하게 나타난다.

개체 중의성 해소를 위한 사용자 유사도 기반의 트윗 개체 링킹 기법 (Tweet Entity Linking Method based on User Similarity for Entity Disambiguation)

  • 김서현;서영덕;백두권
    • 정보과학회 논문지
    • /
    • 제43권9호
    • /
    • pp.1043-1051
    • /
    • 2016
  • 트위터 문서는 웹 문서에 비해 길이가 짧기 때문에 웹 기반의 개체 링킹 기법을 그대로 적용시킬 수 없어 사용자 정보나 집단의 정보를 활용하는 방법들이 시도되고 있다. 하지만, 트윗의 개수가 충분하지 않은 사용자의 경우 데이터 희소성 문제가 여전히 발생하고 관련이 없는 집단의 정보를 사용할 경우 링킹의 결과에 악영향을 미칠 수 있다. 본 논문에서는 기존 연구의 문제를 해결하기 위해 단일 트윗 내의 의미 관련도 뿐만 아니라 사용자의 트윗 집합과 다른 사용자들의 트윗 집합까지 고려하여 데이터 희소성을 해결하고, 관련성이 높은 사용자들의 트윗 정보에 가중치를 주어 트윗 개체 링킹의 성능을 높이고자 한다. 실제 트위터 데이터를 활용한 실험을 통해 제안하는 트윗 개체 링킹 기법이 기존의 기법에 비해 높은 성능을 가지며, 유사도가 높은 사용자의 정보를 사용하는 것이 트윗 개체 링킹에서 데이터 희소성 해결과 링킹 정확도 향상에 연관성이 있음을 보였다.