• 제목/요약/키워드: 키워드 빈도 분석

검색결과 353건 처리시간 0.027초

키워드 네트워크 분석을 활용한 세계 크루즈산업 연구동향 (Research Trends in Global Cruise Industry Using Keyword Network Analysis)

  • 장세은;이수호
    • 한국항해항만학회지
    • /
    • 제38권6호
    • /
    • pp.607-614
    • /
    • 2014
  • 세계적으로 해양산업은 크루즈산업에 많은 관심과 연구가 대폭적으로 이루어지고 있고 우리나라도 미래의 잠재력 있는 국가동력산업의 하나로 인식하고는 있으나 크루즈산업의 연구동향 분석 연구는 국내외에 활발히 이루어지고 있지 않다. 따라서 우선 세계 크루즈산업을 연구하고 이해하기 위해서는 최근에 다양한 산업에 대한 연구동향을 분석한 방법을 활용하여 크루즈산업에도 적용할 필요가 있다. 본 논문의 목적은 외국 유명저널에 발표된 크루즈산업과 관련된 학술논문에서 제시하고 있는 키워드와 논문을 매개로 한 키워드 네트워크를 구축하여 복잡계의 네트워크 분석에서 사용하는 연결 중심성과 매개 중심성 분석방법으로 시대별로 나누어 시각화하여 살펴봄으로써 세계 크루즈산업의 연구동향을 심층적으로 관찰하여 논의하는 것이다. 본 연구에서 제시된 키워드 빈도는 Zipf의 법칙을 따르고 노드의 연결정도는 멱함수 분포를 보여주고 있어 언어네트워크에서 분석하는 키워드 네트워크와 동일함을 관찰한다. 연구방법론으로는 키워드 네트워크 분석을 위하여 사회연결망 프로그램인 넷마이너 4.0을 사용하여 여러 가지 중심성 측정방법 중 키워드 상위 20개의 빈도순위를 비교하여 빈도순위와 가장 가까운 중심성 측정방법을 선택하여 크루즈산업의 연구동향을 분석한다. 특히 크루즈산업의 연구동향이 연도 기간별로 어떠한 변화를 가져왔는지를 살펴보기 위해 2000년 이전과 2000년 이후로 크게 대별하여 나누고 2000년 이후에는 5년 주기로 각 기간별 공통적으로 나타나는 연결 중심성이 높은 최상위의 키워드인 cruise와 tourism 노드를 중심으로 매개 중심성이 높은 것들의 키워드 네트워크를 시각화하여 논의한다. 연구결과에서 흥미롭게도 2010-2014의 기간에 새로운 노드로 China가 등장하여 최상위의 키워드들을 연결하고 있는 것은 최근 급성장하고 있는 중국의 크루즈산업의 발전 양상을 보여준다. 그러므로 본 연구에서 사용하는 키워드 네트워크 분석은 각 연도 기간별 네트워크의 다른 종류의 숫자와 크고 작은 중심축 군집 네트워크의 숫자의 증감뿐 아니라 중심축 군집 네트워크의 중심에 있는 키워드 간의 연결 분석을 용이하게 해주어 기간별 연구동향을 파악하는데 유용한 방법임을 확인할 수 있었다.

텍스트마이닝 방법론을 활용한 웨어러블 관련 키워드의 트렌드 분석 (Analyzing the Trend of Wearable Keywords using Text-mining Methodology)

  • 김민정
    • 디지털융복합연구
    • /
    • 제18권9호
    • /
    • pp.181-190
    • /
    • 2020
  • 본 연구는 신문기사로부터 수집한 웨어러블 관련 텍스트를 대상으로 텍스트마이닝을 수행하여 웨어러블 관련 키워드의 트렌드를 분석하였다. 이를 위해 1992년부터 2019년까지 신문기사 11,952건을 수집하여 빈도분석과 바이그램 분석을 적용하였다. 빈도분석 결과 삼성전자, LG전자, 애플이 최상위 빈도어로 추출되었으며 스마트워치, 스마트밴드가 기기 측면에서 지속적으로 등장하였음을 알 수 있었다. 또한 IT전시회가 매년 고빈도어로 나타났으며 차세대 기술 관련 키워드와 융합된 내용이 기사화되는 것을 볼 수 있었다. 바이그램 분석 결과, 세계-최초, 세계-최대 같은 단어 묶음이 지속적으로 등장하였으며 이슈나 이벤트가 발생할 때마다 관련된 새로운 단어 묶음이 도출됨을 확인할 수 있었다. 이러한 웨어러블 관련 키워드의 트렌드 추이 파악은 웨어러블 동향과 향후 방향성을 이해하는데 유용할 것이다.

키워드 네트워크 분석을 통한 『한국초등수학교육학회지』 연구의 동향 분석 (A Study on the Research Trends of 『Journal of Elementary Mathematics Education in Korea』 through a Keyword Network Analysis)

  • 문소영;조진석
    • 한국초등수학교육학회지
    • /
    • 제23권4호
    • /
    • pp.459-479
    • /
    • 2019
  • 본 연구에서는 키워드 네트워크를 통해 국내 초등수학교육 분야의 대표적인 학술지인 『한국초등수학교육학회지』에 수록된 논문의 키워드를 대상으로 본 학술지의 연구 동향을 살펴보았다. 자료수집은 창간호부터 2018년까지 총 378편의 논문을 대상으로 하였으며, 논문에 포함된 총 1140개의 키워드들에 대하여 Krkwic 프로그램과 NodeXL 프로그램을 활용하여 빈도 분석 및 키워드 네트워크 분석을 실시하였다. 연구 결과 첫째, 빈도분석 결과 최소 5회 이상 출현하여 나타난 키워드는 48개로 수학과교육과정, 수학교과서, 학교수학, 수학문제해결, 수학영재 등이 있었다. 둘째, 키워드 네트워크 분석 결과에서 중요성이 높게 나타난 키워드는 수학교과서, 학교수학, 수학과교육과정, 수학문제해결, 수학적의사소통 등이 나타났다. 이러한 연구 결과를 바탕으로 본 학술지의 연구의 주요한 연구 주제어를 파악하고 연구 동향을 논의하였으며 연구의 제한점을 바탕으로 제언을 할 수 있었다.

  • PDF

MeSH를 이용한 "암 관련 우울증" 연구 동향 분석 (Research Trends of "Cancer-Related Depression": analysis using MeSH in PubMed)

  • 김미영;이춘실
    • 한국정보관리학회:학술대회논문집
    • /
    • 한국정보관리학회 2012년도 제19회 학술대회 논문집
    • /
    • pp.143-146
    • /
    • 2012
  • 본 연구에서는 MEDLINE에 수록된 논문의 암 관련 우울증 문헌을 대상으로 MeSH(Medical Subject Headings) 키워드를 이용하여 1992년부터 2011년까지 20년간의 연구 동향을 분석하였다. 암과 우울증에 해당하는 MeSH 키워드를 주제로 다룬 논문 3,389편과 50,778개의 키워드를 대상으로 주요 학술지 및 암 발병 위치와 우울증 치료요법을 분석하였다. 암 관련 우울증 논문의 암 발병 위치별 빈도는 유방암이 799편으로 가장 높았으며, 폐암, 전립선암, 뇌종양, 두경부암이 뒤를 이었다. 또한 우울증 치료 요법별 빈도는 비약물치료가 552편으로 약물치료 400편보다 높게 나타났으며 비약물치료는 크게 상담치료와 상담 외 치료에 대한 키워드로 구분되었고, 약물치료는 치료 요법명과 약명으로 다시 구분되었다.

  • PDF

키워드 네트워크 분석을 활용한 국내 공공도서관 연구 동향 분석 (An Analysis of Research Trends on Public Libraries in Korea Using Keyword Network Analysis)

  • 장로사
    • 한국비블리아학회지
    • /
    • 제34권4호
    • /
    • pp.285-302
    • /
    • 2023
  • 본 연구는 키워드 네트워크 분석을 활용하여 국내 공공도서관 분야 연구 동향을 파악하였다. 2003년부터 2022년까지 20년 동안 우리나라 문헌정보학 분야 유수 4대 학술지에 출판된 공공도서관 관련 논문 총 752편을 대상으로 하였다. 연구결과는 다음과 같다. 첫째, 2003년부터 2022년까지 연평균 37.6편이 간행되었으며, 상승과 하락을 반복하는 출판양상을 보였다. 둘째, '서비스'와 '문화' 키워드는 출현 빈도와 연결중심성 및 매개중심성 분석결과 모두에서 상위 5위 이내로 파악됨으로써 가장 논의가 많이 된 핵심 키워드로 확인되었다. 셋째, 키워드 쌍의 동시 출현 빈도 분석결과에서 교육-프로그램 키워드 쌍과 서비스-이용자와 서비스-어린이 및 서비스-장애 키워드 쌍이 주목되었다.

코로나 19 뉴스데이터 분석 및 시각화 (Covid 19 news data analysis)

  • 허태성;황인용
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2021년도 제64차 하계학술대회논문집 29권2호
    • /
    • pp.241-242
    • /
    • 2021
  • 본 논문에서는 2020년 1월부터 2020년 8월까지 8개월간의 유통되었던 코로나 19와 관련된 뉴스 데이터를 이용하여 기간 및 지역별 단어의 빈도수를 구하고, 그 결과를 활용해 코로나 19와의 상관관계를 분석하고, 시각화하였다. 뉴스데이터는 한국언론진흥재단에서 운영하는 뉴스 빅데이터 시스템인 '빅카인즈'에서 수집된 데이터를 이용하였다. 본 논문에서 웹서비스를 활용해 시각화하였으며 지역과 기간을 선택하면 분석한 결과를 불러와 전체 지역대비 선택한 지역의 뉴스 빈도수, 선택한 지역의 주요 키워드, 주요 키워드의 지역별 일자별 변화 등을 보여주고 있다. 이러한 시각화를 통해 이전에 발생되었던 사건에 대해 주요 키워드와 코로나 19의 상관관계를 쉽게 파악을 할 수 있다.

  • PDF

텍스트마이닝을 활용한 러닝 어플리케이션 사용자 리뷰 분석: Nike Run Club과 Runkeeper를 중심으로 (Analysis of User Reviews of Running Applications Using Text Mining: Focusing on Nike Run Club and Runkeeper)

  • 류기문;김일광
    • 산업융합연구
    • /
    • 제22권4호
    • /
    • pp.11-19
    • /
    • 2024
  • 본 연구의 목적은 텍스트마이닝을 활용하여 러닝 어플리케이션 사용자의 리뷰를 분석하였다. 본 연구는 python3의 selenium 패키지를 이용하여 google playstore의 Nike Run Club, Runkeeper의 사용자 리뷰들을 분석자료로 이용하였으며, okt 분석기를 통해 한글 명사만을 남겨 형태소를 분리하였다. 형태소 분리 후 rankNL 사전을 만들어 불용어(stopword)를 제거하였다. 자료 분석을 위해 텍스트마이닝의 TF(빈도분석), TF-IDF(키워드 빈도-문서 역빈도), LDA 토픽모델링을 통해 분석하였다. 본 연구의 결과는 다음과 같다. 첫째, Nike Run Club, Runkeeper 어플리케이션 사용자 리뷰에서 공통적으로 상위 키워드로 '기록', '앱', '운동'의 키워드가 도출되었으며 TF, TF-IDF의 순위에는 차이가 나타났다. 둘째, Nike Run Club의 LDA 토픽모델링으로 '기본 항목', '추가 기능', '오류 사항', '위치기반데이터'의 토픽이 도출되었고 Runkeeper는 '오류 사항', '음성 기능', '러닝 데이터', '사용 혜택', '사용 동기'의 토픽이 도출되었다. 결과를 통해 제언하면 어플리케이션의 경쟁력 향상을 기여하기 위해 오류 및 개선사항을 보완해야 한다.

영미 아동 모험 소설에 관한 코퍼스 분석 연구: 『보물섬』을 중심으로 (A Corpus Analysis of British-American Children's Adventure Novels: Treasure Island)

  • 최은샘;정채관
    • 한국콘텐츠학회논문지
    • /
    • 제21권1호
    • /
    • pp.333-342
    • /
    • 2021
  • 본 연구에서는 대표적인 영미 아동 모험 소설 『보물섬』의 언어적 특징을 파악하기 위해 『보물섬』을 코퍼스화 하여 어휘, 리마, 키워드, n-그램을 분석하였다. 이 연구를 통해 고빈도 어휘가 텍스트의 핵심어라는 일반적인 주장과 달리 『보물섬』의 고빈도 어휘는 『보물섬』과 직접 관련이 없는 기능어, 고유명사 등이 최상위층에 포진하고 있다는 것을 발견하였고, 통계적인 방법으로 추출한 『보물섬』 키워드 역시 『보물섬』의 내용을 가늠하기에 충분하지 않음을 발견하였다. 따라서 1차 정량적인 키워드 분석 후 진행된 2차 정성적인 키워드 분석을 통해 추출한 30개의 핵심 키워드를 통해 『보물섬』 내용을 신속하고 구체적으로 파악하는 단초를 마련하였고, 이를 바탕으로 그동안 직관적으로만 회자 되던 『보물섬』에 나타난 남성성을 계량적으로 분석할 수 있었다. 또한, n-그램 분석을 통해 『보물섬』의 작가가 다른 작가에 비해 선호하고 자주 사용하는 연속어휘구를 발견하였고, 이를 토대로 문학 작품의 계량적 연구가 가능한 코퍼스 문체론 연구의 가능성을 탐색하였다. 본 연구를 통해 밝혀낸 연구결과가 영미 아동문학 콘텐츠의 확산과 코퍼스 문체론 연구에 도움이 되기를 희망한다.

한국농수산대학 신입생 자기소개서의 텍스트 마이닝과 연관규칙 분석 (1) (Text Mining and Association Rules Analysis to a Self-Introduction Letter of Freshman at Korea National College of Agricultural and Fisheries (1))

  • 주진수;이소영;김종숙;신용광;박노복
    • 현장농수산연구지
    • /
    • 제22권1호
    • /
    • pp.113-129
    • /
    • 2020
  • 본 연구는 2020년 한농대 입학생의 비정형 텍스트인 자소서에서 의미 있는 정보 혹은 규칙을 추출하기 위하여 고교 재학 중 '학업 및 학습경험'과 '교내 활동'을 기술한 두 개 문항에 대하여 텍스트 마이닝에 의한 토픽 분석과 연관성 분석을 하였다. 모집 전형을 구분하지 않은 텍스트 마이닝 분석 결과에서 '학업 및 학습 경험' 항목과 관련된 주요 키워드는 '공부', '생각', '노력', '문제', '친구' 등의 순으로 많이 나타났으며, '교내 활동' 항목과 관련된 주요 키워드는 '활동', '생각', '친구', '동아리', '학교' 등의 순으로 빈도가 높게 나타났다. 그러나 도시 인재 전형과 농수산 인재 전형 신입생들의 키워드 빈도 순위는 두 항목 모두 전형 특성에 따른 약간의 차이를 나타냈다. 빈도 분석에 결과는 빈도수 상위 50위까지의 키워드를 워드 클라우드로 시각화하여 키워드를 알기 쉽게 표현하였다. 연관 분석은 apriori() 함수를 사용하였으며 적정한 계산을 위하여 support(지지도)와 confidence(신뢰도)의 기준값을 항목별로 설정하였다. 먼저 '학업' 항목에 대한 연관 규칙은 46개를 추출하였으며, 그 가운데 {공부} => {생각}, {성적} => {공부} 및 {과목} => {공부} 등의 규칙에서 높은 연관성을 볼 수 있었다. 이 규칙을 바탕으로 매개체 역할의 키워드를 평가하는 관계 중심성 평가와 노드에 연결된 edge의 수에 따라 중요도를 파악하는 연결 중심성 평가에서는 '생각', '공부', '노력', '시간' 등의 키워드가 중심적인 역할을 하는 정보를 획득하였다. 다음으로 '교내 활동' 항목에서는 45개의 연관 규칙을 생성하여 {활동} => {생각}, {동아리} => {활동} 등의 규칙에서 높은 연관성을 볼 수 있었으며, 관계 중심성 평가와 연결 중심성 평가에서는 '생각', '활동', '학교', '시간', '친구' 등의 키워드가 중심 키워드라는 결과를 얻었다. 다음 연구에서는 자소서의 나머지 두 개의 문항 '배려·나눔·협력·갈등관리' 항목과 한농대 '지원동기와 향후 진로계획' 항목을 분석한다. 분석에는 '키워드의 빈도'에 '문서 빈도의 역수'를 곱하여 주로 다량의 문서에서 핵심어를 추출하는 TF-IDF(Term Frequency-Inverse Document Frequency) 분석을 추가한다.

비정형 텍스트 데이터 분석을 활용한 기록관리 분야 연구동향 (Research Trends in Record Management Using Unstructured Text Data Analysis)

  • 홍덕용;허준석
    • 한국기록관리학회지
    • /
    • 제23권4호
    • /
    • pp.73-89
    • /
    • 2023
  • 본 연구에서는 텍스트 마이닝 기법을 활용하여 국내 기록관리 연구 분야의 비정형 텍스트 데이터인 국문 초록에서 사용된 키워드 빈도를 분석하여 키워드 간 거리 분석을 통해 국내기록관리 연구 동향을 파악하는 것이 목적이다. 이를 위해 한국학술지인용색인(Korea Citation Index, KCI)의 학술지 기관통계(등재지, 등재후보지)에서 대분류(복합학), 중분류 (문헌정보학)으로 검색된 학술지(28종) 중 등재지 7종 1,157편을 추출하여 77,578개의 키워드를 시각화하였다. Word2vec를 활용한 t-SNE, Scattertext 등의 분석을 수행하였다. 분석 결과, 첫째로 1,157편의 논문에서 얻은 77,578개의 키워드를 빈도 분석한 결과, "기록관리" (889회), "분석"(888회), "아카이브"(742회), "기록물"(562회), "활용"(449회) 등의 키워드가 연구자들에 의해 주요 주제로 다뤄지고 있음을 확인하였다. 둘째로, Word2vec 분석을 통해 키워드 간의 벡터 표현을 생성하고 유사도 거리를 조사한 뒤, t-SNE와 Scattertext를 활용하여 시각화하였다. 시각화 결과에서 기록관리 연구 분야는 두 그룹으로 나누어졌는데 첫 번째 그룹(과거)에는 "아카이빙", "국가기록관리", "표준화", "공문서", "기록관리제도" 등의 키워드가 빈도가 높게 나타났으며, 두 번째 그룹(현재)에는 "공동체", "데이터", "기록정보서비스", "온라인", "디지털 아카이브" 등의 키워드가 주요한 관심을 받고 있는 것으로 나타났다.