• 제목/요약/키워드: 동시출현단어 분석

검색결과 116건 처리시간 0.022초

동시출현 단어분석 기반 스팸 문자 탐지 기법 (Coward Analysis based Spam SMS Detection Scheme)

  • 오하영
    • 정보보호학회논문지
    • /
    • 제26권3호
    • /
    • pp.693-700
    • /
    • 2016
  • 스팸 데이터 셋은 통상적으로 공개적으로 구하기 어렵고 기존 연구들은 대부분 스팸 이메일에 초점이 맞춰져 왔기 때문에 스팸 문자 메시지 자체 특성을 분석하는데 한계가 있었다. 스팸 이메일 특성 분석 활용 및 데이터 마이닝 기법 등의 활용을 통한 기존 연구들이 있었지만, 영향력이 높은 단일 단어를 활용한 스팸 문자 탐지 기법에 한정되어 있다는 한계점이 있다. 본 논문에서는 싱가폴 대학교에서 공개적으로 공개한 스팸 문자메시지를 다 각도에서 실험 및 분석하여 스팸 문자의 특성을 밝히고 동시출현 단어분석 기반의 스팸 문자 탐지 기법을 제안한다. 성능평가 결과, 제안하는 기법의 거짓 양성과 거짓 음성이 2%미만임을 보였다.

동시출현 핵심단어 분석을 활용한 폭발사고 연구 동향 분석 (Analysis of Research Trends of Explosion Accidents Using Co-Occurrence Keyword Analysis)

  • 이영우;김민주;이지원;안우성;권상기
    • 화약ㆍ발파
    • /
    • 제42권2호
    • /
    • pp.12-28
    • /
    • 2024
  • 급속한 에너지 확산을 수반하는 폭발 현상은 인명 및 경제적인 피해를 미치고 있다. 산업의 고도화로 인하여 다양하고 광범위한 폭발사고가 전 세계적으로 발생하고 있으며, 이러한 폭발사고의 예방을 위해서는 정확한 원인 분석이 밑바탕이 되어야 한다. 국내외 폭발사고 관련 연구 분석은 일부 사건들에 대해서 제한적인 범위에서 수행되고 있었다. 본 논문에서는 국제학술지에 게재된 전체 논문들을 대상으로 동시출현 핵심단어 분석을 실시하여 시기별 전체적인 연구 경향과 향후 연구자들이 관심을 가질 수 있는 최신 분야를 도출하고자 하였다. 시기별 핵심단어 분석 결과, 2005년~2014년에는 대체로 논문의 수가 적고 전체적인 핵심단어의 수도 적었지만, 2015년 이후 컴퓨터 시뮬레이션과 인공지능분야가 폭발사고사례 분석에 활용되었으며, 폭발사고의 종류 또한 현재 최신 연구분야인 리튬이온 배터리, 혼합가스 등의 다양한 연구가 활발하게 진행되고 있음을 알 수 있었다.

동시출현단어분석을 이용한 연관영화정보 분석 연구 (An Analysis of Related Movie Information Using The Co-Word Method)

  • 최상희
    • 정보관리학회지
    • /
    • 제31권4호
    • /
    • pp.161-178
    • /
    • 2014
  • 최근 이용자들이 정보를 공동생산하고 소비하는 웹기반 서비스들이 활발해지면서 이용자가 정보를 이용한 기록이나 이용자가 습득한 정보를 활용하여 생산한 다양한 부가 정보들이 다시 이용자에게 제공되고 있다. 또한 쌍방향으로 이용자들이 소통할 수 있는 정보채널이 다양해짐으로써 공통된 관심사를 가진 이용자의 정보소비 경험을 공유할 수 있는 방법이 활발하게 모색되고 있다. 이 연구에서는 동시출현정보 분석기법과 자아중심 네트워크 분석 기법을 적용하여 IMDB 서비스의 기존 이용자들이 자신이 보고 싶거나 좋아하는 영화를 선별하여 만들어 놓은 영화리스트에 나타난 정보를 토대로 특정 영화를 좋아하는 이용자가 선호할 만한 다른 영화를 찾아낼 수 있도록 연관영화정보를 다각적으로 표현하였다. 한 영화를 기준으로 연관 영화, 감독, 장르로 분석을 한 결과 영화의 테마나 주인공성향과 같은 다양한 자질로도 연관영화가 연결되었고 감독의 경우 영화내용보다는 감독의 인지도에 영향을 받는 것으로 나타났다. 또한 영화는 주제의 복합성이 큰 것으로 나타나 장르가 연관영화정보를 제공하기에 적합하지 않은 것으로 분석되었다.

동시출현단어 분석을 활용한 비탈면 붕괴 예측 및 분석 연구에 관한 지적구조 분석 (Domain Analysis of Research on Prediction and Analysis of Slope Failure by Co-Word Analysis)

  • 김선겸;김승현
    • 지질공학
    • /
    • 제31권3호
    • /
    • pp.307-319
    • /
    • 2021
  • 최근 드론 및 빅데이터, 인공지능 등 디지털 기술을 활용한 비탈면 연구를 수행하고 있으나 다소 미흡한 실정이며, 여전히 비탈면 붕괴 대비에 취약하다. 이러한 이유로 비탈면 붕괴에 효과적으로 대처하기 위해 디지털 기술을 활용한 비탈면 붕괴 예측 및 분석 연구에 대한 발전방향을 제시하는 것이 필연적이며, 이를 위해 비탈면 붕괴 예측 및 분석에 관한 이해가 선제되어야 한다. 본 연구는 비탈면 붕괴 예측 및 분석 연구의 지적구조를 규명하여 연구방향을 제시하기 위해 2016년 1월 1일부터 2020년 12월 31일까지의 5년간의 Web of Science 기반으로 문헌 데이터를 수집하고 이를 동시출현단어를 활용하여 분석하였다. 네트워크 분석을 통하여 세부 주제 영역을 밝히고, 키워드 간의 지적 관계를 시각화하여 관계, 중심성 분석을 통한 전역 및 지역 중심성이 높은 키워드를 도출하였다. 또한 군집분석을 실시하여 형성된 군집을 다차원축적지도에 표시하였으며, 각 키워드들 간의 상관관계에 따른 지적구조를 제시하였다. 이러한 연구의 결과는 비탈면 붕괴 분석 및 예측 연구의 지적구조를 밝히고, 향후 연구 방향을 찾는데 도움이 될 것으로 기대한다.

동시출현단어 분석을 활용한 오픈액세스 분야의 지적구조 분석: 2013년부터 2018년까지 출판된 문헌정보학 저널을 기반으로 (Domain Analysis on the Field of Open Access by Co-Word Analysis: Based on Published Journals of Library and Information Science during 2013 to 2018)

  • 김선겸;김완종;서태설;최현진
    • 한국도서관정보학회지
    • /
    • 제50권1호
    • /
    • pp.333-356
    • /
    • 2019
  • 기존 상업 출판사 중심의 학술 커뮤니케이션 체제가 가져온 위기를 해소할 수 있는 대안으로 오픈액세스가 등장하였다. 본 연구는 계량정보분석 기법 가운데 하나인 동시출현단어 분석을 활용하여 오픈액세스 분야의 최신 연구 경향을 반영하는 지적구조를 제시하고 주제영역이 어떻게 구성되었는지 확인하는 것을 주된 목적으로 두며, 기존에 수행되었던 오픈액세스 지적구조 분석 연구와 비교분석하였다. 이를 위해 Web of Science로부터 오픈액세스 관련 키워드 검색을 통하여 2013년 1월 1일부터 2018년 11월 31일까지 출판된 문헌정보학 분야 논문 총 761편을 수집하였으며, 이들 논문 가운데 제목과 초록으로부터 명사구 형태의 키워드 총 2,321개를 추출하였다. 오픈액세스 지적구조 분석을 위해 네트워크 분석을 통하여 13개의 세부 주제영역이 추출되었으며, 지적관계를 시각화하여 전역 및 지역 중심성이 높은 키워드를 도출하였다. 또한 군집분석을 실시하고 이 결과를 다차원축적지도에 표시하여 키워드들과의 상관관계를 분석하였다. 이를 통해 앞으로 오픈액세스 영역에서의 연구 방향성 모색에 도움이 될 것으로 기대한다.

키워드 출현 빈도 분석과 CONCOR 기법을 이용한 ICT 교육 동향 분석 (Analysis of ICT Education Trends using Keyword Occurrence Frequency Analysis and CONCOR Technique)

  • 이영석
    • 산업융합연구
    • /
    • 제21권1호
    • /
    • pp.187-192
    • /
    • 2023
  • 본 연구는 기계학습의 키워드 출현 빈도 분석과 CONCOR(CONvergence of iteration CORrealtion) 기법을 통한 ICT 교육에 대한 흐름을 탐색한다. 2018년부터 현재까지의 등재지 이상의 논문을 'ICT 교육'의 키워드로 구글 스칼라에서 304개 검색하였고, 체계적 문헌 리뷰 절차에 따라 ICT 교육과 관련이 높은 60편의 논문을 선정하면서, 논문의 제목과 요약을 중심으로 키워드를 추출하였다. 단어 빈도 및 지표 데이터는 자연어 처리의 TF-IDF를 통한 빈도 분석, 동시 출현 빈도의 단어를 분석하여 출현 빈도가 높은 49개의 중심어를 추출하였다. 관계의 정도는 단어 간의 연결 구조와 연결 정도 중심성을 분석하여 검증하였고, CONCOR 분석을 통해 유사성을 가진 단어들로 구성된 군집을 도출하였다. 분석 결과 첫째, '교육', '연구', '결과', '활용', '분석'이 주요 키워드로 분석되었다. 둘째, 교육을 키워드로 N-GRAM 네트워크 그래프를 진행한 결과 '교육과정', '활용'이 가장 높은 단어의 관계로 나타났다. 셋째, 교육을 키워드로 군집분석을 한 결과, '교육과정', '프로그래밍', '학생', '향상', '정보'의 5개 군이 형성되었다. 이러한 연구 결과를 바탕으로 ICT 교육 동향의 분석 및 트렌드 파악을 토대로 ICT 교육에 필요한 실질적인 연구를 수행할 수 있을 것이다.

국내 인지행동치료 연구의 지식구조: 동시출현단어 분석 (Knowledge Structure of Cognitive Behavioral Therapy Studies in Korea: Co-word Analysis)

  • 김도희;김현진;안다혜
    • 디지털융복합연구
    • /
    • 제17권12호
    • /
    • pp.509-521
    • /
    • 2019
  • 본 연구는 인지행동치료(Cognitve Behavioral Therapy: CBT)분야 학술지에서 나타난 키워드의 출현패턴을 조사하여 국내 CBT 연구의 지식구조를 규명하는 데에 목적이 있다. 국내·외에서 수행된 CBT 연구를 비교하고자 '인지행동치료'에서 출판된 논문 234편(2008-2019)과 'Cognitive Therapy and Research'에서 출판된 논문 2,316편(1977-2019)이 수집되었다. 자료는 NetMiner 4.3 프로그램으로 분석되었으며 동시출현단어 분석은 코사인 유사도 행렬을 산출하고, 네트워크를 시각화하는 절차로 수행되었다. 본 연구의 결과로 국내 CBT연구자들의 주요 관심사가 식별되었고, 국내 CBT 지식구조는 9개의 연구영역으로 범주화되었다: '척도 타당화', '완벽주의와 속박감', '조현병 환자의 인지, 정서, 관계적 특성', '경계선 성격장애와 우울/양극성 장애 환자의 인지적 특성과 치료', '적응과 심리적 건강', '사회불안장애 환자의 인지적 특성과 치료', '우울의 원인과 공존이환', '수용전념치료', '폭식 장애 환자의 이해와 치료'. 본 연구는 지난 11년 동안 국내 CBT 분야에서 축적된 지식을 점검하였다는 데에 의의가 있으며 국내 CBT 연구의 향후 발전과제로 임상적 실천 표준을 제고하기 위한 연구가 필요하다고 제안한다.

텍스트마이닝과 동시출현단어 분석을 이용한 국내 조류학 연구동향: 한국조류학회지 논문을 대상으로 (Avian research trends in Korea analyzed by text-mining and co-word analysis: based on articles of the Korean Journal of Ornithology)

  • 진채령;어수형
    • 한국조류학회지
    • /
    • 제25권2호
    • /
    • pp.126-132
    • /
    • 2018
  • 국내 조류학 연구의 발전을 위해서는 지금까지 어떤 분야에서 연구를 해 왔는지 살펴보는 것이 중요하다. 우리는 텍스트마이닝과 동시출현단어 분석을 이용하여 어떤 분류군에서 어떤 주제로 조류학 연구가 진행되어 왔는지를 정량적으로 연구하였다. 한국조류학회지 논문 372편을 분석 대상으로 연구한 결과, 개체군 및 군집 모니터링, 미기록종 보고 및 번식생태, 조류 체내 중금속 오염 등의 주제와 관련한 단어가 연구 논문에서 많이 사용되었다. 또한, 청둥오리, 민물도요, 흰뺨검둥오리 등 특정 조류에 연구가 편중되었다는 것도 본 연구를 통해 알 수 있었다. 국내 조류학의 균형있는 발전을 위하여 지금까지 상대적으로 부족했던 연구 주제와 분류군이 어떤 것인지 파악하였다는 점에서 본 연구는 의미가 있을 것이다.

지구적 환경문제 해결을 위한 학술활동과 환경운동 경향 연구 (An Informetric Study on Academic Activities and Environmental Movements in Solving Global Environmental Problems)

  • 박재신;정영미
    • 정보관리학회지
    • /
    • 제27권3호
    • /
    • pp.83-102
    • /
    • 2010
  • 본 연구에서는 지구적 환경문제의 해결 방식으로서 환경과학 분야의 학술활동과 같은 학문적 접근 방식과 환경 NGO 중심의 환경운동과 같은 실천적 접근 방식을 두 가지 주요 흐름이라 보고, 이들 각각의 특성을 계량정보학적 분석을 통해 파악하고 비교하였다. 지난 10년 간 환경과학 분야에서 인용된 저널의 주제범주 간 동시인용 관계를 분석함으로써 이 분야의 지식 구조를 파악하였고, 환경 NGO의 웹 사이트에서 수집된 외부링크 데이터를 이용하여 이들의 관심 분야를 확인하였다. 또한 저널 논문과 NGO 뉴스에서 추출된 핵심어를 이용한 동시출현단어 분석을 통해 하위 주제를 파악하여 이들 간의 주제적 유사성과 상이성을 구체화하였다.

동시출현단어 분석을 활용한 한국어교육에서의 학습전략 연구 동향 탐색 (Exploring the Research Trends of Learning Strategies in Korean Language Education Using Co-word Analysis)

  • 허영수;박지홍
    • 정보관리학회지
    • /
    • 제38권2호
    • /
    • pp.65-86
    • /
    • 2021
  • 외국어 교육 분야에서 학습자는 교육의 한 축을 이루는 중요한 부분이지만 한국어교육의 경우 교육 내용, 교수 방법, 교재 등에 비해 학습자 연구는 미진한 면이 있었다. 이에 학습자 연구, 그중에서도 학습전략 연구가 어떻게 이루어져 왔는지를 분석하고 더 나은 교육을 위해 연구가 필요한 부분을 도출해 보는 것은 의미가 있다. 본 연구에서는 한국어교육 분야에서 학습전략 연구의 현황을 분석하기 위해 학술지와 학위논문의 제목에 대해 동시출현단어 분석을 진행하였다. 연구 결과, 한국어 학습자의 학습전략 관련 가장 많은 연구가 이루어진 분야는 '읽기'이고, 대상은 '중국인 유학생'과 '결혼이민자'였다. 또한, 연구 주제에 대한 서브그룹 분석 결과를 보면 주요 서브그룹이 네 개가 나타나는데 '학문 목적 읽기' 관련 그룹, '요청, 거절, 대화 등 화행' 관련 그룹, '쓰기' 관련 그룹, '어휘, 듣기' 관련 그룹이다. 이를 통해 한국어 학습자의 학습전략과 관련해 연구자들의 주요 관심 분야가 '읽기, 화행' 등임을 알 수 있으며, 연구 대상과 연구 분야가 부분적으로 편중되어 있는 상황이므로 다양한 분야와 대상으로 연구를 확대할 필요가 있음을 알 수 있다.