• 제목/요약/키워드: 빅데이터 기법

Search Result 785, Processing Time 0.025 seconds

빅 데이터를 이용한 소셜 미디어 분석 기법의 활용 (Utilization of Social Media Analysis using Big Data)

  • 이병엽;임종태;유재수
    • 한국콘텐츠학회논문지
    • /
    • 제13권2호
    • /
    • pp.211-219
    • /
    • 2013
  • 빅 데이터를 활용한 분석 방법은 빅 데이터를 처리 할 수 있는 기술 기반으로 발전되어 오고 있다. 많은 IT 리서치 기관들이 빅 데이터를 통한 새로운 분석의 패러다임을 예견하고 있고, 또한 IT 벤더들을 중심으로 빅 데이터 처리를 위한 표준 기술들을 제시하고 있다. 빅 데이터는 IT 기기 및 환경의 발달과도 상호연관적이고 소셜 미디어를 주측으로 기존에 예측하지 못하는 비정형화된 데이터들을 정형화 하여, 이에 따른 다양한 분석, 예측 및 최적화에 초점이 맞추어 발달 하고 있다. 과거의 분석 기법은 정형화된 데이터를 기반으로 데이터 마이닝, OLAP, 통계 분석등을 통한 의사결정 도구로서 사용되어 왔다. 하지만 최근 빅데이터를 이용한 새로운 분석의 패러다임을 통해 분석기법의 다양화, 비정형 데이터 분석 등 새로운 형태의 기반 기술발전과 다양한 형태의 데이터를 통한 새로운 분석을 통해 통찰력을 높일 수 있다. 더욱이 고성능의 컴퓨팅 환경들의 발달과 표준화된 대용량 데이터 처리 기술 발달이 향후 조금 더 다양한 형태의 분석패턴을 만들어 갈 것이다. 따라서 본 논문은 빅 데이터를 통해 분석 가능한 다양한 기법을 알아보고, 기존의 데이터 마이닝 분석 기법을 통한 소셜 미디어의 분석 형태에 대한 활용 및 분석방안을 제시 하였다.

클라우드 컴퓨팅 환경에서 빅데이터 처리를 위한 ART 기반의 적응형 자원관리 방법 (Adaptive Resource Management Method base on ART in Cloud Computing Environment)

  • 조규철;김재권
    • 한국시뮬레이션학회논문지
    • /
    • 제23권4호
    • /
    • pp.111-119
    • /
    • 2014
  • 클라우드 환경은 빅데이터의 이슈와 데이터 분석을 가능하게 하는 기술로서, 이를 위한 자원 관리 기법이 필요하다. 현재까지의 자원관리 기법은 한정된 계산 방법을 이용하여 자원의 편중의 문제점이 있으며, 이를 해결하기 위해서 자원관리는 자원이력 정보를 활용한 학습기반의 스케줄링이 필요하다. 본 논문에서는 ART(Adaptive Resonance Theory)기반의 적응형 자원관리 기법을 제안한다. 제안하는 기법은 클라우드환경에서 모니터링 및 자원이력을 이용하여 작업의 적합한 할당이 가능하다. 제안하는 방법은 무감독 학습방법을 사용하며, 적응형 자원 관리를 통하여 서비스의 안정성과 데이터 처리성능을 향상시키는 것을 목적으로 한다. 제안하는 방법은 체계적인 자원관리가 가능하고 가용자원을 효율적으로 활용하여 요구 성능을 향상시킬 수 있다는 장점이 있다.

카운팅 블룸필터를 이용한 SSD 기반의 디렉토리 탐색 기법 (An SSD-Based Directory Parsing with the Counting Bloom Filter)

  • 김만윤;윤희용
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2014년도 제50차 하계학술대회논문집 22권2호
    • /
    • pp.347-349
    • /
    • 2014
  • 데이터의 폭발적인 증가로 우리는 빅데이터 시대를 맞이하게 되었다. 빅데이터의 파일 시스템 내에는 아주 큰 트리구조로 이루어진 디렉토리와 파일이 무수히 존재한다. 이 커다란 트리구조에서 사용자가 요청하는 디렉토리와 파일을 탐색하는 것은 매우 어려운 작업이다. 이에 우리는 카운팅 블룸필터를 이용한 디렉토리 탐색 기법을 제시한다. SDP(SSD-based Directory Parsing)는 최근 또는 자주 액세스한 디렉토리와 파일의 메타데이터를 보관하는 SSD 기반의 캐시이다. 대규모 파일 시스템에서 사용자가 파일을 요청했을 때 파일 시스템은 저장 장치에 메타데이터를 검색하기 위해 여러 번 액세스한다. 이러한 비효율적인 SSD에 대한 액세스를 방지하기 위해 카운팅 블룸필터를 이용하여 메타데이터를 빠르고 효율적으로 검색하는 기법을 제시한다.

  • PDF

하둡 분산 환경 기반의 데이터 수집 기법 연구 (A Study on the Data Collection Methods based Hadoop Distributed Environment)

  • 진고환
    • 한국융합학회논문지
    • /
    • 제7권5호
    • /
    • pp.1-6
    • /
    • 2016
  • 최근 빅데이터 활용과 분석기술의 발전을 위하여 많은 연구가 이루어지고 있고, 빅데이터를 분석하기 위하여 처리 플랫폼인 하둡을 도입하는 정부기관 및 기업이 점차 늘어가고 있는 추세이다. 이러한 빅데이터의 처리와 분석에 대한 관심이 고조되면서 그와 병행하여 데이터의 수집 기술이 주요한 이슈가 되고 있으나, 데이터 분석 기법의 연구에 비하여 수집 기술에 대한 연구는 미미한 상황이다. 이에 본 논문에서는 빅데이터 분석 플랫폼인 하둡을 클러스터로 구축하고 아파치 스쿱을 통하여 관계형 데이터베이스로부터 정형화된 데이터를 수집하고, 아파치 플룸을 통하여 센서 및 웹 애플리케이션의 데이터 파일, 로그 파일과 같은 비정형 데이터를 스트림 기반으로 수집하는 시스템을 제안한다. 이러한 융합을 통한 데이터 수집으로 빅데이터 분석의 기초적인 자료로 활용할 수 있을 것이다.

대용량 네트워크 압축 기반 클러스터링 알고리즘 개발 (Development of Clustering Algorithm based on Massive Network Compression)

  • 서동민;유석종;이민호
    • 한국콘텐츠학회:학술대회논문집
    • /
    • 한국콘텐츠학회 2016년도 춘계 종합학술대회 논문집
    • /
    • pp.53-54
    • /
    • 2016
  • 빅데이터란 대용량 데이터 활용 및 분석을 통해 가치 있는 정보를 추출하고, 이를 바탕으로 대응 방안 도출 또는 변화를 예측하는 기술을 의미한다. 그리고 빅데이터 분석에 활용되는 데이터인 페이스북과 같은 소셜 데이터, 유전자 발현과 같은 바이오 데이터, 항공망과 같은 지리정보 데이터들은 대용량 네트워크로 구성되어 있다. 네트워크 클러스터링은 서로 유사한 특성을 갖는 네트워크 내의 데이터들을 동일한 클러스터로 묶는 기법으로 네트워크 데이터를 분석하고 그 특성을 파악하는데 폭넓게 사용된다. 최근 빅데이터가 다양한 분야에서 활용되면서 방대한 양의 네트워크 데이터가 생성되고 있고, 이에 따라서 대용량 네트워크 데이터를 효율적으로 처리하는 클러스터링 기법의 중요성이 증가하고 있다. MCL(Markov Clustering) 알고리즘은 플로우 기반 무감독(unsupervised) 클러스터링 알고리즘으로 확장성이 우수해 다양한 분야에서 활용되고 있다. 하지만, MCL은 대용량 네트워크에 대해서는 많은 클러스터링 연산을 요구하며 너무 많은 클러스터를 생성하는 문제를 갖는다. 본 논문에서는 네트워크 압축을 기반으로 한 클러스터링 알고리즘을 제안함으로써 MCL보다 클러스터링 속도와 정확도를 향상시켰다. 또한, 희소행렬을 효율적으로 저장하는 CSC(Compressed Sparse Column) 자료구조와 MapReduce 기법을 제안한 클러스터링 알고리즘에 적용함으로써 대용량 네트워크에 대한 클러스터링 속도를 향상시켰다.

  • PDF

빅데이터 분석 방법을 이용한 중학교 정보 교과서 핵심 개념 분석 (Analysis of the Core Concepts of Middle School Informatics Textbook Using Big Data Analysis Techniques)

  • 윤대웅;최현종
    • 창의정보문화연구
    • /
    • 제5권2호
    • /
    • pp.157-164
    • /
    • 2019
  • 빅데이터는 최근 우리 사회에 다양한 분야에서 활용하고 발전하고 있는 분야이다. 정치, 경제, 사회의 각 분야에서 많은 자료를 분석하여 자료에 숨어 있는 다양한 의미를 파악하는 빅데이터 분석 기법이 자주 활용되고 있다. 하지만 교육이라는 부분에 있어서 빅데이터는 단순한 분석 등에 활용하기는 하지만 교육과정과 방향에 대한 분석은 아직 미비한 실정이다. 이에 본 연구에서는 빅데이터 분석 기법을 활용하여 중학교 정보 교과서의 핵심 개념을 파악하여 분석하고자 한다. 정보 교과서 분석을 위한 빅데이터 분석법은 텍스트 마이닝을 사용하였다. 이 프로그램을 활용하여 파악된 중학교 정보 교과서의 핵심 개념들을 통해 교과서에서 강조하고자 하는 개념을 확인할 수 있었고, 교육 분야에서도 빅데이터 활용 가능성을 확인할 수 있었다.

빅데이터 분석을 위한 어텐션 기반의 단어 연관관계 분석 시스템 (Attention-based word correlation analysis system for big data analysis)

  • 황치곤;윤창표;이수욱
    • 한국정보통신학회논문지
    • /
    • 제27권1호
    • /
    • pp.41-46
    • /
    • 2023
  • 최근, 빅데이터 분석은 기계학습의 발전에 따른 다양한 기법들을 이용할 수 있다. 현실에서 수집된 빅데이터는 단어 간의 관계성에 대한 의미적 분석을 바탕으로 같거나 유사한 용어에 대한 자동화된 정제기법이 부족하다. 빅데이터는 일반적인 문장으로 기술되어 있다. 이러한 문제를 해결하기 위해 문장의 형태소 분석과 의미를 이해해야 할 필요가 있다. 이에 자연어를 분석하기 위한 기법인 NLP는 단어의 관계성과 문장을 이해할 수 있다. 본 논문에서는 빅데이터에서 추출된 문장에서 단어를 추출하여 단어 간의 연관 관계를 생성하는 방법을 연구한다. 이에 트랜스포머 기술을 이용한다.

빅 데이터를 활용한 영상/영화콘텐츠 제작의 변화 (Changes in Production of Video / Movie Contents using Big Data)

  • 강창훈;김진호
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2018년도 제58차 하계학술대회논문집 26권2호
    • /
    • pp.399-400
    • /
    • 2018
  • 해마다 방대한 양의 콘텐츠가 쏟아져 나오는 현재의 콘텐츠 시장은 '즐길 거리'가 차고 넘치는, 수요보다 공급이 많은 시장이다. 이러한 환경에서 소비자가 자신의 취향에 맞는 콘텐츠를 쉽고 빠르게 찾을 수 있게 하는 맞춤형 콘텐츠 제공의 측면에서 빅데이터의 효율적인 활용은 중요하다. 더 나아가 콘텐츠의 소비 단계 뿐만 아니라 기획 및 제작 단계에서도 빅데이터는 소비자가 흥미를 느낄만한 콘텐츠를 미리 예측하며, 성공 가능성 높은 콘텐츠를 기획 및 제작할 수 있게 하는데 기인하는 중요한 핵심 요소이다. 이미 게임, 영상, 음악 등의 분야에서는 개인의 기호와 취향에 맞춤화된 콘텐츠를 제공하거나 소비자에게 더 인기를 얻을 수 있는 콘텐츠 기획 및 개발에 빅데이터를 활용하고 있으며, 앞으로는 더욱 다양한 장르에서 빅데이터 활용 사례가 증가할 전망이다.

  • PDF

해운항만기업의 빅데이터 사용의도에 영향을 미치는 요인에 관한 연구 (A Study on Factors Influencing Intention to Use Big Data in Shipping and Port Company)

  • 이준필;장명희
    • 한국항해항만학회:학술대회논문집
    • /
    • 한국항해항만학회 2017년도 추계학술대회
    • /
    • pp.136-137
    • /
    • 2017
  • 4차 산업혁명시대가 도래함에 따라 해운항만기업에서 4차 산업혁명을 주도하는 ICT를 활용하기 위한 노력이 다양하게 전개되고 있다. 특히 해운항만물류분야에서는 IoT센서가 만들어내는 다양한 데이터를 분석하여 도출된 인사이트를 기반으로 업무효율성을 높이고자 빅데이터분석 기법을 적용하기 시작하고 있다. 본 연구에서는 해운항만기업들 중 빅데이터분석을 도입해서 활용하고 있거나, 빅데이터를 업무에 활용하기 위해 도입의도를 가지고 있는 기업의 종사자들을 대상으로 어떤 요인들이 빅데이터 사용의도를 높여주는 지에 대하여 실증분석.

  • PDF

수산과학 빅데이터 플랫폼 구축과 메타 데이터 관리방안 (Fishery R&D Big Data Platform and Metadata Management Strategy)

  • 김재성;최영진;한명수;황재동;조완섭
    • 한국빅데이터학회지
    • /
    • 제4권2호
    • /
    • pp.93-103
    • /
    • 2019
  • 본 논문에서는 수산과학 R&D 정보의 빅데이터 플랫폼 구축과 메타 데이터 관리기법에 관해 소개한다. 빅데이터 플랫폼에서는 다양한 유형의 수산과학 R&D 정보를 수집하여 통합 연계하고, 이를 데이터 레이크 형태로 구축하는 방안을 제시한다. 수산과학 분야에서 수집, 축적되고 있는 기존의 데이터와 함께 위성영상 데이터, 연구보고서 등 비정형 빅데이터까지 수집하여 다양한 분석을 지원하는 빅데이터 플랫폼의 구축방안을 제시한다. 다음으로 데이터 추출과 전처리 및 저장 과정에서 메타 데이터를 수집하고 관리함으로써 수산과학 빅데이터의 체계적인 관리가 가능하도록 한다. 빅데이터 플랫폼 구축과 함께 메타 데이터를 표준양식으로 구축함으로써 데이터의 수집, 저장, 활용 및 유통 등 데이터 수명주기 전반에 걸쳐 체계적이고도 지속적인 빅데이터 관리 방안을 제시하는데 의의가 있다.

  • PDF