• 제목/요약/키워드: 빅데이터 기법

검색결과 796건 처리시간 0.028초

XAI를 활용한 통신사 이탈고객의 특성 이해와 마케팅 적용방안 연구 (Research on Understanding Churned Customer and Application of Marketing in Telco. industry Using XAI)

  • 임진희
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2022년도 춘계학술발표대회
    • /
    • pp.21-24
    • /
    • 2022
  • 최근 통신업계에서는 축적된 빅데이터를 활용하여 고객의 특성을 이해하고 맞춤형 마케팅에 이용하려는 노력이 지속되어 왔다. 본 연구에서는 CatBoost 모델을 사용하여 이탈 가능성이 높은 고객을 예측하고 XAI(eXplainable Artificial Intelligence) 기법 중 하나인 SHAP을 적용하여 이탈에 영향을 미치는 요인을 설명하고자 하였다. SHAP의 global explanation 기법을 사용하여 특정 고객 segmentation 에 대한 이해력을 높이고, local explanation 기법을 사용하여 개별 고객에 대한 설명과 개인화 마케팅에 적용 가능성을 제시하였다. 본 연구는 기존의 이탈 예측모델인 블랙박스 모델이 갖는 한계점을 극복하고 고객의 특성을 이해하여 실제 비즈니스에 활용 가능성을 높였다는 점에서 의의를 가진다.

빅데이터 분석 기반의 제품 평판 마이닝 알고리즘 (An algorithm for mining the reputation of a product based on big data analytics)

  • 박상민;박새빛;온병원
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2016년도 춘계학술발표대회
    • /
    • pp.420-423
    • /
    • 2016
  • 최근 여론조사 분야에서 빅데이터 분석 기법이 널리 활용되고 있다. 기업에서는 최근 출시된 제품에 대한 선호도를 조사하기 위해 기존의 설문조사나 전문가의 의견을 단순 취합하는 것이 아니라, 온라인상에 존재하는 다양한 종류의 데이터를 수집하고 분석하여 제품에 대한 대중의 기호를 정확히 파악할 수 있는 방안이 필요하다. 본 연구에서는 빅데이터로부터 제품의 평판을 자동으로 찾아내는 텍스트 마이닝 방안을 제안하고, 소나타 자동차를 중심으로 제안 방안의 효율성을 평가하고 실험 결과를 자세히 분석한다.

LDA 기법을 이용한 버스 승객의 잠재적 이동패턴 분석 (Latent mobility pattern analysis of bus passengers with LDA)

  • 조아;이경희;조완섭
    • Journal of the Korean Data and Information Science Society
    • /
    • 제26권5호
    • /
    • pp.1061-1069
    • /
    • 2015
  • 최근 교통 분야에서 발생하는 교통 빅데이터 (교통카드 데이터, ATMS 데이터 등)의 분석결과를 교통 정책에 활용하는 사례가 늘어나고 있는 추세이다. 또한 교통 데이터 분석 기법을 기존의 단순 빈도 분석 기법에서 다양한 데이터 마이닝 기법으로 확장하여 교통 데이터 속에 숨어있는 의미를 파악하려는 연구도 진행되고 있다. 본 연구에서는 교통카드 데이터에 대하여 토픽모델링 기법 중의 하나인 LDA (Latent Dirichlet Allocation) 기법을 적용하여 청주시 버스 승객들의 이동패턴을 분석한다. 이를 위해 교통카드 데이터의 하차 결측치를 추정하고, LDA 기법을 적용하여 이동패턴을 추출하였다. 또한 LDA 분석으로 도출된 값을 측정값으로 하여 다차원적 분석을 함으로써 청주시 버스 승객들의 이동패턴 특징을 파악할 수 있다. 분석 결과, 청주시의 경우 크게 1) 시외지역에서 터미널을 이용해 청주시에서 유입되는 패턴, 2) 주거지역에서 상업지역으로 이동하는 패턴, 3) 청주 인근 학교에서 상업 지역 (청주 중심가)로 이동하는 패턴을 발견할 수 있었다. 이동패턴은 도시 계획, 대중교통서비스 향상, 버스 노선 신설 등 다양한 교통정책의 수립에 활용될 수 있을 것으로 기대된다.

이미지 복원을 위한 네트워크 파라미터의 동적 업데이트를 위한 기법

  • 김태현
    • 방송과미디어
    • /
    • 제25권2호
    • /
    • pp.27-35
    • /
    • 2020
  • 최근 많은 연구 결과물에서 빅데이터를 이용하여 학습된 뉴럴 네트워크가 영상 내 노이즈를 제거하는데 매우 효과적임이 입증되었다. 여기에서 한 걸음 더 나아가, 입력으로 주어진 노이즈가 있는 영상의 특징을 분석하여, 사전에 학습된 네트워크의 파라미터를 테스트 타임에 동적으로 업데이트함으로써 주어진 입력 영상을 더욱 잘 처리할 수 있도록 하는 연구들이 시도되고 있다. 본 원고에서는 이와 같이 테스트 타임에 주어지는 입력 영상을 네트워크 학습에 사용하는(self-supervision) 이미지 복원 기법들을 소개한다. 다음으로, 기존의 self-supervision을 이용하는 기법들 대비 학습 효율성과 정확도를 더욱 향상시킬 수 있는 새로운 형태의 네트워크 파라미터 업데이트 기법을 설명하고, 제안하는 기법의 우수성을 다양한 실험 결과를 통해 분석 및 입증한다.

선박 운항 빅데이터를 활용한 운항 효율 향상 방법 연구 (A Study on the Improvement of Sailing Efficiency Using Big Data of Ship Operation)

  • 신정훈;심정연;박진우;최대한;변상수
    • 해양환경안전학회:학술대회논문집
    • /
    • 해양환경안전학회 2017년도 공동학술발표회
    • /
    • pp.244-244
    • /
    • 2017
  • 최근 4차 산업혁명의 주요 변화동인 중 하나인 "빅데이터" 기술을 활용하여 다양한 산업에 적용하기 위한 연구가 활발히 이루어지고 있다. 선박이 운항 하면서 발생되는 데이터에는 1해리 당 소모연료량, 엔진출력, 대지속력, 대수속력, Main Engine RPM, FOC, SFOC, DFOC 등의 여러 지표가 있다. 본 논문에서는 Gathering 데이터간의 민감도를 분석 하여 각 변수들간의 영향력을 판단하여 선박 운항 관련 에너지효율에 대한 주요 변수를 분석 하고, 분석 기법 중 수학 모델을 이용한 근사 모델을 생성 하여, 실측 데이터와 예측결과를 비교분석 하였다. 이를 통해 빅데이터 분석 기술을 활용하여 운항 선박의 에너지효율 관련 변수 간 민감도 확인, 근사모델을 이용한 연비 관련 지표 예측에 활용 할 수 있는 가능성을 확인 하였다.

  • PDF

온라인 빅 데이터 분석 결과와 상수도 통계 비교를 통한 데이터 가치 추출 (Data value extraction through comparison of online big data analysis results and water supply statistics)

  • 홍성진;유도근
    • 한국수자원학회:학술대회논문집
    • /
    • 한국수자원학회 2021년도 학술발표회
    • /
    • pp.431-431
    • /
    • 2021
  • 4차 산업혁명의 도래로 사회기반시설물의 계획 및 운영관리에 있어 데이터 분석을 통한 가치추출에 대한 관심은 매우 높은 상황이다. 데이터의 가용성과 접근성, 정부 지원 등을 평가하는 공공데이터 개방지수에서 한국은 1점 만점에 0.93점을 획득하여 경제협력개발기구 회원국 중 1위(2019년 기준)를 할 정도로 매우 높은 수준(평균 0.60점)이다. 그러나 공식적으로 발표 및 배포되는 사회기반시설물 관련 정보와 심도 있는 연구 분석이 필요한 정보는 접근이 여전히 제한적이라 할 수 있다. 특히 대표적인 사회기반시설물인 상수도시스템은 대부분 국가중요시설로 지정되어 있어 다양한 정보를 획득하고 분석하는데 제약이 존재하며, 관련 국가통계인 상수도통계에서는 누수사고 등과 같은 비정상적 상황에 대한 사고지점, 원인 등과 같은 세부정보는 제공하고 있지 않다. 본 연구에서는 웹크롤링 및 빅데이터 분석기술을 활용하여 과거 일정기간 발생한 지자체의 상수도 누수사고 관련 뉴스를 전수조사하고 도출된 사고건수를 국가 공인 정보인 상수도통계자료와 비교·분석하였다. 독립적인 누수사고 기사를 추출하기 위해서 중복기사의 제거, 누수 관련 키워드 정립, 상수도분야 이외의 관련기사 제거 등의 절차가 필요하며, 이와 같은 기법은 R프로그래밍을 통해 구현되었다. 추가적으로 뉴스기사의 자연어 처리기반 정보추출기법을 통해 누수사고 건수 뿐만 아니라 사고발생일, 위치, 원인, 피해정도, 그리고 대상 관로의 크기 등을 획득하여 상수도 통계에서 제시하고 있는 정보보다 많은 가치를 추출하여 연계할 수 있는 방안을 제시하였다. 제시된 방법론을 국내 A광역시에 적용하여 누수사고 건수를 비교한 결과 상수도통계에서 제시하고 있는 누수발생건수와 유사한 규모의 사고건수를 뉴스기사분석을 통해 도출할 수 있었다. 제안된 방법론은 추가적인 정보의 추출이 가능하다는 점에서 향후 활용성이 높을 것으로 기대된다.

  • PDF

교육 데이터와 분석 기법: 사례 연구를 중심으로 (Education Data and Analytics: A Review of the State of the Art)

  • 권영옥
    • 한국빅데이터학회지
    • /
    • 제4권1호
    • /
    • pp.73-81
    • /
    • 2019
  • 지난 십여 년간 학생의 학습 과정에서 생성되는 방대한 데이터를 다양한 분석기술을 적용하여 학생의 학습 성과 및 교육 환경을 개선하기 위한 관련 연구들이 활발히 진행되어 왔다. 본 논문에서는 교육데이터의 분석 결과를 성공적으로 활용하고 있는 대학의 사례들을 살펴본 후, 기존 사례 연구를 통해서 보다 구체적으로 분석 목적별로 어떤 데이터와 분석 기법이 사용되는지 정리하였다. 그리고 고찰 결과를 토대로 기존 분석의 한계점 및 향후 분석 방향에 대해 제안하고자 한다.

  • PDF

빅 데이터를 이용한 스마트 응용의 설계 (Design of a Smart Application using Big Data)

  • 오선진
    • 한국인터넷방송통신학회논문지
    • /
    • 제15권6호
    • /
    • pp.17-24
    • /
    • 2015
  • 정보 기술과 첨단 무선 네트워크 응용 기술의 급속한 발전과 더불어, 방대하고 다양한 형태의 데이터들이 시시각각 양산되고 있으며, 최근 빅 데이터 분석기술의 중요성과 가치는 점차 증대되고 있다. 과거에는 너무 방대하여 관리조차 힘들어 무용지물이던 빅 데이터는 데이터 수집 컴퓨팅 장비와 분석 도구의 발전을 통해 다양한 활용분야에서 작은 규모의 데이터로는 불가능했던 새로운 영감이나 가치를 추출해 내는 것이 가능하게 되었다. 하지만 현실 세계에서는 아직도 빅 데이터 대부분이 제대로 적절하게 분석되어 사용되지 못하고 사장되는 것이 사실이다. 결국, 빅 데이터에서 통찰력 습득과 새로운 가치 창출을 위한 전제 조건으로 효율적인 빅 데이터 처리를 위한 분석 기술의 확보가 중요하다고 할 수 있다. 본 논문에서는 이러한 빅 데이터를 보다 효율적으로 처리하고 원하는 관심 정보를 효과적으로 추출해 낼 수 있는 정밀한 분석기법과 처리 기술을 연구하고 이를 실제 적용하는 스마트 응용을 설계한다.

공간 빅데이터 기반의 도시재생사업 성과 평가기법 개발 (Development of Performance Evaluation Method for Urban Regeneration Project based on Spatial Big Data)

  • 윤병훈;성순아;이삼수
    • 지역연구
    • /
    • 제39권1호
    • /
    • pp.21-36
    • /
    • 2023
  • 사회·경제적 여건 변화에 따른 저성장시대에 진입하며, 전국 대부분의 도시에서 도시재생을 적극적으로 추진하고 있다. 도시재생은 막대한 국가재정이 투입된 사업임에도 불구하고, 아직 명확한 평가시스템이 마련되지 못하였다. 도시재생사업의 지속가능성을 담보하기 위해 도시재생사업의 성과를 평가하고, 정책을 보완하기 위한 환류체계 구축이 필요하다. 본 연구에서는 도시재생사업의 성과를 평가하기 위한 공간 빅데이터 기반의 도시재생성과 평가기법을 개발하는 것을 목적으로 한다. 도시재생성과 평가기법은 도시재생사업 유형, 대도시·중도소시 여부 등을 기준으로 도시재생사업 영향권을 차등화하였다. 인구·사회, 산업·경제, 물리·환경 측면 평가지표의 도시재생사업 영향권 내부·외부 간의 상대적 비교를 통해, 도시재생사업의 성과를 정량적으로 측정하였다.

빅데이터 분석을 통한 데이터 3법 인식에 관한 연구 (A Study on the Perception of Data 3 Act through Big Data Analysis)

  • 오정주;이환수
    • 융합보안논문지
    • /
    • 제21권2호
    • /
    • pp.19-28
    • /
    • 2021
  • 산업의 디지털 전환을 촉진하고 혁신을 가속화하고자 우리나라는 디지털 뉴딜 정책을 추진하고 있다. 그러나 엄격한 기존의 데이터 관련 법제 하에서는 디지털 뉴딜정책을 위한 산업계의 데이터 활용에 여전히 제약이 있는 상황이다. 이러한 문제를 해결하기 위해서 데이터 3법 개정안이 발의되었으나 실제로 산업계의 데이터 이용 활성화에 어떠한 영향을 미칠지에 대한 논의는 아직 부족한 상황이다. 이에 본 연구에서는 데이터 3법에 대한 여론의 인식을 분석하여 데이터 3법 개정안의 시사점을 분석하고자 한다. 이를 위하여 데이터 3법 개정안과 관련 연구동향을 분석하고, 빅데이터 분석 기법을 이용하여 데이터 3법에 대한 인식을 분석하였다. 분석결과에 따르면 데이터 3법은 개정 취지에 부합하게 데이터 산업 활성화를 촉진하는 반면에 특정산업 분야에 치중될 우려가 있는 것으로 나타났다. 본 연구의 결과는 빅데이터 분석을 통해 시행 초기인 데이터 3법의 산업영향에 대한 온라인 인식을 분석함으로써 향후 개선방안에 대한 시사점을 제공한다는 점에서 의의가 있다.