• 제목/요약/키워드: 커널밀도분석

검색결과 41건 처리시간 0.021초

중력 모델을 이용한 시공간 데이터의 시각화 (Spatiotemporal Data Visualization using Gravity Model)

  • 김석연;연한별;장윤
    • 정보과학회 논문지
    • /
    • 제43권2호
    • /
    • pp.135-142
    • /
    • 2016
  • 시공간 데이터는 위도와 경도를 비롯한 위치정보를 포함한 데이터를 일컫는 말로 지리학적 시각화의 연구로 시공간 데이터를 분석하고 표현하는 방법에 대한 다양한 연구가 진행되었다. 이 기술은 특정 공간에 시간을 두고 연속적 또는 이산적으로 발생하는 데이터로부터 패턴을 찾고 이를 분석하는 데 목표가 있다. 하지만, 이동 경로에 대한 정보가 없는 이산적인 시공간 데이터에서 데이터의 흐름을 시각화하는 것은 쉽지만은 않은 일이다. 본 논문에서는 커널밀도추정과 중력모델을 이용하여 이산적인 시공간 데이터로부터 벡터를 추출하고 이를 이용하여 사용자로 하여금 시공간 데이터에서 움직임과 경향을 분석할 수 있도록 시각화 하는 것에 목표를 두었다. 이를 뒷받침하기 위하여 트위터 데이터를 이용하여 이산적인 시공간 데이터를 시각화하고 분석하고자 한다.

레이더 주파수 분포 기반 커널 밀도 신호 그룹화 기법 (A Kernel Density Signal Grouping Based on Radar Frequency Distribution)

  • 이동원;한진우;이원돈
    • 대한전자공학회논문지SP
    • /
    • 제48권6호
    • /
    • pp.124-132
    • /
    • 2011
  • 현대 전자전에서 레이더 신호 환경은 매우 복잡하고 고밀도화 되어 가고 있다. 이러한 신호로부터 원래의 방사체로 각각 분리하여 분석하고 식별하기 위한 전자전지원을 위해서는 신뢰성있는 신호분석 기법이 요구된다. 본 논문에서는 전자전지원의 신호분석 단계에서 신뢰성을 보장하며 신호처리 비용을 줄일 수 있는 새로운 레이더 신호 그룹화 알고리즘을 제안하였다. 제안된 기법은 주파수 변조 특성에 대한 통계적 분포 특성을 활용하여 수신 신호로부터 커널 밀도 추정 방식을 이용하여 신호 그룹화한다. 제안된 기법에 대해 실험 결과를 통해 우수한 성능을 보유함을 확인하였다.

움직임 인식응용을 위한 커널 밀도 추정 기반 학습용 데이터 증폭 기법 (Data Augmentation using a Kernel Density Estimation for Motion Recognition Applications)

  • 정우순;이형규
    • 한국산업정보학회논문지
    • /
    • 제27권4호
    • /
    • pp.19-27
    • /
    • 2022
  • 머신러닝(ML, Machine Learning)기반 응용에서의 인식성능은 적용된 모델의 종류와 크기, 학습환경 및 학습에 사용되는 데이터 등 다양한 요인에 따라 결정된다. 특히 학습에 사용되는 데이터가 충분치 않을 경우 인식성능이 저하되거나 과적합(Overfitting)등의 문제가 발생하기도 한다. 이미지 인식을 주요 대상으로 하는 기존 연구들은 학습을 위한 데이터셋이 풍부하고 검증된 데이터셋을 사용하여 학습 및 인식성능을 평가할 수 있다. 하지만 사용된 센서, 인식의 대상, 인식 상황이 다른 특정 응용들의 경우 데이터셋을 직접 구축해야 한다. 이런 경우, ML모델의 성능은 데이터의 양과 품질에 따라 달라진다. 본 논문에서는 이용 가능한 학습용 데이터가 충분치 않은 움직임 인식응용에 효율적으로 사용될 수 있는 비모수 추정 방식의 일종인 커널 밀도 추정 알고리즘을 사용하여 학습용 데이터를 증폭한 후, 사용된 커널의 종류에 따라, 원본 데이터의 수 및 증폭 비율에 따라 증폭된 데이터가 원본 데이터의 특징을 잘 반영하는지 인식 정확도 변화를 토대로 비교 분석한다. 실험결과, 본 연구에서 사용한 움직임 인식응용에서는 좁은 대역폭을 가진 Tophat 커널로 증폭된 데이터셋에서 최대 14.31%의 인식 정확도 향상을 확인하였다.

GIS 기반의 상권분석 모형 연구 - Huff 확률모형을 중심으로 - (A Study on the Trade Area Analysis Model based on GIS - A Case of Huff probability model -)

  • 손영기;안상현;신영철
    • 한국지리정보학회지
    • /
    • 제10권2호
    • /
    • pp.164-171
    • /
    • 2007
  • 본 연구는 GIS공간분석기법과 Huff의 확률모형을 이용하여 근린생활권중심의 상권분석을 수행하였다. 연구에 사용된 기본도는 청주시 복대동을 대상으로 하여 업종, 세대수 등을 현장 조사하여 구축하였으며, 기 구축된 LMIS에 있는 연속지적도를 활용하였다. 분석에서는 커널밀도함수(Kernel Density Function)와 최근린지수(Nearest Neighbor Index)를 활용하여 근린생활권내 점포분포 중심권역을 설정하였다. 상권분석을 수행하기 위하여 설정된 중심권역에 따라 중심지(점)와 규모를 산출한 후 상권분석의 모형인 Huff 확률모형에 적용하여 중심권역별 상권을 추출하였으며, 추출된 상권을 지도로 도식하였다. 따라서 본 연구에서는 GIS 공간분석기법 중 커널밀도함수와 최근린지수를 통해 Huff 확률모형에 적용할 수 있는 방법을 제시하였다. 이러한 방법들을 이용함으로써 보다 정확하게 상권분석을 할 수 있으며, 향후 창업하고자 하는 소상공인들에 도움이 될 수 있으리라 사료된다.

  • PDF

대기오염도의 공간적 분포 변화 분석 -수도권 지역을 대상으로- (Spatial Distributions of the Ambient Levels of Air Pollutants in Seoul Metropolitan Area)

  • 권오상;안동환;김원희
    • 자원ㆍ환경경제연구
    • /
    • 제13권1호
    • /
    • pp.83-117
    • /
    • 2004
  • 본 연구는 수도권지역 대기오염 측정망의 오염물질별 연평균 오염도 측정치를 이용하여 최근 10년간의 수도권내 대기오염도의 공간적 분포 및 그 변화를 분석하였다. 분석을 위해 커널확률밀도함수를 추정하고, 또한 지니계수와 엔트로피계열의 불평등지수를 계측하였으며, 분석기간중 오염도의 공간적 분포 변화에 대한 통계적 검정을 실시하였다. 분석결과 최근 10년간 수도권 지역의 $SO_2$, $NO_2$, $O_3$와 CO 등 대기오염물질 오염도의 지역격차는 대체로 일정한 수준을 유지하거나 아니면 완화되는 것으로 나타났다. 또한 순위상관 분석 결과 분석기간 중 오염물질의 공간적 분포에 상당한 정도의 동태적 변화가 있었던 것으로 나타났다.

  • PDF

야생동물위치추적기(WT-200)를 이용한 청둥오리의 이동거리 및 행동권 연구 (Movements and Home-range of Mallards by GPS-Mobile based Telementary (WT-200) in Korea)

  • 강태한;김달호;조해진;신용운;이한수;서재화;황종경
    • 한국환경생태학회지
    • /
    • 제28권6호
    • /
    • pp.642-649
    • /
    • 2014
  • 청둥오리는 대표적인 한국내 월동 수조류로 넓은 농경지를 월동지로 이용한다. 한국의 중부지역에 위치한 만경강 하류지역에서 청둥오리 월동 행동권 및 월동지에서 이동거리를 파악하고자 하였다. 2011-2013년 월동기에 Cannon-net을 이용하여 포획된 청둥오리 7개체에 GPS-이동통신 시스템을 기반으로 하는 야생동물위치추적장치(WT-200)를 부착하였다. 청둥오리 행동권 분석은 GIS용 SHP 파일과 ArcGIS 9.0 Animal Movement Extension을 이용하였으며, 커널밀도측정법(Kernel Density Estimation : KDE)과 최소볼록다각형법(Minimum Convex Polygon Method : MCP)을 이용하여 분석하였다. 청둥오리 행동권은 최소볼록다각형법(MCP)에 의해서 $118.8km^2$(SD=70.1, n=7) 이었으며, 커널밀도측정법(KDE)으로는 $60.0km^2$(KDE 90%), $23.0km^2$(KDE 70%) and $11.6km^2$(KDE 50%)이었다. 야생동물위치추적장치(WT-200) 부착지점으로부터 이동거리는 평균 19.4km이었으며, 최대이동거리는 33.2km, 최소이동거리는 9.4km이었다. GPS좌표가 획득된 정점간 거리는 평균 0.8km이었으며, 정점간 이동거리는 최소 6.5km에서 최대 19.7km이었다. 청둥오리는 월동기 동안 매우 짧은 거리를 이동하였으며, 월동지에서 수계 의존성이 매우 높은 경향을 보였다.

세균성 이질의 탐색적 공간분석 (An Explorator Spatial Analysis of Shigellosis)

  • 박기호
    • 대한지리학회지
    • /
    • 제34권5호
    • /
    • pp.473-491
    • /
    • 1999
  • 세균성 이질은 국내 제1종 법정 전염병으로 분류되어 관리되고 있는 질환으로서 1998년 이후 그 발병 사례가 급속히 증가하고 있다. 본 연구는 1999년 3월 부산시 사상구에서 집단 발병한 세균성 이질을 대상으로 하여, 각 환자들의 발병 시점과 장소의 분포패턴에 대한 지리학적 고찰을 목적으로 한다. 환자분포의 특징적 공간패턴과 그들의 시계열적 확산 양상 등을 탐색하기 위한 방법론은 보건지리학과 지도학 및 공간통계학에 기반을 둔 공간분석기법을 중심으로 설정하였다. 분석자료는 해당 지역의 수치지형도, 지적도, 인구 센서스 자료를 포함한 GIS 데이터베이스로 구축되었다. 인구분포를 감안한 밀도구분도를 바탕으로 개별환자의 위치자료와 동 단위로 집계된 자료를 자료의 형태에 따라 분석기법을 달리하였으며, 환자 발생 밀도, 상대적 위험지수 등을 지도화하여 역학자료의 시각적 통계적 분석을 수행하였다. 환자분포의 공간적 중심위치와 분산의 변화 등 기술적 통계분석과 함께 제1차 공간속성을 커널추정법으로 찾아보았다. 이와 더불어 ‘공간적 의존성’과 관련된 제2차 공간속성은 K-함수와 시뮬레이션을 통해 분석하여 군집성 등이 통계적으로 확인되었다. 본 연구를 통해 역학조사시 GIS의 활용사례가 제시되었으며, 모집단 인구를 고려한 확률지도 작성 기법과 다양한 데이터 가시화 방법, 그리고 시계열별 발생 환자들의 지리적 변이를 분석 하는데 따르는 문제들이 논의되었다.

  • PDF

모수적·비모수적 입력모델링 기법을 이용한 신뢰성 해석 (Reliability Analysis Using Parametric and Nonparametric Input Modeling Methods)

  • 강영진;홍지민;임오강;노유정
    • 한국전산구조공학회논문집
    • /
    • 제30권1호
    • /
    • pp.87-94
    • /
    • 2017
  • 신뢰성 해석 및 신뢰성기반 최적설계는 불확실성을 고려한 확률변수를 입력 값으로 요구하며, 확률변수는 모수적 비모수적 통계모델링 방법을 사용하여 확률분포함수의 형태로 정량화 된다. 신뢰성 해석과 같은 통계적 해석은 입력되는 확률분포함수의 특성이 결과값에 영향을 미치게 되며, 확률분포함수는 통계모델링 방법에 따라 다른 형태를 가지게 된다. 본 연구에서는 모수적 통계모델링 방법인 순차적 통계모델링 방법과 비모수적 방법인 커널밀도추정을 사용하여 데이터의 개수에 따른 통계모델링의 결과를 분석하였다. 또한 수치예제를 통해 두 가지 기법에 따른 신뢰성 해석의 결과를 분석하였고, 데이터의 개수에 따른 적절한 기법을 제안하였다.

분포변화 검정에서 경험확률과정과 커널밀도함수추정량의 검정력 비교 (Power Comparison between Methods of Empirical Process and a Kernel Density Estimator for the Test of Distribution Change)

  • 나성룡;박현아
    • Communications for Statistical Applications and Methods
    • /
    • 제18권2호
    • /
    • pp.245-255
    • /
    • 2011
  • 자료의 분포변화를 검정하는 비모수적 방법으로 경험분포함수를 이용하거나 확률밀도함수 추정량을 이용하는 두 가지 방법을 고려할 수 있다. 이 논문에서는 분포변화 검정을 위한 두가지 방법을 자세히 살펴보고 기존 연구의 결과를 정리한다. 여러 확률모형을 가정하고 분포변화 검정에 대한 모의 실험을 실시하여 두 방법에 대한 이론적 극한 성질이잘 성립하는가를 살펴본다. 검정력 비교를 통하여 모형에 따른 적절한 변화점 분석 방법을 알아본다.

벤처기업정밀실태조사와 한국기업혁신조사 데이터를 활용한 통계적 매칭의 타당성 검증 (The Validity Test of Statistical Matching Simulation Using the Data of Korea Venture Firms and Korea Innovation Survey)

  • 안경민;이영찬
    • 지식경영연구
    • /
    • 제24권1호
    • /
    • pp.245-271
    • /
    • 2023
  • 최근 데이터 경제가 가속화되면서 경영학 분야에서는 데이터 매칭이라는 새로운 기법이 주목받고 있다. 데이터 매칭은 모집단이 같지만 서로 다른 표본에서 수집된 데이터셋을 합치는 기법 또는 처리 과정을 의미한다. 그중에서 통계적 매칭은 서로 다른 데이터를 결합하는데 있어서 사업자 번호와 같이 기준이 되는 변수가 없는 경우 통계적 함수를 활용하여 데이터를 매칭하는 방법이다. 선행연구 검토결과 경제학, 교육학, 보건, 의료 등 다양한 분야에서 통계적 매칭이 많이 사용되고 있는데 반해 경영학 분야는 제한적임을 확인할 수 있었다. 본 연구는 기존 경영학 분야에서 충분히 연구되지 않았던 통계적 매칭의 유용성을 검증하고 활용도를 높이는 방안을 연구하고자 한다. 연구목적을 달성하기 위해 본 연구에서는 2020 벤처기업정밀실태조사와 2020 한국기업혁신조사 자료를 활용하여 통계적 매칭 시뮬레이션을 수행하였다. 먼저, 선행연구를 바탕으로 통계적 매칭에 사용되는 변수를 선정하였다. 공통변수는 업종, 종업원수, 지역, 업력, 상장시장, 매출로 설정하였고, 검증을 위한 고유변수와 제공변수는 중소기업 혁신에서 가장 중요한 연구인력 비율과 R&D 비용으로 각각 설정하였다. 사전 검증을 위해 2020 벤처기업정밀실태조사 자료를 수여자 데이터 30%와 기여자 데이터 70%로 분할하였다. 통계적 매칭에는 마할라노비스 거리와 랜덤 핫덱을 결합한 방식을 사용하였고, 성능평가는 수여자 데이터와 원시 데이터의 평균값 비교와 커널 밀도 함수(Kernel Density Estimation)를 통해 데이터 분포를 비교하였다. 검증결과, 수여자 데이터 30%와 기여자 데이터 70%에서 추출된 매칭 데이터의 평균값이 통계적으로 유의한 차이가 없는 것으로 나타나 유사한 데이터가 매칭된다는 것을 확인하였다. 또한, 두 데이터의 커널 밀도 함수로 도출한 데이터 분포 역시 유사한 형태가 나타나는 것을 확인할 수 있었다. 사후 검증에는 2020 벤처기업정밀실태조사에서 임의로 30%를 수여자 데이터로 추출하고 2020 한국기업혁신조사 자료를 기여자 데이터로 설정하여 통계적 매칭을 수행하고 검증하였다. 사전 검증과 마찬가지로 공통변수는 업종, 종업원수, 지역, 업력, 상장시장, 매출로 설정하였고, 검증을 위한 고유변수는 연구 인력 비율과 R&D 비용으로 정의하였다. 분석 결과, 수여자 데이터의 연구인력 비율의 평균과 기여자 데이터의 평균은 예상과 다르게 통계적으로 차이가 있는 것으로 나타났다. 하지만 커널 밀도 함수에 따른 두 데이터의 분포는 유사한 형태를 보이는 것으로 조사되어 통계적 매칭의 적절성을 확인할 수 있었다. R&D 비용은 통계적 매칭 수행 결과, 수여자 데이터의 R&D 비용 평균과 기여자 데이터의 평균이 통계적으로 차이가 없었고, 커널 밀도 함수도 유사한 분포를 보이는 것으로 조사되었다. 이러한 결과는 모집단은 동일하지만 서로 다른 표본에서 수집된 자료를 통계적으로 결합하여 신뢰할 수 있는 새로운 데이터를 확보할 수 있다는 측면에서 큰 의의가 있다. 또한, 경영학 분야에서 많이 사용되지 않았던 데이터 매칭 방법론을 모의실험을 통해 타당성을 검증함으로써 연구용 데이터 확보와 연구방법론의 확장에 기여했다는 점에서 시사점을 가진다.