• 제목/요약/키워드: 데이터 결측

검색결과 134건 처리시간 0.027초

3차원 스캔한 인체 샅부위의 결측부위 복원 방법 비교 (Comparison of the Editing Method of Missing Area in 3D Scanned Image of Men's Crotch)

  • 김소영;홍경희
    • 한국의류학회지
    • /
    • 제33권3호
    • /
    • pp.401-409
    • /
    • 2009
  • The shape of crotch area is very important to develop functional clothing as well as other ergonomic goods such as chair or saddle etc. However, it is inevitable that 3D scanned image of crotch would have missing part due to its folded shape including overlapping legs nearby. Therefore, the objectives of this research was to compare reconstruction methods of missing parts at crotch using seven dummies of real men's replicas. Two reconstruction methods adopted were kinds of 'fill- hole' in Rapidform 2004, one was 'smooth' and the other was 'curvature'. Each restored image was compared with the original shape of the dummies. As results, the average distance was 0.66mm between original and 'smooth' treated images and 0.59mm between original and 'curvature' treated, which was not statistically different. Average area of restored crotch region was $8740.04cm^2$ by 'smooth' method and $8405.02cm^2$ by 'curvature' method which is close to the original area of $8413.76cm^2$. Statistical difference was found between images of original and 'smooth' ones$(p=0.04^*)$. However, there was no difference between original and 'curvature' treated images, which indicates that 'curvature' method is more useful to fill the hole compared with 'smooth' method.

신경망을 이용한 결측 수문자료 추정 및 실시간 자료 보정 (Missing Hydrological Data Estimation using Neural Network and Real Time Data Reconciliation)

  • 오재우;박진혁;김영국
    • 한국수자원학회논문집
    • /
    • 제41권10호
    • /
    • pp.1059-1065
    • /
    • 2008
  • 강우자료는 수문 해석에 있어 가장 기본이 되는 입력 자료이며, 다양한 원인에 의해 결측이 발생된다. 본 연구에서는 복잡한 자연현상 문제 해결에 그 응용성이 입증된 신경망 기법을 이용하여 결측 처리된 강우를 추정하기 위해서 소양강댐 유역 12개 강우량 관측소를 대상으로 신경망 모형을 구축하였으며, 모형의 성능 평가를 위해 실무에서 가장 많이 사용되고 있는 우량 보정 방법인 역거리법(RDS)과 산술평균법(AMM)으로 추정한 값과 비교하여 신경망을 이용한 추정 방법의 우수성을 보였다. 그리고 온라인상에서 보다 신뢰성 있는 수문자료를 재난관련 유관기관으로 전송하기 위해서 신경망 모형을 이용한 상시 실시간 보정이 가능하도록 신경망 학습기로 구성된 자동 보정시스템을 제안하였다.

K-최근접 이웃 알고리즘을 활용한 심장병 진단 및 예측 (Classification of Heart Disease Using K-Nearest Neighbor Imputation)

  • 박평우;이석원
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2017년도 추계학술발표대회
    • /
    • pp.742-745
    • /
    • 2017
  • 본 논문은 심장질환 도메인에 데이터 마이닝 기법을 적용한 연구로, 기존 환자의 정보에 대하여 K-최근접 이웃 알고리즘을 통해 결측 값을 대체하고, 대표적인 예측 분류기인 나이브 베이지안, 소포트 벡터 머신, 그리고 다층 퍼셉트론을 적용하여 각각 결과를 비교 및 분석한다. 본 연구의 실험은 K 최적화 과정을 포함하고 10-겹 교차 검증 방식으로 수행되었으며, 비교 및 분석은 정확도와 카파 통계치를 통해 판별한다.

학교 미세먼지 예측 모델 개발 (Development of Prediction Model for School Fine Dust)

  • 정종덕;한규한;김성석;김재현
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2022년도 추계학술발표대회
    • /
    • pp.14-16
    • /
    • 2022
  • 세계보건기구에 의해 미세먼지가 1급 발암물질로 지정됨에 따라, 건강에 미치는 영향에 대한 관심이 커지고 있다. 성장기 학생들은 학교에서 오랫동안 머무르게 되며, 따라서 교내 미세먼지는 학생들의 건강에 미치는 영향이 매우 클 수 있다. 본 연구에서는 1년동안 대상 학교에서 수집한 미세먼지 관련 데이터 및 공개된 Air Korea, 기상청 데이터를 활용하여, LSTM 기반 미세먼지 예측 모델을 개발하였다. 수집한 데이터에서 일부 오류나 결측치가 있었지만, 이를 활용한 미세먼지 예측 정확도는 충분히 가치가 있다고 판단된다.

GOCI Chlorophyll-a 결측 자료의 복원을 위한 DINEOF 방법 적용 (Application of DINEOF to Reconstruct the Missing Data from GOCI Chlorophyll-a)

  • 황도현;정한철;안재현;최종국
    • 대한원격탐사학회지
    • /
    • 제37권6_1호
    • /
    • pp.1507-1515
    • /
    • 2021
  • 해색 원격 탐사를 통해 chlorophyll-a를 추정하면 식물성 플랑크톤, 해양일차생산력의 전 지구적 분포를 파악할 수 있다. 하지만 위성으로 관측된 해색 자료는 구름이나 기상 상황 등에 의하여 결측 데이터가 발생한다. 본 연구에서는 DINEOF를 이용하여 GOCI chlorophyll-a 산출물의 결측 자료를 복원하고자 하였다. DINEOF는 시·공간 자료에 기반을 두어 결측 자료를 복원하는 방법으로, 정확도는 GOCI chlorophyll-a 영상의 일부를 제거한 뒤 복원 영상과 비교하여 교차 검증하였다. 연구지역에서 DINEOF를 위한 최적의 EOF 모드는 10-13이었다. 시·공간 복원 자료 결과에서는 오후 시간대 chlorophyll-a 농도가 증가하는 경향이 반영되었고, 노이즈에 해당되는 이상치는 필터링 되는 효과를 보였다. 따라서 DINEOF는 결측이 발생한 영상에 대하여 복원 자료로 활용 가능할 것으로 보이며, 이를 통해 해양 환경 모니터링을 위한 기초 자료로 사용 가능할 것으로 판단된다.

microRNA 발현 데이터의 상관관계 분석을 통한 microRNA Functional Family 탐색 (Defining microRNA functional families through correlation analysis of microRNA microarray data)

  • 남진우;장병탁
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2006년도 한국컴퓨터종합학술대회 논문집 Vol.33 No.1 (A)
    • /
    • pp.13-15
    • /
    • 2006
  • microRNA는 유전자의 전사 후 과정에서 negative regulation을 담당하는 small noncoding RNA의 한 증류이다. 최근까지 330여개의 인간 microRNA가 발견되었지만 그들의 기능이 밝혀진 것은 소수에 불과하다. microRNA의 기능은 3'UTR에 불완전 상보결합을 통해 negative regulation을 받게 되는 유전자의 기능으로부터 유추되는 것이 일반적이다. 특별히 유전체상에 군집화 된 microRNA들은 하나의 전사체로부터 발현되는 것으로 판단되며, 같은 또는 관련된 기능을 하거나 같은 목표 유전자를 조절하기 위한 functional family일 가능성이 높다. 또한 이러한 functional family는 하나의 전사체로부터 발현되기 때문에, 조직별로 조건별로 같은 발현 패턴을 보여야 한다. 본 연구에서는 발현데이터로부터 microRNA functional family를 탐색하기 위해, 5개의 연구 그룹에서 공개한 조직별 microRNA 발현데이터를 표준화 작업을 거친 후 통합하고 k-nearest neighbor 알고리즘을 이용해 결측치를 보정한 후 microRNA 발현사이의 correlation을 계산한다. 이때 데이터 통합에서 생기는 문제에 robust한 결과를 얻기 위해 실제 발현데이터가 아닌 rank 데이터부터 correlation을 측정한다. 계산된 spearman ranked correlation 결과와 microRNA의 genomic coordination 정보로부터 34개의 functional family를 정의할 수 있었다.

  • PDF

피에조센서의 차량 축 카운트를 활용한 교통량보정시스템 (Traffic Correction System Using Vehicle Axles Counts of Piezo Sensors)

  • 정승원;오주삼
    • 한국콘텐츠학회논문지
    • /
    • 제21권1호
    • /
    • pp.277-283
    • /
    • 2021
  • 차종별 교통량 자료는 건축·도시·교통 등의 다양한 분야에서 기초 자료로 활용되는 중요한 자료이다. 교통량 자료는 상시조사와 수시조사를 통해 수집되어 도로교통량 통계연보에 매년 연평균일교통량(AATD)으로 제공된다. 상시조사는 매설형 교통량 수집 장비 (AVC)를 통해 수집되며, AVC는 교통량을 검지하는 루프센서와 축수를 검지하는 피에조 센서로 구성되어 있다. 교통량 수집 장비는 매설형의 특성상 검지 장비 고장 등으로 인한 결측자료가 발생된다. 기존방법에서는 과거 데이터와 지점 주변의 교통량 추세를 통해 보정한다. 그러나 이러한 방법은 시간적·공간적 특성을 반영하지 못하고 보정에 활용되는 기데이터 또한 보정값일 수도 있다는 단점이 있다. 본 연구에서는 차량의 축을 검지할수 있는 피에조센서를 활용하여 획득되는 누적 축수를 통해 축보정계수를 산출하여 결측된 교통량을 보정하는 방안을 제안하였다. 이는 기존 방법의 한계점인 시간적·공간적 특성을 반영할 수 있다는 장점이 있으며, 비교 평가 결과 기존의 방법보다 오차율이 더 낮게 도출되었다. 축 카운트를 활용한 교통량보정시스템은 간단한 알고리즘으로 바로 현장 시스템에 적용 가능한 보정방법으로 판단된다.

디지털 데이터에서 데이터 전처리를 위한 자동화된 결측 구간 대치 방법에 관한 연구 (A Study on Automatic Missing Value Imputation Replacement Method for Data Processing in Digital Data)

  • 김종찬;심춘보;정세훈
    • 한국멀티미디어학회논문지
    • /
    • 제24권2호
    • /
    • pp.245-254
    • /
    • 2021
  • We proposed the research on an analysis and prediction model that allows the identification of outliers or abnormality in the data followed by effective and rapid imputation of missing values was conducted. This model is expected to analyze efficiently the problems in the data based on the calibrated raw data. As a result, a system that can adequately utilize the data was constructed by using the introduced KNN + MLE algorithm. With this algorithm, the problems in some of the existing KNN-based missing data imputation algorithms such as ignoring the missing values in some data sections or discarding normal observations were effectively addressed. A comparative evaluation was performed between the existing imputation approaches such as K-means, KNN, MEI, and MI as well as the data missing mechanisms including MCAR, MAR, and NI to check the effectiveness/efficiency of the proposed algorithm, and its superiority in all aspects was confirmed.

모델트리의 결측치 처리 방법에 따른 콜레스테롤수치 예측의 성능 변화 (Using Missing Values in the Model Tree to Change Performance for Predict Cholesterol Levels)

  • 정용규;원재강;신성철
    • 서비스연구
    • /
    • 제2권2호
    • /
    • pp.35-43
    • /
    • 2012
  • 데이터 마이닝은 특정분야에서만 관심을 갖는 분야가 아니라 현재 우리주변 여러 분야에서 많이 사용되고 응용되고 있다. 즉, 수많은 데이터 가운데 숨겨져 있는 유용한 상관관계를 발견하여, 미래에 실행 가능한 정보를 예측하여 추출해 내고 추후에 의사 결정에 이용하는 과정을 말한다. 하지만, 일부 데이터 집합에서는 매우 많은 결측치를 포함하는 변수들이 존재한다. 다시 말해서 다수의 레코드에서 측정치가 존재하지 않는 데이터 집합이 존재한다. 그래서 본 논문에서는 Cholesterol 값을 예측하기 위한 결측치 처리에 따른 모델트리 알고리즘을 적용하고, 실험을 통해서 각 처리방식에 대한 성능을 분석한다. 또는 이 결과를 통하여 결측치 대체방법에 대한 효율적인 적용사례를 제시한다.

  • PDF

XGBoost 기반 상수도관망 센서 위치 최적화 (Optimal Sensor Location in Water Distribution Network using XGBoost Model)

  • 장혜운;정동휘
    • 한국수자원학회:학술대회논문집
    • /
    • 한국수자원학회 2023년도 학술발표회
    • /
    • pp.217-217
    • /
    • 2023
  • 상수도관망은 사용자에게 고품질의 물을 안정적으로 공급하는 것을 목적으로 하며, 이를 평가하기 위한 지표 중 하나로 압력을 활용한다. 최근 스마트 센서의 설치가 확장됨에 따라 기계학습기법을 이용한 실시간 데이터 기반의 분석이 활발하다. 따라서 어디에서 데이터를 수집하느냐에 대한 센서 위치 결정이 중요하다. 본 연구는 eXtreme Gradient Boosting(XGBoost) 모델을 활용하여 대규모 상수도관망 내 센서 위치를 최적화하는 방법론을 제안한다. XGBoost 모델은 여러 의사결정 나무(decision tree)를 활용하는 앙상블(ensemble) 모델이며, 오차에 따른 가중치를 부여하여 성능을 향상시키는 부스팅(boosting) 방식을 이용한다. 이는 분산 및 병렬 처리가 가능해 메모리리소스를 최적으로 사용하고, 학습 속도가 빠르며 결측치에 대한 전처리 과정을 모델 내에 포함하고 있다는 장점이 있다. 모델 구현을 위한 독립 변수 결정을 위해 압력 데이터의 변동성 및 평균압력 값을 고려하여 상수도관망을 대표하는 중요 절점(critical node)를 선정한다. 중요 절점의 압력 값을 예측하는 XGBoost 모델을 구축하고 모델의 성능과 요인 중요도(feature importance) 값을 고려하여 센서의 최적 위치를 선정한다. 이러한 방법론을 기반으로 상수도관망의 특성에 따른 경향성을 파악하기 위해 다양한 형태(예를 들어, 망형, 가지형)와 구성 절점의 수를 변화시키며 결과를 분석한다. 본 연구에서 구축한 XGBoost 모델은 추가적인 전처리 과정을 최소화하며 대규모 관망에 간편하게 사용할 수 있어 추후 다양한 입출력 데이터의 조합을 통해 센서 위치 외에도 상수도관망에서의 성능 최적화에 활용할 수 있을 것으로 기대한다.

  • PDF