• Title/Summary/Keyword: 군집 자료

Search Result 1,192, Processing Time 0.027 seconds

연속형 자료에 대한 나무형 군집화

  • Heo, Myeong-Hui;Yang, Gyeong-Suk
    • Proceedings of the Korean Statistical Society Conference
    • /
    • 2005.05a
    • /
    • pp.49-51
    • /
    • 2005
  • 본 연구는 반복분할(recursive partitioning)에 의한 군집화 방법을 제안하고 활용 예를 제시한다. 이 방법은 나무 형태의 해석하기 쉬운 단순한 규칙을 제공하면서 동시에 변수선택기능을 제공한다.

  • PDF

Improvements of K-modes Algorithm and ROCK Algorithm (K-모드 알고리즘과 ROCK 알고리즘의 개선)

  • 김보화;김규성
    • The Korean Journal of Applied Statistics
    • /
    • v.15 no.2
    • /
    • pp.381-393
    • /
    • 2002
  • K-modes algorithm and ROCK(RObust Clustering using linKs) algorithm we useful clustering methods for large categorical data. In the paper, we investigate these algorithms and propose improved algorithms of them to correct their weakness. A simulation study shows that the proposed algorithms could increase the performance of data clustering.

A Search-ant and Labor-ant Algorithm for Clustering Data (탐색개미-일개미 군집화 알고리즘)

  • Sim Gyu-Seok;Lee Hui-Sang;Kim Yun-Bae;Park Jin-Su;Kim Jae-Beom
    • Proceedings of the Korean Operations and Management Science Society Conference
    • /
    • 2006.05a
    • /
    • pp.313-319
    • /
    • 2006
  • 데이타 마이닝, 특히 군집화 분야는 개미기반 알고리즘(ant-based algorithm) 관련 연구가 주목받는 영역 중 하나이다. 그러나 개미기반 알고리즘은 실제 군집화 문제를 해결하기에 많은 어려움을 가지고 있다. 본 논문에서는 기존의 알고리즘들을 고찰하고, 보다 실제적인 개미의 행태를 고려하여, 개선된 알고리즘을 제안한다. 실제 개미의 먹이 수집 과정에서 일어나는 초기 탐색개미의 움직임과 저장소를 향한 일개미들의 움직임을 반영하여, 보다 빠르고 효율적인 군집화를 이끌어 낸다. 인공자료와 실제 자료에 적용하여, 제안하는 알고리즘이 성능을 향상시킬 수 있고, 보다 다양한 자료에 적용될 수 있다는 것을 실험결과로 보였다.

  • PDF

Analysis of Rainfall Pattern Change According to Urbanization (도시화에 따른 강우특성 변화 분석)

  • Oh, Tae-Suk;Moon, Young-Il;Son, Chan-Young;Chun, Si-Young
    • Proceedings of the Korea Water Resources Association Conference
    • /
    • 2010.05a
    • /
    • pp.1327-1331
    • /
    • 2010
  • 최근 50년간 한반도는 산업화와 근대화로 인하여 급격한 도시화가 진행되었다. 도시화는 자연적으로 조성된 생태환경을 변화시키고, 열섬현상과 고층빌딩 등으로 인해 대기의 이동과 특성의 변화를 야기시키게 된다. 따라서 본 연구에서는 우리나라의 과거부터 인구자료와 시가화면적비 자료를 이용하여 도시화가 많이 진행된 지역과 비도시화 지역으로 구분하여 발생된 강우특성자료에 대한 비교분석을 수행하였다. 따라서 우리나라의 관측자료가 존재하는 57개 지점을 대상으로 위도, 경도, 연강우량, 연최대일강우량, 강우일수, 10mm 이상의 강우일수 및 80mm 이상의 강우일수를 이용하여 군집분석을 수행하였다. 군집분석을 통해 우리나라를 크게 4개 권역으로 구분하고, 강우자료의 관측기간을 이등분하여 전후를 비교하였다. 분석 결과에서 도시화가 진행된 지역이 비도시화 지역에 비하여 강우사상의 변화가 연강우량과 강우일수, 80mm 이상 강우일수에서 나타나고 있는 것으로 나타났다. 따라서 도시화가 강우특성 변화에 끼치는 영향에 대한 지속적인 연구가 필요한 것으로 판단된다.

  • PDF

Applications of Cluster Analysis in Biplots (행렬도에서 군집분석의 활용)

  • Choi, Yong-Seok;Kim, Hyoung-Young
    • Communications for Statistical Applications and Methods
    • /
    • v.15 no.1
    • /
    • pp.65-76
    • /
    • 2008
  • Biplots are the multivariate analogue of scatter plots. They approximate the multivariate distribution of a sample in a few dimensions, typically two, and they superimpose on this display representations of the variables on which the samples are measured(Gower and Hand, 1996, Chapter 1). And the relationships between the observations and variables can be easily seen. Thus, biplots are useful for giving a graphical description of the data. However, this method does not give some concise interpretations between variables and observations when the number of observations are large. Therefore, in this study, we will suggest to interpret the biplot analysis by applying the K-means clustering analysis. It shows that the relationships between the clusters and variables can be easily interpreted. So, this method is more useful for giving a graphical description of the data than using raw data.

Regional frequency analysis using rainfall observation data in Gangwon Province (강원도 강우관측 자료를 이용한 지역빈도분석)

  • Young Il Jeon;Sang Ug Kim;Dong Il Seo;Jae Wook Han
    • Proceedings of the Korea Water Resources Association Conference
    • /
    • 2023.05a
    • /
    • pp.211-211
    • /
    • 2023
  • 본 연구에서는 지역빈도분석을 이용하고 있는 홍수량 산정 지침에서 활용되고 있는 전국대상의 강우관소에 대한 확률강우량과 강원지역에 위치한 강우관측소만을 대상으로 산정한 확률강우량을 비교하였다. 이를 위해서 강원도 지역의 48개 지점의 지속기간별 강우자료를 수집한 후, K-means 기법을 이용하여 6개의 군집으로 구분하였다. 강원도 대부분이 산악지형임을 고려해 산악효과를 야기하는 지형인자와 강우자료의 관계를 파악하였다. 국가수자원관리종합정보시스템에서 수집한 강우자료를 사용하여 지속시간별 최대강우량과 산악효과를 야기하는 지형인자로 선정한 고도 이외에 위도, 경도를 각각 추가인자로 고려해 지역빈도분석을 수행하였다. 위 지형인자와 강우자료를 이용하여 수문학적 동질한 특성을 가지는 군집을 구성하였으며, 위도와 경도를 인자로 추가하면 더욱 강한 상관성을 보임을 알 수 있었다. 군집분석결과를 통해 모수를 추정하고 적절한 분포를 선택하였으며, 이상치검정과 적합도 검정을 통해 최종 분포를 결정하였다. 고도와 위도, 경도를 모두 고려해 이용한 지역빈도분석 결과 강원도의 실제 강우특성과 마찬가지로 고도의 높낮이에 따라 강우형태를 전국단위 지역빈도분석과 비교하였다. 최종적으로 현재 활용되고 있는 홍수량 산정 지침의 확률강우량과 강원지역에 위치한 강우관측소만을 대상으로 한 지역빈도분석의 차이의 발생원인과 강원지역에서의 특이성을 결론으로 제시하였다.

  • PDF

Analysis of Characteristics of Clusters of Middle School Students Using K-Means Cluster Analysis (K-평균 군집분석을 활용한 중학생의 군집화 및 특성 분석)

  • Jaebong, Lee
    • Journal of The Korean Association For Science Education
    • /
    • v.42 no.6
    • /
    • pp.611-619
    • /
    • 2022
  • The purpose of this study is to explore the possibility of applying big data analysis to provide appropriate feedback to students using evaluation data in science education at a time when interest in educational data mining has recently increased in education. In this study, we use the evaluation data of 2,576 students who took 24 questions of the national assessment of educational achievement. And we use K-means cluster analysis as a method of unsupervised machine learning for clustering. As a result of clustering, students were divided into six clusters. The middle-ranking students are divided into various clusters when compared to upper or lower ranks. According to the results of the cluster analysis, the most important factor influencing clusterization is academic achievement, and each cluster shows different characteristics in terms of content domains, subject competencies, and affective characteristics. Learning motivation is important among the affective domains in the lower-ranking achievement cluster, and scientific inquiry and problem-solving competency, as well as scientific communication competency have a major influence in terms of subject competencies. In the content domain, achievement of motion and energy and matter are important factors to distinguish the characteristics of the cluster. As a result, we can provide students with customized feedback for learning based on the characteristics of each cluster. We discuss implications of these results for science education, such as the possibility of using this study results, balanced learning by content domains, enhancement of subject competency, and improvement of scientific attitude.

웹로그 데이터에 대한 군집분석 알고리즘에 관한 연구

  • Gang, Hyeon-Cheol;Han, Sang-Tae;Seon, Yeong-Su
    • Proceedings of the Korean Statistical Society Conference
    • /
    • 2003.10a
    • /
    • pp.313-318
    • /
    • 2003
  • 최근 인터넷은 기업이 고객과 접촉할 수 있는 새로운 수단으로써 기업의 홍보나 서비스를 제공하는 기능을 수행할 뿐만 아니라 사업을 위한 중요한 도구로 여겨지고 있다. 따라서 방문자의 웹사이트 이용형태를 파악하기 위한 다양한 기법들이 제시되고 있으며, 웹로그 데이터에 대한 자료분석 기법들이 여러 학문분야에서 연구되고 있다. 본 연구에서는 웹로그 데이터에 대한 군집분석을 위해 거리측도 및 분석 알고리즘을 제안하였으며, 실제 자료에 이를 적용하여 제안된 알고리즘의 특성을 살펴보았다.

  • PDF

군집방법의 역사와 응용사례에 관한 고찰

  • 이승우
    • Journal for History of Mathematics
    • /
    • v.10 no.2
    • /
    • pp.48-52
    • /
    • 1997
  • 통계학이란 미래에 대한 예측을 하고 이에 대비하여 합리적인 의사결정을 내리는데 도움을 받을 수 있는 학문이다. 최근 다변량 통계분석은 관찰이나 실험의 대상이 되는 하나 이상의 변수들을 동시에 분석할 수 있는 매우 실제성이 높은 분석방법으로 통계학, 경영학, 사회학, 심리학, 생물학 등 여러 전공 분야에서 복잡하고 다양한 자료 분석에 폭넓게 활용되고 있다. 이 논문에서는 다변량 분석 방법 중 컴퓨터와 통계 분석 소프트웨어의 발전으로 인하여 최근에 활발히 연구되고 있는 군집방법의 역사와 여러 연구분야의 실제자료분석에 응용할 수 있도록 군집분석을 6가지로 나누어서 분류하였고 그 방법론을 제시하였다.

  • PDF

통영 인근 바다목장 개발 해역내 조하대 저서동물 군집 구조

  • 박흥식;김종만;홍재상
    • Proceedings of the Korean Society of Fisheries Technology Conference
    • /
    • 2000.05a
    • /
    • pp.395-395
    • /
    • 2000
  • 저서동물 군집조사는 먹이사슬이나 먹이망 등 해양생태계의 역학관계를 이해하는데 필수적으로 이루어져야 할 부분이며, 환경 변화가 해양생물에 미치는 영향을 평가하거나 생태계 변화를 예측하는데 가장 효율적인 조사방법이라고 본다. 바다목장화를 위해서는 우선적으로 연질기저 저서생불군집의 특징을 파악하여 생태계의 구조와 물질순환에 관한 기초적 자료를 제공할 필요가 있기 때문에, 본 조사는 저서환경에 대한 자료 축적 및 생태계 변동에 대한 감시 차원에서의 조사를 수행하였다. (중략)

  • PDF