• 제목/요약/키워드: 밀도기반군집

검색결과 41건 처리시간 0.025초

밀도 기반의 퍼지 C-Means 알고리즘을 이용한 클러스터 합병 (Cluster Merging Using Density based Fuzzy C-Means algorithm)

  • 한진우;전성해;오경환
    • 한국지능시스템학회:학술대회논문집
    • /
    • 한국퍼지및지능시스템학회 2003년도 춘계 학술대회 학술발표 논문집
    • /
    • pp.235-238
    • /
    • 2003
  • Fuzzy C-Means(FCM) 알고리즘은 초기 군집 중심의 개수와 위치에 따라 군집 결과의 성능차이가 많이 나타난다. 하지만 일반적인 경우에 군집 중심의 개수는 분석가의 주관에 의해 결정되고, 임의적으로 결정되기 때문에 원래 데이터의 구조와는 무관하게 수행되어 최적화된 군집화 수행을 실행하지 못하는 경우가 발생하게 된다. 따라서 본 논문에서는 원래의 데이터의 구조에 좀더 근접한 퍼지 군집화를 수행하기 위하여 격자를 바탕으로 한 데이터의 밀도를 이용한 FCM을 제안하고, 이러한 밀도 기반 FCM에 의해 결정된 군집의 합병 기법을 제안하였다. N-차원의 데이터 공간을 N-차원의 격자로 나누고, 초기 군집 중심의 개수와 위치는 각 격자의 밀도를 바탕으로 결정된다. 초기화 이후에 각 격자 내부에서 FCM을 이용하여 군집화를 수행하고, 계속해서 이웃 격자의 군집결과에 대하여 군집간의 유사도 측도를 이용하여 군집 합병을 수행함으로써 데이터의 자연적인 구조에 근접한 군집화를 수행하였다. 제안된 군집화 합병 기법의 향상된 성능은 UCI Machine Learning Repository 데이터를 이용하여 확인하였다.

  • PDF

다계층 밀도기반 군집화 기법 (Multi-hierarchical Density-based Clustering Method)

  • 신동문;정석호;이경민;이동규;손교용;류근호
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2009년도 추계학술발표대회
    • /
    • pp.797-798
    • /
    • 2009
  • 군집화는 대용량의 데이터로부터 유용한 정보를 추출하는 데에 적합한 데이터마이닝 기법들 중 하나이다. 군집화 기법은 주어진 데이터그룹 내에서 사전정보 없이 의미있는 지식을 발견할 수 있으므로 큰 어려움이 없이 실제 응용분야에 적용할 수 있다. 또한, 대용량 데이터를 다룰 때에 개별적인 데이터에 대한 접근 횟수를 줄이고, 알고리즘이 다루어야 할 데이터 구조의 크기를 줄일 수 있다. 본 논문에서는 밀도-기반 군집화 기법을 기반으로 하는 새로운 군집화 기법을 제안한다. 우리가 제안하는 군집화 기법은 반복적인 군집화 과정을 통하여 군집 내 주변 잡음을 제거하고 더 세밀하게 집단을 세분화하는 것이 가능하다. 또한, 군집을 표현하는 데에 계층구조로 나타내어 각 군집의 상관관계를 파악하는 데에 유리하다. 본 논문에서 제안하는 군집화 기법을 통하여 다양한 밀도를 가진 군집들을 효과적으로 분류할 수 있을 거라고 기대된다.

밀도 기반 공간 군집체계를 반영한 해양사고 위험 예측 모델 개발에 관한 연구

  • 양지민;최충정;백연지;임광현;노유나
    • 한국항해항만학회:학술대회논문집
    • /
    • 한국항해항만학회 2023년도 춘계학술대회
    • /
    • pp.146-147
    • /
    • 2023
  • 해양사고는 도로교통과 달리 지속적으로 증가하고 있으며, 인명피해가 주로 발생하는 주요 사고의 치사율은 도로교통의 11.7배 이상이다. 해양사고는 외부 환경에 따라 사고 위치가 변하고 즉각적인 조치가 어려워 타 교통에 비해 대형 사고로 이어질 가능성이 매우 크다. 그러나 여전히 사고가 발생하고 난 후 대응하는 등 사후적 관리 단계에 무르고 있어 사고의 주요 요인을 사전에 식별·관리하는 선제적 관리단계로의 전환 필요성이 대두되고 있다. 따라서 본 연구에서는 해양사고 발생 지점 밀도 기반의 가변 공간 군집체계를 반영한 해양사고 예측모델을 개발하였다. 반복적인 공간 가산분석을 통해 밀도가 높을수록 작은 규모의 격자 체계를 가질 수 있도록 상세한 공간 군집체계를 구성하였으며, 단순 사고 위험도 예측뿐만 아닌 사고 인과관계를 설명할 수 있는 BN(Bayesian Network) 기반의 모형을 사용하여 해양사고 위험예측 모델을 개발하였다. 또한, Cost-of-Omission을 통해 해양사고 예측확률의 변화와 각 변수들의 영향력을 확인하였으며, 월별 해양사고예측 결과를 GIS를 활용하여 2D/3D 기반으로 시각화하였다.

  • PDF

군집분석을 이용한 양파 감성사전 구축 (Construction of Onion Sentiment Dictionary using Cluster Analysis)

  • 오승원;김민수
    • Journal of the Korean Data Analysis Society
    • /
    • 제20권6호
    • /
    • pp.2917-2932
    • /
    • 2018
  • 우리나라 식생활에 밀접한 관련을 가지고 있는 채소인 양파의 수급불균형 해결을 위한 생산량 예측 모형 개발의 노력이 많은 연구를 통해 이뤄지고 있다. 하지만 양파의 수확기와 저장 가능성을 고려해 봤을 때 생산량 예측만으로는 수급불균형 해결이 어렵다. 따라서 본 논문에서는 양파의 생산량 정보와 가격의 다양한 요인이 포함되어 있으며 일상에서 쉽게 접할 수 있는 인터넷 기사를 이용하여 가격 예측을 위한 감성사전을 구축하고자 한다. 양파 기사는 2012년부터 2016년까지의 데이터를 사용하였고 도매시장 가격을 통한 문서구분을 통해 4가지 TF-IDF를 비교하여 적합한 TF-IDF를 사용하였다. 분석을 위하여 분할적 군집분석 중 k-means 군집, 밀도기반군집(DBSCAN; density based spatial cluster applications with noise), 가우시안혼합분포군집(GMM; Gaussian mixture model) 군집을 통하여 가격에 대한 긍정/부정 단어를 구분한 결과 GMM 군집이 의미 있는 긍정, 부정, 무정의 3개의 사전으로 구성되었다. 구축된 사전의 합리성을 비교하기 위하여 가격 상승 기사와 가격 하락 기사의 분류에 로지스틱 회귀분석을 적용한 결과 85.7%의 정확도로 구축된 사전의 합리성을 확인할 수 있었다.

계층 발생 프레임워크를 이용한 군집 계층 시각화 (Visualizing Cluster Hierarchy Using Hierarchy Generation Framework)

  • 신동화;이세희;서진욱
    • 정보과학회 컴퓨팅의 실제 논문지
    • /
    • 제21권6호
    • /
    • pp.436-441
    • /
    • 2015
  • 군집화 알고리즘은 그 종류에 따라 만들어낼 수 있는 군집의 종류와 보여줄 수 있는 정보의 수준이 차이가 난다. 밀도기반 군집화 알고리즘은 데이터 분포 상의 임의의 모양을 가진 군집을 잘 잡아내지만 보여줄 수 있는 계층정보가 매우 적거나 없는 수준이고, 반면 계층적 군집화 알고리즘은 자세한 계층 정보를 보여주지만 구 모양의 군집 외에는 잘 잡아내지 못한다. 이 논문에서는 이러한 두 군집화 방식의 대표적 알고리즘인 OPTICS와 응집 계층 군집화 알고리즘의 장점만을 취하는 계층 발생 프레임워크를 제시하고 이와 더불어 효과적 데이터 분석을 위한 여러 시각화, 상호작용 기법을 지원하는 시각적 분석 애플리케이션을 제공한다.

공간 태그된 트윗을 사용한 밀도 기반 관심지점 경계선 추정 (Density-Based Estimation of POI Boundaries Using Geo-Tagged Tweets)

  • 신원용;둥부도
    • 한국통신학회논문지
    • /
    • 제42권2호
    • /
    • pp.453-459
    • /
    • 2017
  • 사용자들은 그들의 관심이 관심지점 (POI: Point-of-Interest)과 관련이 있다는 사실을 언급하기 위해 위치 기반 소셜 네트워크에 체크인하거나 그들의 상태를 올리는 경향이 있다. 관심지역 (AOI: Area-of-Interest)을 찾는 기존 연구는 대부분 위치 기반 소셜 네트워크로부터 수집된 공간 태그된 사진과 함께 밀도 기반 군집화 기법을 사용하여 수행되었다. 반면, 본 연구에서는 POI 중심을 포함한 하나의 군집에 해당하는 POI 경계선을 추정하는 데에 초점을 맞춘다. 트위터 사용자들로부터의 공간 태그된 트윗을 사용하여 POI 중심으로부터 도달할 수 있는 적절한 반경을 찾음으로써 POI 경계선을 추정하는 밀도 기반 저복잡도 두 단계 방법을 소개한다. 두 단계 밀도 기반 추정을 통해 선택된 공간 태그의 convex hull로써 POI 경계선을 추정하는데, 각 단계에서 다른 크기의 반경 증가를 가정하여 진행한다. 제안한 방법은 기본 밀도 기반 군집화 방법보다 계산 복잡도 측면에서 우수한 성능을 가짐을 보인다.

다중 클래스 아다부스트를 이용한 엘리베이터 내 군집 밀도 추정 (Crowd Density Estimation with Multi-class Adaboost in elevator)

  • 김대훈;이영현;구본화;고한석
    • 한국컴퓨터정보학회논문지
    • /
    • 제17권7호
    • /
    • pp.45-52
    • /
    • 2012
  • 본 논문에서는 다중 클래스 아다부스트 기반의 분류기를 이용하여 엘리베이터 내 군집 밀도를 추정하는 방법을 제안한다. SOM을 사용하는 기존의 방법은 재현성이 떨어지며 충분한 성능을 내지 못한다. 제안한 방법은 GLDM(Grey-Level Dependency Matrix)과 GGDM(Grey-Gradient Dependency Matrix)의 텍스처 특징과 다중 클래스 아다부스트 기반의 분류기를 통해 실내 군집 밀도를 추정한다. 다중 클래스를 분류하기 위해 기존의 아다부스트 알고리즘에서 웨이트 업데이트 식을 변형하여 더 높은 성능의 약한 분류기를 생성하도록 하였다. 군집 밀도는 인원수에 따라 0명, 1~2명, 3~4명, 5명 이상 등 네 가지 클래스로 구분하였다. 엘리베이터 내 영상을 이용한 모의 실험 결과 제안된 방법은 기존의 방법보다 약 20% 정도의 검출률 향상을 나타내었다.

개선된 밀도 기반의 퍼지 C-Means 알고리즘을 이용한 클러스터 합병 (Cluster Merging Using Enhanced Density based Fuzzy C-Means Clustering Algorithm)

  • 한진우;전성해;오경환
    • 한국지능시스템학회논문지
    • /
    • 제14권5호
    • /
    • pp.517-524
    • /
    • 2004
  • 1960년대 퍼지 이론이 소개된 이후 데이터 마이닝을 포함한 기계 학습 분야의 군집화 작업에서 퍼지 이론이 폭넓게 사용되었다. 퍼지 C-평균 알고리즘은 가장 많이 사용되는 퍼지 군집화 알고리즘이다. 이 알고리즘은 하나의 데이터 개체가 서로 다른 소속 정도를 가지고 각 군집에 할당될 수 있도록 한다. 퍼지 C-평균 알고리즘도 K-평균 알고리즘과 같은 일반적인 군집화 알고리즘과 마찬가지로 초기 군집수와 군집 중심의 위치에 의해 최종 군집 결과의 성능 차이가 나타난다. 군집화를 위한 이러한 초기 설정은 주관적이며 이 때문에 적절치 못한 결과를 얻게 될 수도 있다. 본 논문에서는 이 문제를 해결할 수 있는 방법으로 주어진 학습 데이터의 속성을 기반으로 한 초기 군집수와 군집 중심을 결정하는 개선된 밀도 기반의 퍼지 C-평균 알고리즘을 제안하였다. 제안 방법은 격자를 사용하여 초기 군집 중심의 위치와 군집수를 결정하였다. 기존에 많이 이용되었던 객관적인 기계 학습 데이터를 이용하여 제안 알고리즘의 성능비교를 수행하였다.

능동소나 시스템을 위한 군집화 기반의 클러터 제거 기법 (A clutter reduction algorithm based on clustering for active sonar systems)

  • 곽철현;정명준;안재균
    • 한국음향학회지
    • /
    • 제35권2호
    • /
    • pp.149-157
    • /
    • 2016
  • 본 논문에서는 천해 환경에서 고밀도로 형성되는 클러터를 제거하는 군집화 기반의 능동소나 클러터 제거 기법을 제안한다. 먼저 제안하는 기법에서는 표적의 속도, 송신 핑 주기 등을 고려하여 측정치에 대해 밀도 기반의 군집화를 수행한다. 군집으로 분류된 측정치들을 실제 표적에 대한 후보로 가정하고 군집화 되지 않은 측정치인 잡음을 제거한다. 군집화 후 군집별 표적 여부를 판단하기 위해 유효성 검사를 실시하여 표적과 클러터를 구분한다. 최종적으로 표적으로 분류되지 않은 군집의 측정치들을 클러터로 간주하여 제거한다. 제안한 기법을 모의신호와 해상실험데이터를 이용하여 성능 분석한 결과, 본 논문에서 제안한 군집화 기반의 능동소나 클러터 기법의 성능이 기존 방법보다 우수함을 확인하였다.

전기 사용량 시계열 함수 데이터에 대한 비모수적 군집화 (Nonparametric clustering of functional time series electricity consumption data)

  • 김재희
    • 응용통계연구
    • /
    • 제32권1호
    • /
    • pp.149-160
    • /
    • 2019
  • 본 연구는 2016년 7월부터 2017년 6월까지 인천 소재 A 대학교의 15분 단위의 일일 전기 사용량 시계열 데이터에 대해 functional data analysis 기법을 적용하여 군집화하고 각 군집의 특성을 파악하고 예측에 활용하고자 한다. 하루동안의 A 대학교의 전기 사용량은 패턴은 주중과 주말 에 큰 차이를 보이며 스플라인 기저함수로 FPCA 구한 후 이들에 대한 가우시안 분포의 혼합모형 기반 군집분석으로 3개의 군집화가 적절해 보인다. 각 군집에 대해 평균 함수, 확률밀도함수, 일들의 분포 등을 정리해 각 군집에 대한 정보와 특징을 보여준다.