• 제목/요약/키워드: image clustering

검색결과 599건 처리시간 0.03초

Clustering Algorithm by Grid-based Sampling

  • Park, Hee-Chang;Ryu, Jee-Hyun;Lee, Sung-Yong
    • Journal of the Korean Data and Information Science Society
    • /
    • 제14권3호
    • /
    • pp.535-543
    • /
    • 2003
  • Cluster analysis has been widely used in many applications, such as pattern analysis or recognition, data analysis, image processing, market research on on-line or off-line and so on. Clustering can identify dense and sparse regions among data attributes or object attributes. But it requires many hours to get clusters that we want, because clustering is more primitive, explorative and we make many data an object of cluster analysis. In this paper we propose a new method of clustering using sample based on grid. It is more fast than any traditional clustering method and maintains its accuracy.

  • PDF

Clustering Algorithm using a Center Of Gravity for Grid-based Sample

  • 박희창;유지현
    • 한국데이터정보과학회:학술대회논문집
    • /
    • 한국데이터정보과학회 2003년도 춘계학술대회
    • /
    • pp.77-88
    • /
    • 2003
  • Cluster analysis has been widely used in many applications, such that data analysis, pattern recognition, image processing, etc. But clustering requires many hours to get clusters that we want, because it is more primitive, explorative and we make many data an object of cluster analysis. In this paper we propose a new clustering method, 'Clustering algorithm using a center of gravity for grid-based sample'. It is more fast than any traditional clustering method and maintains accuracy. It reduces running time by using grid-based sample and keeps accuracy by using representative point, a center of gravity.

  • PDF

고객 Clustering을 위한 Blog 감성 추출에 대한 연구 (A Study on Extracting Customer Emotions from Blog and Clustering for Target Marketing)

  • 배상근;강재우
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2008년도 춘계학술발표대회
    • /
    • pp.403-406
    • /
    • 2008
  • Blog는 개인의 여러 미묘한 감정과 감성들을 표현하고, 이를 소통하는 Communication Channel 역할을 하고 있으며, 또한 누구나 접근할 수 있게 되었다. 이는 각 기업에게, 기존의 비효율적인 Mass Marketing 방법에서 벗어나, 소비자의 감성을 자연스럽게 추출하여 세련된 Target Marketing을 할 수 있는 훌륭한 기회를 제공하게 된다. 하지만, 고객의 Blog로 부터 미묘한 감성지수를 추출하고, 이를 마케팅 방법에 접목시키는 것은 쉽지 않은 일이다. 이러한 문제를 해결하기 위해서 본 논문에서는 고객 회원정보에 등록된 Blog를 이용하여, Target Marketing에 활용할 수 있는, 고객 Clustering을 위한 Blog 감성 추출에 대한 연구를 수행하였다. Blog의 Main Skin Image를 통해 지배적인 채도와 명도를 추출하여 수치화하고, 이를 바탕으로 고객 Blog를 테이스트 스케일법 (*일본감성연구소 개발방법)의 실증된 감성 Group 별로 Clustering 하였다. Clustering 된 각 Blog 사용자를 대상으로 연관 배색에 대한 감성 설문조사를 실시한 결과, 유의한 실험결과가 도출되어 향후 고객 감성을 기반으로 한 Target Marketing에 활용할 수 있는 가능성을 볼 수 있었다.

HSV색공간을 이용한 칼라화상의 클러스터링 및 색차평가에 관한 연구 (A Study on Clustering and Color Difference Evaluation of Color Image using HSV Color Space)

  • 김영일
    • 전자공학회논문지T
    • /
    • 제35T권2호
    • /
    • pp.20-27
    • /
    • 1998
  • HSV색공간을 이용한 칼라화상의 클러스터링 및 색차평가에 관한 연구(A Study on Clustering and Color Difference Evaluation of Color Image using HSV Color Space) pp.20~27 칼라화상을 화상부호화, 리모트 센싱, 컴퓨터비젼 등의 분야에 이용하기 위해서는 인간이 감각적으로 취급하기 쉬운 색공간으로 화상정보를 변환시켜야 한다. 색상, 명도, 채도를 근거로한 Munsell색공간은 인간의 색지각과 영역간의 색차가 일치하는 특징으로 인하여 칼라화상의 클러스터링에 이용되고 있다. 본 논문에서는 RGB입력화상을 ${L^*}{a^*}{b^*}$ 균등색공간으로 변환하고, 색지각과 일치되는 HSV색공간으로 근사화시킴으로써, 각 좌표축을 중심으로 클러스터링과 그 색차를 평가한다. 자기수렴 특성을 갖는 ISO DATA 알고리즘을 응용하여 HSV칼라화상의 영역을 분할하고, 과분할된 영역을 통합하는 방법을 제안하였다. 두 종류의 입력화상에 대한 클러스터링을, 색차를 기본으로 한 임계값에 따라 수행하므로써 화상내용의 복잡함에 대응하는 양호한 영역분할 결과를 제시하였다.

  • PDF

제조 시계열 데이터를 위한 진화 연산 기반의 하이브리드 클러스터링 기법 (Evolutionary Computation-based Hybird Clustring Technique for Manufacuring Time Series Data)

  • 오상헌;안창욱
    • 스마트미디어저널
    • /
    • 제10권3호
    • /
    • pp.23-30
    • /
    • 2021
  • 제조 시계열 데이터 클러스터링 기법은 제조 대용량 데이터 기반 군집화를 통한 설비 및 공정 이상 탐지 분류를 위한 중요한 솔루션이지만 기존 정적 데이터 대상 클러스터링 기법을 시계열 데이터에 적용함에 있어 낮은 정확도를 가지는 단점이 있다. 본 논문에서는 진화 연산 기반 시계열 군집 분석 접근 방식을 제시하여 기존 클러스터링 기술에 대한 정합성 향상하고자 한다. 이를 위하여 먼저 제조 공정 결과 이미지 형상을 선형 스캐닝을 활용하여 1차원 시계열 데이터로 변환하고 해당 변환 데이터 대상으로 Pearson 거리 매트릭을 기반으로 계층적 군집 분석 및 분할 군집 분석에 대한 최적 하위클러스터를 도출한다. 해당 최적 하위클러스터 대상 유전 알고리즘을 활용하여 유사도가 최소화되는 최적의 군집 조합을 도출한다. 그리고 실제 제조 과정 이미지 대상으로 기존 클러스터링 기법과 성능 비교를 통하여 제안된 클러스터링 기법의 성능 우수성을 검증한다.

퍼지 ART 신경망을 이용한 내용기반 영상검색 (Contents-based Image Retrieval using Fuzzy ART Neural Network)

  • 박상성;이만희;장동식;김재연
    • 융합신호처리학회논문지
    • /
    • 제4권2호
    • /
    • pp.12-17
    • /
    • 2003
  • 본 논문은 퍼지 ART 신경망 알고리즘을 이용하여 내용기반 영상을 검색하는 연구를 제시한다. 대용량의 영상 데이터베이스를 검색할 때, 클러스터링은 빠른 검색을 위해 중요하다. 그러나 많은 양의 영상 데이터를 적절하게 클러스터링 하는 것은 상당히 어렵다. 기존의 유사도에 따른 검색 방법은 검색의 정확도가 떨어지고 검색시간이 많이 걸리는 단점이 있기 때문에 이러한 단점을 보완하는 방법이 필요하다. 본 논문에서는 앞서 언급한 문제점을 보완하기 위하여 신경망 알고리즘을 사용한 내용기반 영상검색 시스템을 제안한다. 퍼지 ART 신경망 알고리즘을 사용한 본 검색 시스템에서는 색상과 질감을 검색에 필요한 특징치로 잡아 데이터를 0과 1사이의 데이터로 정규화 하여 신경망 알고리즘의 입력 데이터로 넣어서 영상을 클러스터링 한 후 검색을 실시하였다 300개의 영상을 가지고 실험한 결과 약 87%의 검출률을 보여 주었다.

  • PDF

초점거리 정보를 이용한 디지털 사진 분류 알고리즘 (A Smart Image Classification Algorithm for Digital Camera by Exploiting Focal Length Information)

  • 주영호;조환규
    • 한국컴퓨터그래픽스학회논문지
    • /
    • 제12권4호
    • /
    • pp.23-32
    • /
    • 2006
  • 최근 들어 디지털 카메라의 대중화로 인하여 많은 사람들이 손쉽게 다량의 사진을 촬영할 수 있게 되었다. 수백 장의 사진을 수작업으로 분류, 관리하는 것은 매우 힘든 일이며, 따라서 이를 자동으로 수행해주는 시스템의 필요성이 증대되었다. 디지털 이미지를 분류하는 이전 연구들은 대부분 일반적인 사진에 중점을 두고 있기 때문에 디지털 사진을 분류하기 위해서는 사용하기 힘들다. 최근에는 특정 조건 내에서 디지털 이미지를 분류하는 연구들이 많이 진행되고 있다. 이 알고리즘들은 대부분 시간차를 이용하여 사진을 분류하며 대부분 좋은 결과를 보이고 있지만 개선해야할 여지가 많이 남아있다. 예를 들면 초점거리와 같은 정보들은 사진을 분류할 때 전혀 사용하지 않는다. 따라서 본 논문에서는 EXIF의 초점거리 정보를 이용한 사진 분류 알고리즘을 제안한다. 본 논문에서는 매칭 벡터 분석방법을 이용하여 사진을 분류한다. 제안한 방법으로 실험한 결과, 95%의 사진 분류 성공률을 보였다.

  • PDF

EXTRACTING INSIGHTS OF CLASSIFICATION FOR TURING PATTERN WITH FEATURE ENGINEERING

  • OH, SEOYOUNG;LEE, SEUNGGYU
    • Journal of the Korean Society for Industrial and Applied Mathematics
    • /
    • 제24권3호
    • /
    • pp.321-330
    • /
    • 2020
  • Data classification and clustering is one of the most common applications of the machine learning. In this paper, we aim to provide the insight of the classification for Turing pattern image, which has high nonlinearity, with feature engineering using the machine learning without a multi-layered algorithm. For a given image data X whose fixel values are defined in [-1, 1], X - X3 and ∇X would be more meaningful feature than X to represent the interface and bulk region for a complex pattern image data. Therefore, we use X - X3 and ∇X in the neural network and clustering algorithm to classification. The results validate the feasibility of the proposed approach.

Cost Effective Image Classification Using Distributions of Multiple Features

  • Sivasankaravel, Vanitha Sivagami
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제16권7호
    • /
    • pp.2154-2168
    • /
    • 2022
  • Our work addresses the issues associated with usage of the semantic features by Bag of Words model, which requires construction of the dictionary. Extracting the relevant features and clustering them into code book or dictionary is computationally intensive and requires large storage area. Hence we propose to use a simple distribution of multiple shape based features, which is a mixture of gradients, radius and slope angles requiring very less computational cost and storage requirements but can serve as an equivalent image representative. The experimental work conducted on PASCAL VOC 2007 dataset exhibits marginally closer performance in terms of accuracy with the Bag of Word model using Self Organizing Map for clustering and very significant computational gain.

다차원 데이터에 대한 심층 군집 네트워크의 성능향상 방법 (Performance Improvement of Deep Clustering Networks for Multi Dimensional Data)

  • 이현진
    • 한국멀티미디어학회논문지
    • /
    • 제21권8호
    • /
    • pp.952-959
    • /
    • 2018
  • Clustering is one of the most fundamental algorithms in machine learning. The performance of clustering is affected by the distribution of data, and when there are more data or more dimensions, the performance is degraded. For this reason, we use a stacked auto encoder, one of the deep learning algorithms, to reduce the dimension of data which generate a feature vector that best represents the input data. We use k-means, which is a famous algorithm, as a clustering. Sine the feature vector which reduced dimensions are also multi dimensional, we use the Euclidean distance as well as the cosine similarity to increase the performance which calculating the similarity between the center of the cluster and the data as a vector. A deep clustering networks combining a stacked auto encoder and k-means re-trains the networks when the k-means result changes. When re-training the networks, the loss function of the stacked auto encoder and the loss function of the k-means are combined to improve the performance and the stability of the network. Experiments of benchmark image ad document dataset empirically validated the power of the proposed algorithm.