• 제목/요약/키워드: Group Model Clustering

검색결과 98건 처리시간 0.028초

이단계 군집분석에 의한 농촌관광 편의시설 유형별 소비자 선호 결정요인 (Determinants of Consumer Preference by type of Accommodation: Two Step Cluster Analysis)

  • 박덕병;윤유식;이민수
    • 마케팅과학연구
    • /
    • 제17권3호
    • /
    • pp.1-19
    • /
    • 2007
  • 본 연구에서는 농촌관광 방문객에게 제공되는 편의시설을 유형화하고 어떤 특징을 가진 방문객이 어떤 편의시설을 선호하는지를 규명하기 위한 방법과 그 분석결과를 제시하였다. 이를 위하여 우선 2단계 군집분석법을 사용하여 농촌관광 편의시설을 유형화하였다. 그 다음으로 군집분석에 사용되는 변인이 범주형 변인이 있을 경우 전통적인 군집분석 방법을 적용할 수 없기 때문에 2단계 군집분석을 하였다. 본 연구는 2단계 군집분석법이 범주형 변인으로 측정된 농촌관광의 편의시설을 유형화하는 데 매우 유용하다는 것을 보여 주고 있다. 다중로짓 모형을 사용하여 특정 편의시설 유형을 선호할 확률에 영향을 미치는 농촌관광 방문자의 사회인구학적 특성과 여행특성을 규명하였다. 즉, 다중로짓 모형을 통해 참조항(일반농가형)으로 설정된 편의시설 유형에 비해 특정 편의시설을 선호할 확률에 영향을 미치는 소비자의 특성을 규명할 수 있다는 것이 본 연구의 특징이다.

  • PDF

정보이론 관점에서 본 서울시 지역구간의 미세먼지 영향력 재조명 (A Reexamination on the Influence of Fine-particle between Districts in Seoul from the Perspective of Information Theory)

  • 이재구;이태훈;윤성로
    • 정보과학회 컴퓨팅의 실제 논문지
    • /
    • 제21권2호
    • /
    • pp.109-114
    • /
    • 2015
  • 본 논문에서는 서울시에 속하는 25개의 지역구로부터 측정된 미세먼지 시계열(time series) 정보의 상관도를 정보이론(information theory)의 엔트로피(entropy)로 정량화하고, 이를 그래프로 표현하는 서울시 지역구 미세먼지 전이 모델을 만들어 지역별 유사성과 영향력을 분석하는 방법을 제안한다. 먼저, 각각의 미세먼지 농도 시계열을 가지는 지역구의 모든 쌍마다 전이 엔트로피(transfer entropy)를 계산하여 그래프의 노드간 연결 강도를 구한다. 이 그래프에 전통적인 커뮤니티 검출(community detection) 기법인 모듈성 기반 군집화(on modularity-based clustering) 알고리즘을 적용하여 전체 지역구들에 생성되는 커뮤니티를 검출하였다. 이를 통해 지역적인 근접 정도가 높은 지역과 차량 이동이 많은 지역 간의 미세 먼지 전이성이 높은 것을 확인하였으며, 더불어 제안된 방법은 기존 미세먼지의 기상모델 분석과 다른 정보이론 관점에서의 새로운 미세먼지 분석 방법의 고찰 및 향상된 미세먼지 분석 자료 생성에 활용될 것으로 기대된다.

머신 러닝을 사용한 이미지 클러스터링: K-means 방법을 사용한 InceptionV3 연구 (Image Clustering Using Machine Learning : Study of InceptionV3 with K-means Methods.)

  • 닌담 솜사우트;이효종
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2021년도 추계학술발표대회
    • /
    • pp.681-684
    • /
    • 2021
  • In this paper, we study image clustering without labeling using machine learning techniques. We proposed an unsupervised machine learning technique to design an image clustering model that automatically categorizes images into groups. Our experiment focused on inception convolutional neural networks (inception V3) with k-mean methods to cluster images. For this, we collect the public datasets containing Food-K5, Flowers, Handwritten Digit, Cats-dogs, and our dataset Rice Germination, and the owner dataset Palm print. Our experiment can expand into three-part; First, format all the images to un-label and move to whole datasets. Second, load dataset into the inception V3 extraction image features and transferred to the k-mean cluster group hold on six classes. Lastly, evaluate modeling accuracy using the confusion matrix base on precision, recall, F1 to analyze. In this our methods, we can get the results as 1) Handwritten Digit (precision = 1.000, recall = 1.000, F1 = 1.00), 2) Food-K5 (precision = 0.975, recall = 0.945, F1 = 0.96), 3) Palm print (precision = 1.000, recall = 0.999, F1 = 1.00), 4) Cats-dogs (precision = 0.997, recall = 0.475, F1 = 0.64), 5) Flowers (precision = 0.610, recall = 0.982, F1 = 0.75), and our dataset 6) Rice Germination (precision = 0.997, recall = 0.943, F1 = 0.97). Our experiment showed that modeling could get an accuracy rate of 0.8908; the outcomes state that the proposed model is strongest enough to differentiate the different images and classify them into clusters.

FMS에서의 작업부하균형을 고려한 기계부하결정 (Machine Loading by Workload Balancing in Flexible Manufacturing Systems)

  • 윤영수;이상용
    • 품질경영학회지
    • /
    • 제20권2호
    • /
    • pp.129-136
    • /
    • 1992
  • This paper aims to develope an algorithm to minimize the total production time, sum of group formation times and processing times, under the balanced workload among the machines by grouping parts with machine loading in FMS. The algorithm of this study is composed of four step procedures ; (1) Parts grouping by Group Technology(GT) (2) Minimizing total processing time in loading problem (3) Machine workload balancing, including above(2) (4) Group formation time, including above(3) For parts grouping, Rank Order Clustering(ROC) algorithm developed by King(1980) is used and this algorithm is programmed by using the MACRO functions of QUATTRO Pro, one of the spreadsheet packages. The structure for loading model is solved by using the Hyper-LINDO. As a case study, numerical examples are demonstrated to show the effectiveness of the proposed machine loading procedure.

  • PDF

다단계 특징벡터 기반의 분류기 모델 (Multistage Feature-based Classification Model)

  • 송영수;박동철
    • 전자공학회논문지CI
    • /
    • 제46권1호
    • /
    • pp.121-127
    • /
    • 2009
  • 본 논문은 다단계 특징벡터를 이용한 분류기 모델(Multistage Feature-based Classification Model: MFCM)을 제안하는데, MFCM은 주어진 데이터에서 추출된 특징벡터 전체를 한 번에 이용하지 않고, 같은 성질들의 특징벡터들끼리 모아서, 여러 단계에 걸쳐서 분류에 이용한다. 학습단계에서, 같은 성질을 가지는 특징벡터 그룹 각각을 이용하는 국지적 분류기의 분류 정확도 산출을 통해 각 특징벡터그룹의 기여도를 측정한다. 분류단계에서는 각 특징벡터그룹의 기여도에 따라 차등적으로 가중치를 적용하여 최종적인 분류결론을 이끌어 낸다. 본 논문에서는 MFCM의 개념을 기존의 몇 가지 분류 알고리즘에 적용하고, 음악 장르 분류 문제에 응용하여, 제안된 알고리즘의 유용성에 관한 실험을 수행하였다. 실험의 결과 제안된 MFCM을 이용하는 분류기는 기존의 알고리즘과 비교하여 분류정확도에서 평균적으로 7%-13%의 성능향상을 보여준다.

Prognostic Evaluation of Categorical Platelet-based Indices Using Clustering Methods Based on the Monte Carlo Comparison for Hepatocellular Carcinoma

  • Guo, Pi;Shen, Shun-Li;Zhang, Qin;Zeng, Fang-Fang;Zhang, Wang-Jian;Hu, Xiao-Min;Zhang, Ding-Mei;Peng, Bao-Gang;Hao, Yuan-Tao
    • Asian Pacific Journal of Cancer Prevention
    • /
    • 제15권14호
    • /
    • pp.5721-5727
    • /
    • 2014
  • Objectives: To evaluate the performance of clustering methods used in the prognostic assessment of categorical clinical data for hepatocellular carcinoma (HCC) patients in China, and establish a predictable prognostic nomogram for clinical decisions. Materials and Methods: A total of 332 newly diagnosed HCC patients treated with hepatic resection during 2006-2009 were enrolled. Patients were regularly followed up at outpatient clinics. Clustering methods including the Average linkage, k-modes, fuzzy k-modes, PAM, CLARA, protocluster, and ROCK were compared by Monte Carlo simulation, and the optimal method was applied to investigate the clustering pattern of the indices including platelet count, platelet/lymphocyte ratio (PLR) and serum aspartate aminotransferase activity/platelet count ratio index (APRI). Then the clustering variable, age group, tumor size, number of tumor and vascular invasion were studied in a multivariable Cox regression model. A prognostic nomogram was constructed for clinical decisions. Results: The ROCK was best in both the overlapping and non-overlapping cases performed to assess the prognostic value of platelet-based indices. Patients with categorical platelet-based indices significantly split across two clusters, and those with high values, had a high risk of HCC recurrence (hazard ratio [HR] 1.42, 95% CI 1.09-1.86; p<0.01). Tumor size, number of tumor and blood vessel invasion were also associated with high risk of HCC recurrence (all p< 0.01). The nomogram well predicted HCC patient survival at 3 and 5 years. Conclusions: A cluster of platelet-based indices combined with other clinical covariates could be used for prognosis evaluation in HCC.

신경망을 이용한 제조셀 형성 알고리듬 (A Manufacturing Cell Formantion Algorithm Using Neural Networks)

  • 이준한;김양렬
    • 경영과학
    • /
    • 제16권1호
    • /
    • pp.157-171
    • /
    • 1999
  • In a increasingly competitive marketplace, the manufacturing companies have no choice but looking for ways to improve productivity to sustain their competitiveness and survive in the industry. Recently cellular manufacturing has been under discussion as an option to be easily implemented without burdensome capital investment. The objective of cellular manufacturing is to realize many aspects of efficiencies associated with mass production in the less repetitive job-shop production systems. The very first step for cellular manufacturing is to group the sets of parts having similar processing requirements into part families, and the equipment needed to process a particular part family into machine cells. The underlying problem to determine the part and machine assignments to each manufacturing cell is called the cell formation. The purpose of this study is to develop a clustering algorithm based on the neural network approach which overcomes the drawbacks of ART1 algorithm for cell formation problems. In this paper, a generalized learning vector quantization(GLVQ) algorithm was devised in order to transform a 0/1 part-machine assignment matrix into the matrix with diagonal blocks in such a way to increase clustering performance. Furthermore, an assignment problem model and a rearrangement procedure has been embedded to increase efficiency. The performance of the proposed algorithm has been evaluated using data sets adopted by prior studies on cell formation. The proposed algorithm dominates almost all the cell formation reported so far, based on the grouping index($\alpha$ = 0.2). Among 27 cell formation problems investigated, the result by the proposed algorithm was superior in 11, equal 15, and inferior only in 1.

  • PDF

심전도 신호의 자동분석을 위한 자기회귀모델 변수추정과 패턴분류 (The Auto Regressive Parameter Estimation and Pattern Classification of EKS Signals for Automatic Diagnosis)

  • 이윤선;윤형로
    • 대한의용생체공학회:의공학회지
    • /
    • 제9권1호
    • /
    • pp.93-100
    • /
    • 1988
  • The Auto Regressive Parameter Estimation and Pattern Classification of EKG Signal for Automatic Diagnosis. This paper presents the results from pattern discriminant analysis of an AR (auto regressive) model parameter group, which represents the HRV (heart rate variability) that is being considered as time series data. HRV data was extracted using the correct R-point of the EKG wave that was A/D converted from the I/O port both by hardware and software functions. Data number (N) and optimal (P), which were used for analysis, were determined by using Burg's maximum entropy method and Akaike's Information Criteria test. The representative values were extracted from the distribution of the results. In turn, these values were used as the index for determining the range o( pattern discriminant analysis. By carrying out pattern discriminant analysis, the performance of clustering was checked, creating the text pattern, where the clustering was optimum. The analysis results showed first that the HRV data were considered sufficient to ensure the stationarity of the data; next, that the patern discrimimant analysis was able to discriminate even though the optimal order of each syndrome was dissimilar.

  • PDF

위키피디어 기반 개념 공간을 가지는 시멘틱 텍스트 모델 (A Semantic Text Model with Wikipedia-based Concept Space)

  • 김한준;장재영
    • 한국전자거래학회지
    • /
    • 제19권3호
    • /
    • pp.107-123
    • /
    • 2014
  • 텍스트마이닝 연구의 기본적인 난제는 기존 텍스트 표현모델이 자연어 문장으로 기술된 텍스트 데이터로부터 의미 또는 개념 정보를 표현하지 않는데 기인한다. 기존 텍스트 표현모델인 벡터공간 모델(vector space model), 불리언 모델(Boolean model), 통계 모델(statistical model), 텐서공간 모델(tensor space model) 등은 'Bag-of-Words' 방식에 바탕을 두고 있다. 이러한 텍스트 모델들은 텍스트에 포함된 단어와 그것의 출현 횟수만으로 텍스트를 표현하므로, 단어의 함축 의미, 단어의 순서 및 텍스트의 구조를 전혀 표현하지 못한다. 대부분의 텍스트 마이닝 기술은 대상 문서를 'Bag-of-Words' 방식의 텍스트 모델로 표현함을 전제로 하여 발전하여 왔다. 하지만 오늘날 빅데이터 시대를 맞이하여 방대한 규모의 텍스트 데이터를 보다 정밀하게 분석할 수 있는 새로운 패러다임의 표현모델을 요구하고 있다. 본 논문에서 제안하는 텍스트 표현모델은 개념공간을 문서 및 단어와 동등한 매핑 공간으로 상정하여, 그 세 가지 공간에 대한 연관 관계를 모두 표현한다. 개념공간의 구성을 위해서 위키피디어 데이터를 활용하며, 하나의 개념은 하나의 위키피디어 페이지로부터 정의된다. 결과적으로 주어진 텍스트 문서집합을 의미적으로 해석이 가능한 3차 텐서(3-order tensor)로 표현하게 되며, 따라서 제안 모델을 텍스트 큐보이드 모델이라 명명한다. 20Newsgroup 문서집합을 사용하여 문서 및 개념 수준의 클러스터링 정확도를 평가함으로써, 제안 모델이 'Bag-of-Word' 방식의 대표적 모델인 벡터공간 모델에 비해 우수함을 보인다.

Robust PCA를 활용한 이공계 대학생의 확률 및 통계 개념 이해도 분석 (Clustering Analysis of Science and Engineering College Students' understanding on Probability and Statistics)

  • 유용석
    • 융합정보논문지
    • /
    • 제12권3호
    • /
    • pp.252-258
    • /
    • 2022
  • 본 연구에서는 실제 대학의 소규모 강좌에서 확률과 통계에 대한 수강생들의 이해도를 쉽고 빠르게 분석하기 위한 방법을 제안한다. 95명의 이공계 대학생을 대상으로 확률과 통계에 대한 컴퓨터 기반 검사를 시행하였다. 학생들의 응답을 Robust PCA와 가우시안 혼합 모델을 사용하여 7개의 군집으로 나눈 뒤, 각 군집 별로 주제별 성취도를 분석하였다. 상위권 군집은 통계적 추정을 제외한 다른 주제들에 대해서 대체로 높은 성취도를 보였으며, 저성취 군집들은 서로 다른 주제에 대해서 강약점을 보였다. 제안하는 기법은 기존에 널리 쓰이는 PCA를 사용하여 차원 축소 후 군집 분석을 수행한 것 보다 각 군집들의 특성이 더 분명하게 나타냈다. 이는 각 군집 별 특징에 따른 개별화된 학습 전략을 개발하는 데 활용될 수 있다.