• 제목/요약/키워드: Dirichlet Process

검색결과 72건 처리시간 0.033초

공원 이슈에 대한 주요 언론의 담론변화분석 - 1995년부터 2019년까지 신문 기사를 중심으로 - (Analysis of Changes in Discourse of Major Media on Park Issues - Focusing on Newspaper Articles Published from 1995 to 2019 -)

  • 고하정
    • 한국조경학회지
    • /
    • 제49권5호
    • /
    • pp.46-58
    • /
    • 2021
  • 국내에 근대식 공원이 도입된 이후, 공원은 우리에게 필수적인 존재가 되었다. 민선시기 이후, 공원조성 등 공원을 둘러싼 이슈가 생산되고 언론을 통해 확산되어 담론을 형성하는 과정을 거쳤다. 이에 본 연구는 민선시장 체제인 1995년 이후의 '공원' 관련 이슈를 다룬 국내 중앙지의 보도기사를 수집하여 토픽분석과 의미연결망 분석을 통해 공원에 대한 시계열적 담론 변화 추이를 분석하였다. LDA 토픽모델링 분석결과, 5개의 토픽-도시공원확충(토픽1), 역사문화공원(토픽2), 이용프로그램(토픽3), 동물원 사건사고(토픽4), 공원조성과정갈등(토픽5)-으로 분류되었다. 언론에서 다룬 주요 공원담론은 다음과 같다. 첫째, 공원의 양적 확장에 대한 조성과정과 갈등이 주요 담론으로 다뤄지고 있다. 둘째, 신규 공원 조성시마다 공원명이 신규 단어로 출현하고 이후 지속적으로 언급되면서 담론형성에 한 축을 담당하고 있다. 셋째, 민선시대 공원 관련 언론에서 '주민'은 주요 주체로 '도시', '환경'과 함께 언급되며, 공원의 공공성에 대한 담론을 형성하고 있다. 본 연구는 공원이 언론을 통해 어떻게 해석되는지 담론변화를 살펴보았다는 점에서 의의를 가진다. 추후 본 연구에서 다룬 중앙지 외에 지역지, 전문지 등 다른 매체에 대한 연구를 통해 공원에 대한 다양한 관점의 담론이 다뤄지길 기대한다.

Non-Simultaneous Sampling Deactivation during the Parameter Approximation of a Topic Model

  • Jeong, Young-Seob;Jin, Sou-Young;Choi, Ho-Jin
    • KSII Transactions on Internet and Information Systems (TIIS)
    • /
    • 제7권1호
    • /
    • pp.81-98
    • /
    • 2013
  • Since Probabilistic Latent Semantic Analysis (PLSA) and Latent Dirichlet Allocation (LDA) were introduced, many revised or extended topic models have appeared. Due to the intractable likelihood of these models, training any topic model requires to use some approximation algorithm such as variational approximation, Laplace approximation, or Markov chain Monte Carlo (MCMC). Although these approximation algorithms perform well, training a topic model is still computationally expensive given the large amount of data it requires. In this paper, we propose a new method, called non-simultaneous sampling deactivation, for efficient approximation of parameters in a topic model. While each random variable is normally sampled or obtained by a single predefined burn-in period in the traditional approximation algorithms, our new method is based on the observation that the random variable nodes in one topic model have all different periods of convergence. During the iterative approximation process, the proposed method allows each random variable node to be terminated or deactivated when it is converged. Therefore, compared to the traditional approximation ways in which usually every node is deactivated concurrently, the proposed method achieves the inference efficiency in terms of time and memory. We do not propose a new approximation algorithm, but a new process applicable to the existing approximation algorithms. Through experiments, we show the time and memory efficiency of the method, and discuss about the tradeoff between the efficiency of the approximation process and the parameter consistency.

커뮤니티 기반 Q&A서비스에서의 질의 할당을 위한 이용자의 관심 토픽 분석에 관한 연구 (A Study on Mapping Users' Topic Interest for Question Routing for Community-based Q&A Service)

  • 박종도
    • 정보관리학회지
    • /
    • 제32권3호
    • /
    • pp.397-412
    • /
    • 2015
  • 본 연구에서는 커뮤니티 기반 질의응답 서비스에서의 질의할당을 위하여, 해당 커뮤니티에 축적된 질의응답 데이터 세트를 이용하여 해당 카테고리내의 토픽을 분석하고 이를 바탕으로 해당 토픽에 관심을 가지는 이용자의 관심 토픽을 분석하고자 하였다. 특정 카테고리 내의 토픽을 분석하기 위해서 LDA기법을 사용하였고 이를 이용하여 이용자의 관심 토픽을 모델링하였다. 나아가, 커뮤니티에 새롭게 유입되는 질의에 대한 토픽을 분석한 후, 이를 바탕으로 해당 토픽에 대해 관심을 가지고 있는 이용자를 추천하기 위한 일련의 방법들을 실험하였다.

Topic Extraction and Classification Method Based on Comment Sets

  • Tan, Xiaodong
    • Journal of Information Processing Systems
    • /
    • 제16권2호
    • /
    • pp.329-342
    • /
    • 2020
  • In recent years, emotional text classification is one of the essential research contents in the field of natural language processing. It has been widely used in the sentiment analysis of commodities like hotels, and other commentary corpus. This paper proposes an improved W-LDA (weighted latent Dirichlet allocation) topic model to improve the shortcomings of traditional LDA topic models. In the process of the topic of word sampling and its word distribution expectation calculation of the Gibbs of the W-LDA topic model. An average weighted value is adopted to avoid topic-related words from being submerged by high-frequency words, to improve the distinction of the topic. It further integrates the highest classification of the algorithm of support vector machine based on the extracted high-quality document-topic distribution and topic-word vectors. Finally, an efficient integration method is constructed for the analysis and extraction of emotional words, topic distribution calculations, and sentiment classification. Through tests on real teaching evaluation data and test set of public comment set, the results show that the method proposed in the paper has distinct advantages compared with other two typical algorithms in terms of subject differentiation, classification precision, and F1-measure.

Stochastic Mixture Modeling of Driving Behavior During Car Following

  • Angkititrakul, Pongtep;Miyajima, Chiyomi;Takeda, Kazuya
    • Journal of information and communication convergence engineering
    • /
    • 제11권2호
    • /
    • pp.95-102
    • /
    • 2013
  • This paper presents a stochastic driver behavior modeling framework which takes into account both individual and general driving characteristics as one aggregate model. Patterns of individual driving styles are modeled using a Dirichlet process mixture model, as a non-parametric Bayesian approach which automatically selects the optimal number of model components to fit sparse observations of each particular driver's behavior. In addition, general or background driving patterns are also captured with a Gaussian mixture model using a reasonably large amount of development data from several drivers. By combining both probability distributions, the aggregate driver-dependent model can better emphasize driving characteristics of each particular driver, while also backing off to exploit general driving behavior in cases of unseen/unmatched parameter spaces from individual training observations. The proposed driver behavior model was employed to anticipate pedal operation behavior during car-following maneuvers involving several drivers on the road. The experimental results showed advantages of the combined model over the model adaptation approach.

토픽 모델링을 이용한 지속가능패션 연구 동향 분석 (Analysis of sustainable fashion research trends using topic modeling)

  • 이하나
    • 복식문화연구
    • /
    • 제29권4호
    • /
    • pp.538-553
    • /
    • 2021
  • As interest in the sustainable fashion industry continues to increase along with climate issues, it is necessary to identify research trends in sustainable fashion and seek new development directions. Therefore, this study aims to analyze research trends on sustainable fashion. For this purpose, related papers were collected from the KCI (Korean Citation Index) and Scopus, and 340 articles were used for the study. The collected data went through data transformation, data preprocessing, topic modeling analysis, core topic derivation, and visualization through a Python algorithm. A total of eight topics were obtained from the comprehensive analysis: consumer clothing consumption behavior and environment, upcycle product development, product types by environmental approach, ESG business activities, materials and material development, process-based approach, lifestyle and consumer experience, and brand strategy. Topics were related to consumption, production, and education of sustainable fashion, respectively. KCI analysis results and Scopus analysis results derived eight topics but showed differences from the comprehensive analysis results. This study provides primary data for exploring various themes of sustainable fashion. It is significant in that the data were analyzed based on probability using a research method that excluded the subjective value of the researcher. It is recommended that follow-up studies be conducted to examine social trends.

A pooled Bayes test of independence using restricted pooling model for contingency tables from small areas

  • Jo, Aejeong;Kim, Dal Ho
    • Communications for Statistical Applications and Methods
    • /
    • 제29권5호
    • /
    • pp.547-559
    • /
    • 2022
  • For a chi-squared test, which is a statistical method used to test the independence of a contingency table of two factors, the expected frequency of each cell must be greater than 5. The percentage of cells with an expected frequency below 5 must be less than 20% of all cells. However, there are many cases in which the regional expected frequency is below 5 in general small area studies. Even in large-scale surveys, it is difficult to forecast the expected frequency to be greater than 5 when there is small area estimation with subgroup analysis. Another statistical method to test independence is to use the Bayes factor, but since there is a high ratio of data dependency due to the nature of the Bayesian approach, the low expected frequency tends to decrease the precision of the test results. To overcome these limitations, we will borrow information from areas with similar characteristics and pool the data statistically to propose a pooled Bayes test of independence in target areas. Jo et al. (2021) suggested hierarchical Bayesian pooling models for small area estimation of categorical data, and we will introduce the pooled Bayes factors calculated by expanding their restricted pooling model. We applied the pooled Bayes factors using bone mineral density and body mass index data from the Third National Health and Nutrition Examination Survey conducted in the United States and compared them with chi-squared tests often used in tests of independence.

질점-용수철 기반변형/파괴 물체와 격자 기반 유체의 상호작용 시뮬레이션 기술 (Coupled simulation of grid-based fluid and mass-spring based deformation/fracture)

  • 김봉준;임재광;홍정모
    • 한국컴퓨터그래픽스학회논문지
    • /
    • 제20권4호
    • /
    • pp.9-16
    • /
    • 2014
  • 유체의 흐름과고체의 변형 및 파괴 현상이 어우러진 복잡한 자연 현상을 영상물로 만들어 내는 것은 각각의 물리 현상을 시뮬레이션 하는 기술들이 서로 상호작용할 수 있도록 결합되어야 가능하다. 본 논문에서는 질점-용수철 기반의 변형과 파괴가 가능한 물체와 격자 기반의유체가 서로 상호작용하는 시뮬레이션 기법을 제안한다. 이 기법은유체 간의 상호작용과 물체와 유체의 상호작용으로 나뉜다. 유체는 물과 연기로 구성되며 이들의 상호작용은 가변 밀도를 사용하는 기법과는 다르게 시뮬레이션을 두 단계로 나눠 진행한다. 먼저 유체 이류 이후의 경계 영역에 있는 물과 공기의 속도를 질량의 비율에 맞춰 혼합한다. 그리고 물의 프로젝션 과정에서 연기 영역을 Dirichlet 경계조건으로 설정하고 연기를 프로젝션 과정에서 물 영역을 Neumann 경계조건으로 설정하여 두 개의 문제로 분리한다. 유체를 독립적으로 풀기 때문에 상대적으로 높은 안정성을 기대할 수 있으며 프로젝션 과정에서 요구되는 셀의 개수가감소하여 수렴시키는데 필요한 계산 횟수가 줄어들어 효율적이다. 물체는 물과공기 모두 프로젝션을 할 때 기존의 강체와의 상호작용 기법과 유사하게 Neumann 경계조건으로 설정하지만 각 질점에 대하여 유체의 압력을 적분하기 때문에 유체의 움직임에 반응하는 변형과 파괴를 다룰 수 있다. 제안한 기법은 물리적으로 정밀한 결과를 제공하지는 않지만 영상 제작에서 필요한 다양한 시나리오의 시뮬레이션이 가능하며 논문에 제시된 다양한 결과는 이 기법이 효과적이라는 것을 보여준다.

Organic Light-Emitting Diodes 디스플레이 기술의 특허 동향과 기술적 가치에 관한 탐색적 연구 (An Exploratory research on patent trends and technological value of Organic Light-Emitting Diodes display technology)

  • 김민구;김용우;정태현;김영민
    • 지능정보연구
    • /
    • 제28권4호
    • /
    • pp.135-155
    • /
    • 2022
  • 본 연구는 Organic Light-Emitting Diodes(OLEDs) 산업의 하위기술 분야를 도출하여 특허 동향을 분석하고 각 하위기술 분야별 기술 가치, 독창성, 다양성을 분석한다. 특허 자료 수집을 위해 OLED 기술과 관련된 국제 특허 분류(International Patent Classification) 집합을 정의하고, 이를 활용해 2005년부터 2017년까지 출원된 OLED 연관 특허를 수집하였다. 이어서 토픽모델을 이용하여 대량의 특허 문서를 12가지 주요 기술로 구분하고 각 기술에 대한 동향을 조사하였다. 그중 터치 센서, 모듈, 이미지 처리, 회로 구동 관련 특허는 증가 추세를 보였으나 가상 현실, 사용자 인터페이스 관련 특허는 최근 감소하였고, 박막 트랜지스터, 지문 인식, 광학필름 관련 특허는 지속적인 추세를 보였다. 이후 각 기술 그룹에 포함된 특허의 전방 인용 수, 독창성, 다양성을 조사하여 기술적 가치를 비교하였다. 결과로부터 전방 인용 수, 독창성, 다양성이 높은 이미지 처리기술, UI/UX, 모듈 기술, 점착 기술 분야가 상대적으로 높은 기술적 가치를 보여주었다. 본 연구를 통해 기업의 기술 전략 수립과정에서 활용 가치가 높은 정보를 제공한다.

지방자치단체의 스마트시티 조례 분석: 토픽모델링을 활용하여 (Analysis of Municipal Ordinances for Smart Cities of Municipal Governments: Using Topic Modeling)

  • 서형준
    • 정보화정책
    • /
    • 제30권1호
    • /
    • pp.41-66
    • /
    • 2023
  • 본 연구는 72개 지자체의 74개 스마트시티 조례를 대상으로, 지자체 스마트시티 조례의 방향성을 확인하고자 토픽모델링을 활용하여 조례의 주요 키워드를 확인하고, 조례의 키워드에 따른 주제분류를 진행하였다. 분석결과 주요 키워드는 스마트도시위원회의 구성 및 운영에 관한 키워드가 조례 내에서 높은 빈도를 보였다. 조례에 대한 토픽모델링 Latent Dirichlet Allocation(LDA) 분석결과 관련 키워드에 따라 총 8개의 주제로 분류할 수 있었다. 구체적으로 주제-1(스마트시티 추진사항 보안), 주제-2(스마트시티 산업진흥), 주제-3(스마트시티 주민협의체 구성), 주제-4(스마트시티 추진체계 지원), 주제-5(개인정보 관리), 주제-6(스마트시티 데이터 활용), 주제-7(지능정보화 행정구현), 주제-8(스마트시티 홍보) 등으로, 주제의 비중은 주제-6, 주제-4, 주제-1 등의 순으로 나타났다. 권역별 주제분류는 수도권은 주제-5, 주제-6, 주제-8 의 비중이 높았고, 지방권은 주제-2, 주제-3, 주제-4의 비중이 높아 수도권은 스마트시티의 실질 운영 관련 주제가 높았고, 지방권은 스마트시티 추진을 위한 준비단계 관련 주제 비중이 높았다.