• 제목/요약/키워드: Feature Weighting

검색결과 127건 처리시간 0.028초

한의학 고문헌 텍스트에서의 저자 판별 - 기능어의 역할을 중심으로 - (A Comparative Study of Feature Extraction Methods for Authorship Attribution in the Text of Traditional East Asian Medicine with a Focus on Function Words)

  • 오준호
    • 대한한의학원전학회지
    • /
    • 제33권2호
    • /
    • pp.51-59
    • /
    • 2020
  • Objectives : We would like to study what is the most appropriate "feature" to effectively perform authorship attribution of the text of Traditional East Asian Medicine Methods : The authorship attribution performance of the Support Vector Machine (SVM) was compared by cross validation, depending on whether the function words or content words, single word or collocations, and IDF weights were applied or not, using 'Variorum of the Nanjing' as an experimental Corpus. Results : When using the combination of 'function words/uni-bigram/TF', the performance was best with accuracy of 0.732, and the combination of 'content words/unigram/TFIDF' showed the lowest accuracy of 0.351. Conclusions : This shows the following facts from the authorship attribution of the text of East Asian traditional medicine. First, function words play an important role in comparison to content words. Second, collocations was relatively important in content words, but single words have more important meanings in function words. Third, unlike general text analysis, IDF weighting resulted in worse performance.

온라인 결함계측용 협대역 제거형 공간필터의 최적설계 및 제작 (Optical Design and Construction of Narrow Band Eliminating Spatial Filter for On-line Defect Detection)

  • 전승환
    • 한국항해학회지
    • /
    • 제22권4호
    • /
    • pp.59-67
    • /
    • 1998
  • A quick and automatic detection with no harm to the goods is very important task for improving quality control, process control and labour reduction. In real fields of industry, defect detection is mostly accomplished by skillful workers. A narrow band eliminating spatial filter having characteristics of removing the specified spatial frequency is developed by the author, and it is proved that the filter has an excellent ability for on-line and real time detection of surface defect. By the way,. this spatial filter shows a ripple phenominum in filtering characteristics. So, it is necessary to remove the ripple component for the improvement of filter gain, moreover efficiency of defect detection. The spatial filtering method has a remarkable feature which means that it is able to set up weighting function for its own sake, and which can to obtain the best signal relating to the purpose of the measurement. Hence, having an eye on such feature, theoretical analysis is carried out at first for optimal design of narrow band eliminating spatial filter, and secondly, on the basis of above results spatial filter is manufactured, and finally advanced effectiveness of spatial filter is evaluated experimentally.

  • PDF

Fault Detection of a Proposed Three-Level Inverter Based on a Weighted Kernel Principal Component Analysis

  • Lin, Mao;Li, Ying-Hui;Qu, Liang;Wu, Chen;Yuan, Guo-Qiang
    • Journal of Power Electronics
    • /
    • 제16권1호
    • /
    • pp.182-189
    • /
    • 2016
  • Fault detection is the research focus and priority in this study to ensure the high reliability of a proposed three-level inverter. Kernel principal component analysis (KPCA) has been widely used for feature extraction because of its simplicity. However, highlighting useful information that may be hidden under retained KPCs remains a problem. A weighted KPCA is proposed to overcome this shortcoming. Variable contribution plots are constructed to evaluate the importance of each KPC on the basis of sensitivity analysis theory. Then, different weighting values of KPCs are set to highlight the useful information. The weighted statistics are evaluated comprehensively by using the improved feature eigenvectors. The effectiveness of the proposed method is validated. The diagnosis results of the inverter indicate that the proposed method is superior to conventional KPCA.

간소화된 주성분 벡터를 이용한 벡터 그래픽 캐릭터의 얼굴표정 생성 (The facial expression generation of vector graphic character using the simplified principle component vector)

  • 박태희
    • 한국정보통신학회논문지
    • /
    • 제12권9호
    • /
    • pp.1547-1553
    • /
    • 2008
  • 본 논문은 간소화된 주성분 벡터를 이용한 벡터 그래픽 캐릭터의 다양한 얼굴 표정 생성 방법을 제안한다. 먼저 Russell의 내적 정서 상태에 기반하여 재정의된 벡터 그래픽 캐릭터들의 9가지 표정에 대해 주성분 분석을 수행한다. 이를 통해 캐릭터의 얼굴 특성과 표정에 주된 영향을 미치는 주성분 벡터를 찾아내고, 간소화된 주성분 벡터로부터 얼굴 표정을 생성한다. 또한 캐릭터의 특성과 표정의 가중치 값을 보간함으로써 자연스러운 중간 캐릭터 및 표정을 생성한다. 이는 얼굴 애니메이션에서 종래의 키프레임 저장 공간을 상당히 줄일 수 있으며, 적은 계산량으로 중간 표정을 생성할 수 있다. 이에 실시간 제어를 요구하는 웹/모바일 서비스, 게임 등에서 캐릭터 생성 시스템의 성능을 상당히 개선할 수 있다.

영상 클레스별 중요 특징 가중에 의한 영상 검색 방법 (Image Retrieval by Important Feature Weighting for Each Class)

  • 유동근;박채훈;최유경;권인소
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2012년도 춘계학술발표대회
    • /
    • pp.382-385
    • /
    • 2012
  • 이 논문에서는 영상 검색(image retrieval) 및 영상 부류(image categorization)을 위하여 영상을 기술할 때 영상의 클레스(class)별로 서로 다른 주요 특징량(feature)에 가중치 를 주는 방법론을 제안한다. 기존에 연구되어온 영상의 특징량 벡터에 가중치를 주는 방식은 모든 영상 클레스에 대하여 동일하게 가중치를 적용하기 때문에 영상이 클레스별로 서로 다른 특징량이 중요하다는 성질을 이용할 수 없다. 영상이 클레 별로 서로 다른 특징량이 중요하다는 성질을 이용하기 위하여 영상의 클레스별로 특징량 벡터에 서로 다른 가중치 벡터(weight vector)를 학습하였다. 그 후 질의 영상(query image)이 입력되면, 기존의 영상 검색 프레임워크(framework)를 통해 데이터베이 스(database)로 부터 미리 정의된 서브 클레스(sub-class)의 수에 해당하는 영상부 집합(subset)을 만들었다. 그리고 영상부 집합의 특징량 벡터들에 클레스별로 각각 학습된 가중치 벡터를 적용하여 특징량 벡터들 간의 거리를 다시 계산하여 리랭킹(re-ranking)하였다. 이 방법론을 UKBench Dataset에 적용하여 실험을 해보았으며 가중치를 주기 전과 비교 하였을 때 더 높은 정확도를 보였다.

Breast Cytology Diagnosis using a Hybrid Case-based Reasoning and Genetic Algorithms Approach

  • Ahn, Hyun-Chul;Kim, Kyoung-Jae
    • 한국지능정보시스템학회:학술대회논문집
    • /
    • 한국지능정보시스템학회 2007년도 한국지능정보시스템학회
    • /
    • pp.389-398
    • /
    • 2007
  • Case-based reasoning (CBR) is one of the most popular prediction techniques for medical diagnosis because it is easy to apply, has no possibility of overfitting, and provides a good explanation for the output. However, it has a critical limitation - its prediction performance is generally lower than other artificial intelligence techniques like artificial neural networks (ANNs). In order to obtain accurate results from CBR, effective retrieval and matching of useful prior cases for the problem is essential, but it is still a controversial issue to design a good matching and retrieval mechanism for CBR systems. In this study, we propose a novel approach to enhance the prediction performance of CBR. Our suggestion is the simultaneous optimization of feature weights, instance selection, and the number of neighbors that combine using genetic algorithms (GAs). Our model improves the prediction performance in three ways - (1) measuring similarity between cases more accurately by considering relative importance of each feature, (2) eliminating redundant or erroneous reference cases, and (3) combining several similar cases represent significant patterns. To validate the usefulness of our model, this study applied it to a real-world case for evaluating cytological features derived directly from a digital scan of breast fine needle aspirate (FNA) slides. Experimental results showed that the prediction accuracy of conventional CBR may be improved significantly by using our model. We also found that our proposed model outperformed all the other optimized models for CBR using GA.

  • PDF

Application of cost-sensitive LSTM in water level prediction for nuclear reactor pressurizer

  • Zhang, Jin;Wang, Xiaolong;Zhao, Cheng;Bai, Wei;Shen, Jun;Li, Yang;Pan, Zhisong;Duan, Yexin
    • Nuclear Engineering and Technology
    • /
    • 제52권7호
    • /
    • pp.1429-1435
    • /
    • 2020
  • Applying an accurate parametric prediction model to identify abnormal or false pressurizer water levels (PWLs) is critical to the safe operation of marine pressurized water reactors (PWRs). Recently, deep-learning-based models have proved to be a powerful feature extractor to perform high-accuracy prediction. However, the effectiveness of models still suffers from two issues in PWL prediction: the correlations shifting over time between PWL and other feature parameters, and the example imbalance between fluctuation examples (minority) and stable examples (majority). To address these problems, we propose a cost-sensitive mechanism to facilitate the model to learn the feature representation of later examples and fluctuation examples. By weighting the standard mean square error loss with a cost-sensitive factor, we develop a Cost-Sensitive Long Short-Term Memory (CSLSTM) model to predict the PWL of PWRs. The overall performance of the CSLSTM is assessed by a variety of evaluation metrics with the experimental data collected from a marine PWR simulator. The comparisons with the Long Short-Term Memory (LSTM) model and the Support Vector Regression (SVR) model demonstrate the effectiveness of the CSLSTM.

온라인 동향 분석을 위한 이벤트 문장 추출 방안 (Event Sentence Extraction for Online Trend Analysis)

  • 윤보현
    • 한국콘텐츠학회논문지
    • /
    • 제12권9호
    • /
    • pp.9-15
    • /
    • 2012
  • 기존의 이벤트 문장 추출에 관한 연구는 학습단계에서 3W 자질을 학습하지 않고, 추출단계에서 3W 자질의 존재여부에 따른 규칙만을 적용하여 이벤트 문장을 추출하였다. 본 논문에서는 온라인 동향 분석을 위해 학습단계에서 3W 자질을 추출하고 가중치를 계산하고, 추출단계에서 3W 자질을 반영하는 문장 가중치 기반 이벤트 문장 추출 방안을 제시한다. 실험결과, 자질필터링은 $TF{\times}IDF$ 가중치 기법을 사용한 상위 30% 자질만을 사용하는 것이 가장 우수한 결과를 보였다. 공공이슈 분야인 부동산 도메인에서 문장 가중치 기반 방법은 3W 자질 중 who와 when 자질이 가장 영향을 많이 미치는 것으로 나타났다. 아울러 다른 기계학습 방법과의 비교하여 공공이슈 분야인 부동산 도메인에서 문장 가중치 기반 이벤트 문장 추출 방법이 가장 좋은 성능을 보였다.

하이브리드 신뢰도를 이용한 제한 영역 핵심어 검출 성능향상 (Improvement of Domain-specific Keyword Spotting Performance Using Hybrid Confidence Measure)

  • 이경록;서현철;최승호;최승호;김진영
    • 한국음향학회지
    • /
    • 제21권7호
    • /
    • pp.632-640
    • /
    • 2002
  • 본 논문에서는 기존의 RLJ-신뢰도 (RLJ-confidence measure)와 정규화 신뢰도 (normalized CM)의 단점을 보완하기 위해 ACM (Anti-filler CM)을 제안하였고, HCM (hybrid CM)을 이용하여 기존의 NCM과 제안한 ACM을 통합하였다. 제안된 ACM은 기존 신뢰도의 단점 중 하나인 오인증 (FA: false acceptance)의 원인이 반음소 모델의 구성방법에 있다고 보고 음소 인식기를 이용하여 실제 음소 수열을 추정한 다음, 이를 반음소 모델로 정의하고 신뢰도를 계산하였다. 두 가지 신뢰도의 특성을 살펴보면, 기존 NCM(FR: false rejection)에 좋은 성능을 보이고, 제안한 ACM은 FA에서 좋은 성능을 보여 두 신뢰도가 상보적인 특성을 가진다 이를 이용하여 두 가지 신뢰도를 가중치 벡터 α를 이용하여 통합하고 이를 합성 신뢰도 (HCM: Hybrid CM)라고 정의하였다. 실험결과 미검출율 (MDR: missed detection rate) 10%부근에서, HCM 적용시에 0.219 FA/KW/HR (false alarm/keyword/how)로서 NCM 단독사용에 비해 성능이 22% 향상되었다.

이진 단일 패턴과 곡률의 투영벡터를 이용한 이륜차 검출 (Two-wheeler Detection using the Local Uniform Projection Vector based on Curvature Feature)

  • 이영학;김태선;심재창
    • 한국멀티미디어학회논문지
    • /
    • 제18권11호
    • /
    • pp.1302-1312
    • /
    • 2015
  • Recent research has been devoted and focused on detecting pedestrian and vehicle in intelligent vehicles except for the vulnerable road user(VRUS). In this paper suggest a new projection method which has robustness for rotation invariant and reducing dimensionality for each cell from original image to detect two-wheeler. We applied new weighting values which are calculated by maximum curvature containing very important object shape features and uniform local binary pattern to remove the noise. This paper considered the Adaboost algorithm to make a strong classification from weak classification. Experiment results show that the new approach gives higher detection accuracy than of the conventional method.