• 제목/요약/키워드: structured SVM

검색결과 17건 처리시간 0.019초

Fast Training of Structured SVM Using Fixed-Threshold Sequential Minimal Optimization

  • Lee, Chang-Ki;Jang, Myung-Gil
    • ETRI Journal
    • /
    • 제31권2호
    • /
    • pp.121-128
    • /
    • 2009
  • In this paper, we describe a fixed-threshold sequential minimal optimization (FSMO) for structured SVM problems. FSMO is conceptually simple, easy to implement, and faster than the standard support vector machine (SVM) training algorithms for structured SVM problems. Because FSMO uses the fact that the formulation of structured SVM has no bias (that is, the threshold b is fixed at zero), FSMO breaks down the quadratic programming (QP) problems of structured SVM into a series of smallest QP problems, each involving only one variable. By involving only one variable, FSMO is advantageous in that each QP sub-problem does not need subset selection. For the various test sets, FSMO is as accurate as an existing structured SVM implementation (SVM-Struct) but is much faster on large data sets. The training time of FSMO empirically scales between O(n) and O($n^{1.2}$), while SVM-Struct scales between O($n^{1.5}$) and O($n^{1.8}$).

  • PDF

다중-클래스 SVM 기반 야간 차량 검출 (Night-time Vehicle Detection Based On Multi-class SVM)

  • 임효진;이희용;박주현;정호열
    • 대한임베디드공학회논문지
    • /
    • 제10권5호
    • /
    • pp.325-333
    • /
    • 2015
  • Vision based night-time vehicle detection has been an emerging research field in various advanced driver assistance systems(ADAS) and automotive vehicle as well as automatic head-lamp control. In this paper, we propose night-time vehicle detection method based on multi-class support vector machine(SVM) that consists of thresholding, labeling, feature extraction, and multi-class SVM. Vehicle light candidate blobs are extracted by local mean based thresholding following by labeling process. Seven geometric and stochastic features are extracted from each candidate through the feature extraction step. Each candidate blob is classified into vehicle light or not by multi-class SVM. Four different multi-class SVM including one-against-all(OAA), one-against-one(OAO), top-down tree structured and bottom-up tree structured SVM classifiers are implemented and evaluated in terms of vehicle detection performances. Through the simulations tested on road video sequences, we prove that top-down tree structured and bottom-up tree structured SVM have relatively better performances than the others.

Structured SVM을 이용한 노래 가사의 감정 분류 (Lyric-based Emotion Classification using Structured SVM)

  • 김민호;권혁철
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2012년도 한국컴퓨터종합학술대회논문집 Vol.39 No.1(B)
    • /
    • pp.273-275
    • /
    • 2012
  • 노래(Song)와 같이 가사를 포함한 음악은 같은 스타일의 멜로디라도 청자에 따라 느끼는 감정이 다르다. 따라서 전통적인 음악 분류에서 사용하는 템포, 박자, 음정, 음표, 리듬과 같은 자질을 이용하여 감정을 분류할 수 없다. 본 연구에서는 가사로부터 감정 자질을 추출하고, 이를 학습 자질로 이용하여 노래 가사의 감정을 분류한다. 감정 자질의 추출 정확도를 높이고자, 한국어의 언어적 특징을 반영한 규칙을 구축한다. 추출된 감정 자질과 structured SVM을 이용하여 노래 가사의 감정을 분류한 결과, Naive Bayes나 SVM과 같은 전통적인 학습 기법보다 높은 성능(accuracy = 68.9%)을 보였다.

Structural SVM 기반의 한국어 의미역 결정 (Korean Semantic Role Labeling Using Structured SVM)

  • 이창기;임수종;김현기
    • 정보과학회 논문지
    • /
    • 제42권2호
    • /
    • pp.220-226
    • /
    • 2015
  • 의미역 결정은 자연어 문장의 서술어와 그 서술어에 속하는 논항들 사이의 의미관계를 결정하는 문제이다. 일반적으로 의미역 결정을 위해서는 서술어 인식(Predicate Identification, PI), 서술어 분류(Predicate Classification, PC), 논항 인식(Argument Identification, AI) 논항 분류(Argument Classification, AC) 단계가 수행된다. 본 논문에서는 한국어 의미역 결정 문제를 위해 Korean Propbank를 의미역 결정 학습 말뭉치로 사용하고, 의미역 결정 문제를 Sequence Labeling 문제로 바꾸어 이 문제에서 좋은 성능을 보이는 Structural SVM을 이용하였다. 실험결과 서술어 인식/분류(Predicate Identification and Classification, PIC)에서는 97.13%(F1)의 성능을 보였고, 논항 인식/분류(Argument Identification and Classification, AIC)에서는 76.96%(F1)의 성능을 보였다.

Multi-Class SVM+MTL for the Prediction of Corporate Credit Rating with Structured Data

  • Ren, Gang;Hong, Taeho;Park, YoungKi
    • Asia pacific journal of information systems
    • /
    • 제25권3호
    • /
    • pp.579-596
    • /
    • 2015
  • Many studies have focused on the prediction of corporate credit rating using various data mining techniques. One of the most frequently used algorithms is support vector machines (SVM), and recently, novel techniques such as SVM+ and SVM+MTL have emerged. This paper intends to show the applicability of such new techniques to multi-classification and corporate credit rating and compare them with conventional SVM regarding prediction performance. We solve multi-class SVM+ and SVM+MTL problems by constructing several binary classifiers. Furthermore, to demonstrate the robustness and outstanding performance of SVM+MTL algorithm over other techniques, we utilized four typical multi-class processing methods in our experiments. The results show that SVM+MTL outperforms both conventional SVM and novel SVM+ in predicting corporate credit rating. This study contributes to the literature by showing the applicability of new techniques such as SVM+ and SVM+MTL and the outperformance of SVM+MTL over conventional techniques. Thus, this study enriches solving techniques for addressing multi-class problems such as corporate credit rating prediction.

Academic Registration Text Classification Using Machine Learning

  • Alhawas, Mohammed S;Almurayziq, Tariq S
    • International Journal of Computer Science & Network Security
    • /
    • 제22권1호
    • /
    • pp.93-96
    • /
    • 2022
  • Natural language processing (NLP) is utilized to understand a natural text. Text analysis systems use natural language algorithms to find the meaning of large amounts of text. Text classification represents a basic task of NLP with a wide range of applications such as topic labeling, sentiment analysis, spam detection, and intent detection. The algorithm can transform user's unstructured thoughts into more structured data. In this work, a text classifier has been developed that uses academic admission and registration texts as input, analyzes its content, and then automatically assigns relevant tags such as admission, graduate school, and registration. In this work, the well-known algorithms support vector machine SVM and K-nearest neighbor (kNN) algorithms are used to develop the above-mentioned classifier. The obtained results showed that the SVM classifier outperformed the kNN classifier with an overall accuracy of 98.9%. in addition, the mean absolute error of SVM was 0.0064 while it was 0.0098 for kNN classifier. Based on the obtained results, the SVM is used to implement the academic text classification in this work.

스펙트럼 군집화에서 블록 대각 형태의 유사도 행렬 구성 (Magnifying Block Diagonal Structure for Spectral Clustering)

  • 허경용;김광백;우영운
    • 한국멀티미디어학회논문지
    • /
    • 제11권9호
    • /
    • pp.1302-1309
    • /
    • 2008
  • K-means나 퍼지 군집화와 같은 전통적인 군집화 기법들이 원형(prototype)을 기반으로 하고 볼록한 형태의 집단들에 적합한 반면, 스펙트럼 군집화(spectral clustering)는 국부적인 유사성을 기반으로 전역적인 집단을 찾아내는 기법으로 오목한 형태의 집단들에도 적용할 수 있어 커널을 기반으로 하는 SVM과 더불어 각광을 받고 있다. 하지만 SVM이 그러하듯이 스펙트럼 군집화에서도 커널의 폭은 성능에 지대한 영향을 끼치는 요인으로, 이를 결정하기 위한 다양한 방법이 시도되었지만 여전히 휴리스틱에 의존하는 실정이다. 이 논문에서는 유사도 행렬이 보다 명백한 블록 대각 형태를 가지도록 하기 위해 국부적인 커널의 폭을 거리 히스토그램을 바탕으로 적응적으로 결정하는 방법을 제시한다. 제안한 방법은 스펙트럼 군집화에 사용되는 유사도 행렬(affinity matrix)이 블록 형태의 대각 행렬을 이룰 때 이상적인 결과를 낸다는 사실에 기반하고 있으며, 이를 위해서 전통적인 유클리디안 거리와 무작위 행보 거리(random walk distance)를 함께 사용한다. 제안한 방법은 기존의 방법들에서 사용하는 유사도 행렬에 비해 명확한 블록 대각 행렬을 나타내고 있음을 실험 결과를 통해 확인할 수 있다.

  • PDF

DNA 커널을 이용한 MicroRNA 목표 유전자 예측 (MicroRNA Target Prediction using DNA Kernels)

  • 노영균;김성규;김청택;장병탁
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2005년도 가을 학술발표논문집 Vol.32 No.2 (2)
    • /
    • pp.259-261
    • /
    • 2005
  • 분류 방법으로서의 SVM(Support Vector Machine)은 커널 방법과 함께 사용됨으로써 그 유용성을 크게 향상시켰다. 커널 방법은 일반적으로 입력 데이터의 자질(feature)로 나타내는 공간으로부터 높은 차원의 공간으로 데이터를 사상(mapping)시키는 역할을 하게 되나, 기본적으로는 데이터간에 새로운 거리(metric)를 부설해주는 역할을 하는 것이다. 지금까지 나온 다양한 커널 방법은 구조화된(structured) 데이터에 대해 커널 형태로 거리를 부여하는 방법을 제시한다. 본 논문에서는 DNA의 작용을 모델링하여 만든 새로운 커널이 miRNA(micro RNA)와 mRNA(messenger RNA)쌍에 대한 발현 여부를 분류해 내기 위해 커널 형식으로 거리를 부여하는 방법을 보인다. 이 방법은 실리콘 컴퓨터가 아닌 실제 DNA분자로 실험할 수 있도록 설계된 것을 고려할 때 여러 종류의 DNA 코드를 분석하는 데 사용될 수 있는 새로운 분자컴퓨팅 방법이다.

  • PDF

방향성 특징 기술자를 이용한 식물 잎 인식 (Plant leaf Classification Using Orientation Feature Descriptions)

  • 강수명;윤상민;이준재
    • 한국멀티미디어학회논문지
    • /
    • 제17권3호
    • /
    • pp.300-311
    • /
    • 2014
  • 환경의 변화에 따라 급속도로 변화하는 생태계에 대한 체계적인 연구를 위해 식물의 정보를 수집 분석하기 위한 연구가 활발하게 진행되고 있다. 특히, 스마트 기기의 카메라를 이용하여 언제 어디서나 사용자가 원하는 식물의 종류를 검색할 수 있는 기술에 대한 관심이 증가하고 있다. 본 논문은 식물 인식 및 생태계 분석을 위해 다양한 식물의 잎을 종류별로 분석할 수 있는 방법에 대해 제안한다. 이를 위해, 카메라부터 입력된 식물 잎 사진의 관심 영역을 GrabCut을 통해 배경과 분리한 후, 형태 기술자 추출 방법인 SIFT(Scale-Invariant Feature Transform), HOG(Histogram of Oriented Gradient)를 이용하여 형태 기술자를 추출하고, 이것을 부호화 기법 및 공간 피라미드 방법을 이용한 분류 특징 벡터를 만든다. SVM(Support Vector Machine)을 통한 식물 잎 분류 및 인식한다. 다양한 식물 잎에 대한 실험 결과를 통해 비슷한 색상이나 형태를 가지고 있더라도 방향성 특징 기술자를 활용한 식물 잎 분류 방법이 매우 효율적임을 알 수 있다.

빅데이터 분석을 이용한 문단 내의 감정 예측 (Emotion Prediction of Paragraph using Big Data Analysis)

  • 김진수
    • 디지털융복합연구
    • /
    • 제14권11호
    • /
    • pp.267-273
    • /
    • 2016
  • 모바일의 확산과 더불어 정형화된 자료뿐만 아니라 다양한 형태의 비정형화된 자료로부터 정보가 생성되고 정보 전달 및 공유가 활발히 이루어지고 있다. 최근에는 다양한 SNS 매체들로부터 생산 및 배포되는 많은 자료들 중에서 유의미한 정보를 추출하는 기술로 빅데이터 기술을 많이 사용하며, 빅데이터 분석 기법 중 하나인 데이터 마이닝 기법을 사용한다. 특히, SNS로부터 수집된 방대하고 다양한 자료들을 이용하여 대중의 집단지성에 표출된 일반적인 감정을 분석하여 다양한 분야에 활용한다. 본 논문에서는 SNS를 통해 작성된 짧은 문단 내 함축된 키워드와 키워드들 간의 연관성을 이용하여 문단에 나타난 감정을 예측하고 사용자별 감정에 따른 적절한 답변이나 예측된 감정과 유사한 상품이나 영화 등 다양한 추천시스템에 사용될 수 있도록 형태소 분석과 변형된 n-gram방법을 혼합하여 효율적인 감정 예측 시스템을 제안한다. 제안된 시스템은 평균 82.25%의 재현율을 보여 기존의 시스템에 비해 더욱 향상된 성능을 보여 주었고, 형태소분석을 통해 의미 있는 키워드 추출에 도움이 될 것으로 기대한다.