• 제목/요약/키워드: Decision tree method

검색결과 630건 처리시간 0.021초

연관성 방향을 고려한 부호 헬링거 측도의 제안 (Signed Hellinger measure for directional association)

  • 박희창
    • Journal of the Korean Data and Information Science Society
    • /
    • 제27권2호
    • /
    • pp.353-362
    • /
    • 2016
  • 데이터 마이닝은 빅 데이터에 내재되어 있는 새로운 법칙이나 잠재되어 있는 지식을 탐색한 후, 이를 근거로 하여 의사결정에 활용하고자 하는 것이다. 위키 백과사전에 의하면 데이터 마이닝 기법 중의 하나인 연관성 규칙은 연관성 평가 기준에 의해 관심 있는 항목들 간에 관련성을 찾아내는 기법으로 많은 연구자들에 의해 연관성 평가를 위한 흥미도 측도들이 개발되어 왔다. 이들 중에서 헬링거 측도는 여러 가지 흥미도 측도들에 비해 많은 장점이 있으나 연관성의 방향을 판단하기가 곤란한 문제를 내포하고 있다. 이 문제를 해결하기 위해 본 논문에서는 부호를 가지는 헬링거 측도를 제안하고 몇 가지 예제를 통하여 유용성을 고찰하였다. 그 결과, 본 논문에서 제안하는 부호 헬링거 측도는 양의 연관성을 가지는 경우에는 양의 값으로 나타나고 음의 연관성을 가지는 경우에는 음의 값을 갖는 것으로 나타났다. 또한 동시발생빈도, 동시 비 발생빈도, 그리고 불일치 빈도가 증가함에 따라 기본적인 연관성 평가 기준들과 부호 헬링거 측도는 증감 여부가 동일한 것을 알 수 있었다.

관상동맥우회술 시행환자의 중증도 보정 재원일수 변이에 관한 연구 (The Variation Factors of Severity-Adjusted Length of Stay in CABG)

  • 김선자;강성홍;김원중;김유미
    • 품질경영학회지
    • /
    • 제39권3호
    • /
    • pp.391-399
    • /
    • 2011
  • Our study was carried out to analyze the variation factors of severity-adjusted length of stay(LOS) in coronary artery bypass graft(CABG). The subjects were 932 CABG inpatients of the Korean National Hospital Discharge In-depth Injury Survey from 2004 through 2008. The data were analyzed using $x^2$ test and the severity-adjusted model was developed using data mining technique. The results of the study were as follows: male(71.1%), older than 61 years of age(61.6%), more than 500 beds(92.8%) and admitting via ambulatory care(70.0%) appeared to have higher rate than otherwise. In-hospital mortality of CABG inpatients was 2.8%. In addition, 46.4% of the patients received their care in other residence. The angina pectoris(45.6%) was found to be the highest in principle diagnosis, followed by chronic ischemic heart disease(36.9%) and acute myocardial infarction(12.0%). We developed severity-adjusted LOS model using the variables such as gender, age and comorbidity. Comparison of adjusted values in predicted LOS revealed that there were significant variations in LOS by location of hospital, bed size, and whether patients received the care in their residences. The variations of LOS can be explained as the indirect indicator for quality variation of medical process. It is suggested that the severity-adjusted LOS model developed in this study should be utilized as a useful method for benchmarking in hospital and it is necessary that national standard clinical practice guideline should be developed.

휴대폰 카메라로 촬영한 악보 영상 인식을 위한 의사트리 알고리즘 (Decision-Tree Algorithm for Recognition of Music Score Images Obtained by Mobile Phone Camera)

  • 박건희;오성열;손화정;유재명;김수형;이귀상
    • 한국콘텐츠학회논문지
    • /
    • 제8권6호
    • /
    • pp.16-25
    • /
    • 2008
  • 현대 사회에서 빼놓을 수 없는 기기인 휴대폰 카메라를 통하여 획득한 악보를 인식함으로써 누구나 손쉽게 전문적인 악보에 대한 지식이 없어도 악보를 연주할 수 있는 시스템을 제안한다. 본 실험은 휴대폰 카메라를 이용하여 촬영한 악보 영상을 전처리과정을 통하여 분리된 심볼들을 인식한 후 미디를 구성한다. 본 논문에서는 실험을 위하여 휴대폰 카메라로 촬영한 임의의 악보 영상 11종을 사용하였다. 전처리 과정을 거친 심볼을 대상으로 제안한 방법을 통하여 인식한 결과 평균 98%의 높은 인식률을 보였다. 본 시스템을 휴대폰에 포팅하여 수행시간을 측정한 결과, 영상의 입력 후 미디 생성까지 걸리는 시간이 평균 8.63초가 소요됨을 알 수 있었다.

모든 가능한 진단도구를 활용한 균형비교신뢰도의 제안 (Proposition of balanced comparative confidence considering all available diagnostic tools)

  • 박희창
    • Journal of the Korean Data and Information Science Society
    • /
    • 제26권3호
    • /
    • pp.611-618
    • /
    • 2015
  • 오늘날 정보 기술과 소셜미디어의 확산으로 인하여 빅 데이터에 관심이 집중되고 있다. 이를 처리하기 위한 기술 중의 하나가 데이터마이닝기법인데, 이들 중에는 연관성 규칙이 많이 활용되고 있다. 연관성 규칙은 방향에 따라 양, 음, 그리고 역의 연관성 규칙 등이 존재하며, 평가 기준을 설정하고자 하는 경우에는 이들 세 가지 연관성 규칙을 동시에 고려하는 것이 바람직하다고 할 수 있다. 이를 위해 본 논문에서는 의학진단분야에서 활용되고 있는 진단도구들 중에서 민감도, 특이도, 위양성도, 그리고 위음성도를 고려한 균형비교신뢰도를 제안하고자 한다. 또한 흥미도 측도가 가져야 할 조건들을 점검한 후, 예제를 통하여 측도의 유용성을 고찰하였다. 그 결과, 균형비교신뢰도는 비교신뢰도와 역의 비교신뢰도가 양의 값을 가지는 경우에는 양의 값을 가지며, 이들 두 값이 음인 경우에는 음으로 나타났다. 따라서 연관성 규칙의 평가 기준 관점에서 볼 때 비교신뢰도와 역의 비교신뢰도를 개별적으로 이용하기 보다는 균형비교신뢰도를 활용하는 것이 더 바람직하다고 할 수 있다.

모바일 디바이스에서 상황인식 컴퓨팅을 위한 사용자 활동 상태 추정 (Estimation of User Activity States for Context-Aware Computing in Mobile Devices)

  • 백종훈;윤병주
    • 대한전자공학회논문지SP
    • /
    • 제43권1호
    • /
    • pp.67-74
    • /
    • 2006
  • 모바일 단말 환경에서 상황인식 컴퓨팅 기술은 유비쿼터스 컴퓨팅의 핵심기술 중 하나이다. 상황인식 컴퓨팅은 사용자의 일상생활 활동에 능동적으로 반응하는 컴퓨터 응용들을 실현 가능하게 한다. 본 논문에서는 물체나 인간의 물리적인 활동 상태를 감지할 수 있는 가속도센서를 사용하여 모바일 디바이스에 적용한다. 인간의 활동 상태를 추정하기위한 방법은 평균, 표준 편차, 왜도와 같은 다양한 통계치를 분류를 위한 특징으로 활용하는 것이 몇몇 간단한 통계치만을 의존하는 기존의 방법들 보다 더 효과적일 것이다. 분류 알고리듬은 제한된 리소스를 가진 모바일 디바이스를 고려하여 기존의 신경망 대신 간단한 결정 트리를 이용하고자 한다. 유비쿼터스 컴퓨팅과 모바일 응용들을 위한 우리의 상황 검출 시스템의 실험은 기존의 방법들 보다 성능이 향상되었으며 그 결과를 제시한다.

중소 제조기업의 생산정보화(MES) 도입 전략에 관한 연구 (II) - 룰 베이스를 이용한 맞춤형 도입 가이드라인 (A Study on the Production Informatization Strategy for Korean SMEs of Manufacturing Industries (II) - Customized Guideline for Introduction of Production Information System using Rule-base)

  • 정연경;조문빈;이전일;노상도;조현재;조용주;최석우
    • 한국정밀공학회지
    • /
    • 제30권2호
    • /
    • pp.206-215
    • /
    • 2013
  • In recent years, many companies have heavily invested in introducing production informatization systems in order to strengthen the competitiveness and to satisfy consumer's desires in quickly changing market environment. However, it is not effective due to the lack of understanding of systems and of non-existence of an optimal system for each company. Therefore, in this paper, manufacturing companies were classified according to its properties; size of the firm, type of business, production method and job production. After that, a model has been built to calculate the production informatization level, and it has been applied to 450 companies. Results of 450 surveys would be the base for figuring out strategies of introducing the production informatization to the companies which are wishing to build production informatization systems. Finally, Developed in this paper rule base system refer customized guideline to company that wants to adapt production information system.

Exploring the Feature Selection Method for Effective Opinion Mining: Emphasis on Particle Swarm Optimization Algorithms

  • Eo, Kyun Sun;Lee, Kun Chang
    • 한국컴퓨터정보학회논문지
    • /
    • 제25권11호
    • /
    • pp.41-50
    • /
    • 2020
  • 감성분석 연구에서는 문장에 내포된 감성을 결정짓는 단어를 찾는 것으로부터 시작된다. 경영자는 소비자가 주로 사용하는 단어를 분석함으로써 시장의 반응을 이해할 수 있다. 본 연구에서는 감성분류의 성능에 영향을 미치는 단어를 찾기 위하여 입자군집최적화 탐색방법과 다목적진화 알고리즘이 적용된 속성선택 방법을 제안한다. 속성선택 방법은 기존 머신러닝 분류기를 벤치마킹함으로써 성능이 비교된다. 벤치마킹된 분류기는 의사결정나무, 나이브 베이지안 네트워크, 서포터 벡터 머신, 랜덤포레스트, 배깅, 랜덤 서브스페이스, 로테이션 포레스트이다. 연구결과에 따르면, 입자군집 최적화 알고리즘이 적용된 속성선택방법으로 선택된 속성을 사용한 경우에 속성의 수를 상당히 줄일 수 있었고, 분류기의 성능을 유지시킬 수 있었다. 특히, 정확도 결과에서는 입자군집 최적화 탐색방법으로 선택된 속성을 사용한 경우의 서포터 벡터 머신의 성능이 가장 높게 나타났다. AUC 결과에서는 랜덤 서브스페이스가 가장 높게 나타났다. 본 연구의 결과는 해당 탐색방법과 분류기를 적용함으로써 오피니언 마이닝 모델의 성능을 효율적으로 유지 및 개선시키도록 도움을 준다.

위계적 선형모형을 이용한 강의평가 결정요인 분석 (Determinants of student course evaluation using hierarchical linear model)

  • 조장식
    • Journal of the Korean Data and Information Science Society
    • /
    • 제24권6호
    • /
    • pp.1285-1296
    • /
    • 2013
  • 강의평가 결과에 영향을 미치는 특성변수로는 교과목 수준의 다양한 강좌특성 변수들과 수강생 수준의 다양한 인적특성 변수들이 있다. 특정 수강생은 다수의 교과목을 이수하기 때문에 다수의 교과목들은 동일한 수강생 안에 속하게 됨으로써 공유되는 특성이 있게 된다. 즉 강의평가 결과는 교과목 수준의 강좌특성 (1-수준)과 수강생 수준의 인적특성 (2-수준)에 의해 영향을 받는 다층구조 (multilevel)를 가지게 되며, 위계적 자료 특성을 가지는 복수의 분석단위의 구조가 된다. 따라서 전통적인 회귀분석에서와 같이 개별 교과목들이 독립이라는 가정을 할 수 없게 된다. 본 논문에서는 강의평가결과에 영향을 미치는 다층구조의 특성을 가진 변수들의 영향력을 보다 타당하게 분석하기 위한 방법으로 위계선형모형 (HLM; hierarchical linear model)을 이용하였다. 분석결과는 다음과 같다. 먼저 교과목 수준의 특성변수들 중에 강좌규모, 개설학년, 담당교수의 전임여부, 해당 교과목의 총 평균평점, 원어강좌 여부가 통계적으로 유의하게 강의평가 결과에 영향을 미친 것으로 나타났다. 또한 수강생 수준의 인적특성 변수들 중에는 성별, 학과계열, 대입당시 전형방법, 평균평점 등이 유의하게 강의평가 결과에 영향을 미친 것으로 나타났다.

적응 프루닝 알고리즘과 PDT-SSS 알고리즘을 이용한 한국어 연속음성인식에 관한 연구 (A Study on the Korean Continuous Speech Recognition using Adaptive Pruning Algorithm and PDT-SSS Algorithm)

  • 황철준;오세진;김범국;정호열;정현열
    • 한국멀티미디어학회논문지
    • /
    • 제4권6호
    • /
    • pp.524-533
    • /
    • 2001
  • 연속음성인식 시스템의 실용화를 위해서 가장 중요한 것은 높은 인식 성능을 가지면서 동시에 실시간으로 인식되어야 한다. 이를 위하여 본 연구에서는 먼저 연속음성인식의 인식률 향상을 위하여 효과적인 음향모델을 구성하기 위하여 PDT-SSS(Phonetic Decision Tree-based Successive State Splitting) 알고리즘을 도입하여 HM-Net을 구성하고, 언어모델로서 반복학습을 이용하여 인식률 향상을 제고한다. 그리고, 기존의 연구에서 유효함이 입증된 프레임 단위 적응 프루닝 알고리즘을 연속음성에 적용하여 인식 속도를 개선하고자 한다. 제안된 방법의 유효성을 확인하기 위하여, 남성 4인이 항공편 예약 관련 음성에 대하여 인식 실험을 수행하였다. 그 결과 연속음성인식률 90.9%, 단어인식률 90.7%의 높은 인식성능을 얻었으며, 적응 프루닝 알고리즘을 적용한 경우 인식성능의 저하없이 약 1.2초(전체의 15%)의 인식시간을 줄일 수 있어 제안된 방법의 유효성을 확인할 수 있었다.

  • PDF

미래 네트워크 제공을 위한 기계 학습 기반 스마트 서비스 추상화 계층 설계 (Design of Machine Learning based Smart Service Abstraction Layer for Future Network Provisioning)

  • ;;김경백;최덕재
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2016년도 추계학술발표대회
    • /
    • pp.114-116
    • /
    • 2016
  • Recently, SDN and NFV technology have been developed actively and provide enormous flexibility of network provisioning. The future network services would generally involve many different types of services such as hologram games, social network live streaming videos and cloud-computing services, which have dynamic service requirements. To provision networks for future services dynamically and efficiently, SDN/NFV orchestrators must clearly understand the service requirements. Currently, network provisioning relies heavily on QoS parameters such as bandwidth, delay, jitter and throughput, and those parameters are necessary to describe the network requirements of a service. However it is often difficult for users to understand and use them proficiently. Therefore, in order to maintain interoperability and homogeneity, it is required to have a service abstraction layer between users and orchestrators. The service abstraction layer analyzes ambiguous user's requirements for the desired services, and this layer generates corresponding refined services requirements. In this paper, we present our initial effort to design a Smart Service Abstraction Layer (SmSAL) for future network architecture, which takes advantage of machine learning method to analyze ambiguous and abstracted user-friendly input parameters and generate corresponding network parameters of the desired service for better network provisioning. As an initial proof-of-concept implementation for providing viability of the proposed idea, we implemented SmSAL with a decision tree model created by learning process with previous service requests in order to generate network parameters related to various audio and video services, and showed that the parameters are generated successfully.