ID3 Algorithm Improved with Time-weighted Entropy

시간 가중치 엔트로피를 이용한 결정 트리 생성 알고리즘

  • Dong, Liq-Uan (Department of Computer Engineering, Sungkyunkwan University) ;
  • Lee, Jee-Hyong (Department of Computer Engineering, Sungkyunkwan University)
  • 동립권 (성균관대학교 정보통신공학부 컴퓨터공학과) ;
  • 이지형 (성균관대학교 정보통신공학부 컴퓨터공학과)
  • Published : 2005.07.01

Abstract

결정 트리(Decision Tree)는 주어진 데이터의 경향을 학습하는 데 사용되는 대표적인 방식이다. 이것은 주어진 데이터를 구조화하기 위하여 데이터의 속성과 정보의 엔트로피에 기반을 둔 정보획득량을 이용한다. 본 논문에서는 유비쿼터스 환경에서 사용자 프로파일 정보처럼 시간에 따라 그 경향이 변하는 데이터에 유용하게 적용할 수 있는 시간 가중치 엔트로피를 정의한다. 그리고 ID3 알고리즘을 기반으로 새롭게 제안하는 시간 가중치 엔트로피를 이용하는 향상된 ID3 알고리즘을 쓰고 사용자의 경향을 분석한다. 본 논문에서 제안하는 엔트로피를 이용하는 방식은 데이터들의 시간에 관한 영향을 고려해서 기준방식보다 분석결과가 더욱 유리하다. 두 방식의 비교 테스트 결과를 보면 시간 가중치 엔트로피를 이용하는 알고리즘은 기존의 ID3 알고리즘보다 구성된 트리의 구조가 매우 간단하고 유리하다.

Keywords