• Title/Summary/Keyword: 마이닝시스템

Search Result 934, Processing Time 0.025 seconds

Web Document Prediction System by using Web Log Mining (웹 로그 마이닝을 이용한 웹 문서 예측 시스템)

  • Lee Bum-suk;Hwang Byung-yeon
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2005.11b
    • /
    • pp.97-99
    • /
    • 2005
  • 웹 문서 수의 급격한 증가는 사용자로 하여금 방대한 양의 웹 문서들로부터 필요한 정보를 선별하기 위한 시간과 비용을 낭비하게 만들었다. 따라서 이러한 문제를 해결하기 위한 연구의 필요성이 점차 증가하였는데, 그 중 웹 서버 로그 데이터에 마이닝 기법을 적용하여 사용자들의 사이트 내 문서의 접근 패턴을 분석하고, 그 데이터를 이용하여 동적으로 변화하는 적응형 웹 사이트를 제공하려는 것이 대표적인 연구 사례이다. 본 논문에서는 웹 서버 로그 마이닝을 이용하여 사용자가 필요로 하거나, 관심을 가지고 있는 페이지를 예측하여 추천해 주는 시스템에 대해 소개한다. 이러한 시스템을 구현하기 위해 순차 패턴 마이닝이나 빈발 에피소드 발견 기법 등의 알고리즘을 사용할 수 있다. 제안하는 시스템에서는 사용자 접근 패턴을 분석할 때 순차 패턴 마이닝 기법을 사용하고, 사용자의 이동 패턴을 근거로 웹 문서를 예측하여 추천해줄 때에는 에피소드 발견 기법에서의 window 개념을 이용한다. 본 논문에서 제안한 시스템은 웹 문서를 사용자가 머물었던 시간에 따라 관심 있는 문서와 지나간 문서로 구분하여 관심 있는 문서에 대해서안 마이닝을 수행한다. 또한 일정한 크기를 갖는 History window에 의해 다음 문서를 추천해주기 때문에 사용자의 모든 로그를 저장하지 않으므로 보다 효율적이다.

  • PDF

An Efficient Data Mining Query Processing Using Concept Hierachy (개념계층을 이용한 효율적인 마이닝 질의 처리)

  • 문봉완;김경창
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 1998.10b
    • /
    • pp.395-397
    • /
    • 1998
  • 현재 데이터마이닝과 관련하여 많은 주제들이 다루어지고 있다. 하지만, 전체적인 마이닝 시스템과 관련하여 마이닝 질의 언어 및 효율적인 질의 처리 방식에 대한 체계적인 연구는 충분하지 못한 것 같다. 따라서 본 논문에서는 과거 구현된 바 있는 마이닝 질의 처리기를 기반으로 하여 질의처리의 융통성을 제공하며, 효율적인 질의 처리를 취한 방법론에 대해 다루고자 한다. 과거 구현되었던 마이닝 질의 처리기는 데이터웨어하우스에 있는 primitive 데이터들을 마이닝 시스템에서 사용할 수 있도록 추출하여 보여주는 역할을 했는데, 단순히 primitive 단위의 데이터들에 대한 접근 뿐 아니라, 현재 데이터마이닝 분야에서 연구 중에 있는 개념 계층이라는 구조를 이용하여 일반화된 데이터 및 에트리뷰트들에 대한 계층적인 정보를 이용하여 체계적이며, 효율적인 마이닝 질의 처리를 가능하게 하고자 한다.

Design and Implementation of a Spatial Data Mining System (공간 데이터 마이닝 시스템의 설계 및 구현)

  • Bae, DUck-Ho;Baek, Ji-Haeng;Oh, Hyun-Kyo;Song, Ju-Won;Kim, Sang-Wook;Choi, Myoung-Hoi;Jo, Hyeon-Ju
    • Journal of Korea Spatial Information System Society
    • /
    • v.11 no.2
    • /
    • pp.119-132
    • /
    • 2009
  • Owing to the GIS technology, a vast volume of spatial data has been accumulated, thereby incurring the necessity of spatial data mining techniques. In this paper, we propose a new spatial data mining system named SD-Miner. SD-Miner consists of three parts: a graphical user interface for inputs and outputs, a data mining module that processes spatial mining functionalities, a data storage model that stores and manages spatial as well as non-spatial data by using a DBMS. In particular, the data mining module provides major data mining functionalities such as spatial clustering, spatial classification, spatial characterization, and spatio-temporal association rule mining. SD-Miner has own characteristics: (1) It supports users to perform non-spatial data mining functionalities as well as spatial data mining functionalities intuitively and effectively; (2) It provides users with spatial data mining functions as a form of libraries, thereby making applications conveniently use those functions. (3) It inputs parameters for mining as a form of database tables to increase flexibility. In order to verify the practicality of our SD-Miner developed, we present meaningful results obtained by performing spatial data mining with real-world spatial data.

  • PDF

Probabilistic filtering for a biological knowledge discovery system with text mining and automatic inference (텍스트 마이닝 및 자동 추론 기반 생물학 지식 발견 시스템을 위한 확률 기반 필터링)

  • Lee, Hee-Jin;Park, Jong-C.
    • Journal of the Korea Society of Computer and Information
    • /
    • v.17 no.2
    • /
    • pp.139-147
    • /
    • 2012
  • In this paper, we discuss the structure of biological knowledge discovery system based on text mining and automatic inference. Given a set of biology documents, the system produces a new hypothesis in an integrated manner. The text mining module of the system first extracts the 'event' information of predefined types from the documents. The inference module then produces a new hypothesis based on the extracted results. Such an integrated system can use information more up-to-date and diverse than other automatic knowledge discovery systems use. However, for the success of such an integrated system, the precision of the text mining module becomes crucial, as any hypothesis based on a single piece of false positive information would highly likely be erroneous. In this paper, we propose a probabilistic filtering method that filters out false positives from the extraction results. Our proposed method shows higher performance over an occurrence-based baseline method.

The Design of A Context Mining System to Minimize Users' Direct-Feedback in Ubiquitous Environment (유비쿼터스 환경에서 사용자의 직접 피드백을 최소화하기 위한 컨텍스트 마이닝 시스템 설계)

  • Choi Young-Hwan;Lee Sang-Yong
    • Proceedings of the Korean Institute of Intelligent Systems Conference
    • /
    • 2005.11a
    • /
    • pp.263-266
    • /
    • 2005
  • 현재 유비쿼터스 환경에서 대부분의 시스템이 개인화된 추천 서비스를 위한 컨텍스트 인식 과정에서 사용자의 직접 피드백을 받는 경우가 많다. 다양한 서비스가 사용자 주변에 존재한다고 하더라도 사용자가 서비스를 받기 위해 직접 피드백을 하는 경우가 많아지면 invisible service를 받을 수 없게 된다. 본 논문에서는 마이닝 기법을 기반으로 사용자의 프로파일 생성과 갱신, 선호도를 예측하여 효율적인 서비스를 제공하는 컨텍스트 마이닝 시스템을 제안한다. 본 시스템에서는 초기프로파일을 생성할 때만 사용자의 직접 피드백을 이용하고, 사용자 프로파일의 갱신과 선호도 예측, 추천 둥 컨텍스트 마이닝 과정에서는 사용자의 행동과 사용자와 유사한 그룹의 선호도, 그리고 사용자의 주변 환경과 같은 컨텍스트 정보를 이용하여 직접 피드백을 최소화한다.

  • PDF

Fuzzy category based transaction analysis for web usage mining (웹 사용 마이닝을 위한 퍼지 카테고리 기반의 트랜잭션 분석 기법)

  • 이시헌;이지형
    • Proceedings of the Korean Institute of Intelligent Systems Conference
    • /
    • 2004.04a
    • /
    • pp.341-344
    • /
    • 2004
  • 웹 사용 마이닝(Web usage mining)은 웹 로그 파일(web log file)이나 웹 사용 데이터(Web usage data)에서 의미 있는 정보를 찾아내는 연구 분야이다. 웹 사용 마이닝에서 일반적으로 많이 사용하는 웹 로그 파일은 사용자들이 참조한 페이지의 단순한 리스트들이다. 따라서 단순히 웹 로그 파일만을 이용하는 방법만으로는 사용자가 참조했던 페이지의 내용을 반영하여 분석하는데에는 한계가 있다. 이러한 점을 개선하고자 본 논문에서는 페이지 위주가 아닌 웹 페이지가 포함하고 있는 내용(아이템)을 고려하는 새로운 퍼지 카테고리 기반의 웹 사용 마이닝 기법을 제시한다. 또한 사용자를 잘 파악하기 위해서 시간에 따라 관심의 변화를 파악하는 방법을 제시한다.

  • PDF

A Data Mining using Data Information Technology (데이터정보기술을 이용한 데이터 마이닝)

  • Jeon, Seong-Hae;Lee, Seung-Ju;O, Gyeong-Hwan
    • Proceedings of the Korean Institute of Intelligent Systems Conference
    • /
    • 2008.04a
    • /
    • pp.264-265
    • /
    • 2008
  • 문제의 정의부터 데이터의 조사, 측정, 수집, 전송, 분석, 지식의 창출, 그리고 최적의 의사결정 및 피드백에 이르는 전체 과정을 다루는 데이터기술은 2000년 전,후에 제안되었다. 아직 이에 대한 폭넓은 연구는 이루어지고 있지 못하지만 기업 비즈니스를 위한 CRM 등의 경영을 위한 효과적인 데이터 마이닝 방법론에 대한 개선을 위한 중요한 역할이 기대된다. 본 논문에서는 현재 연구되고 있는 데이터기술과 정보기술의 창조적인 융합을 제안하고 이를 통하여 효과적인 데이터 마이닝의 수행방안에 대하여 연구한다.

  • PDF

The Development of Data Mining Solution based on Web (웹 기반의 데이터 마이닝 솔루션 개발에 대하여)

  • 구자용;박헌진;최대우
    • Proceedings of the Korea Inteligent Information System Society Conference
    • /
    • 2000.11a
    • /
    • pp.301-306
    • /
    • 2000
  • 최근 데이터 웨어하우징의 활발한 구축과 우수고객 확보를 위한 치열한 경쟁으로 데이터 마이닝은 많은 업체의 큰 관심을 끌고있다. 본 연구는 풍부한 알고리즘과 과학적 그래프를 제공하여 사용자로 하여금 최상의 데이터 마이닝 효과를 거둘 수 있도록 Statserver를 핵심 엔진으로 사용한 인터넷 기반의 데이터 마이닝 솔루션 개발에 관한 편이다

  • PDF

Multi-Dimensional Association Rule Mining in Survey Data (설문 데이터를 위한 다차원 연관 규칙 마이닝)

  • 이정수;김교정
    • Proceedings of the Korea Inteligent Information System Society Conference
    • /
    • 2003.05a
    • /
    • pp.395-399
    • /
    • 2003
  • 본 논문에서는 인문 사회과학 분야의 방대한 설문 데이터를 처리하기 위해 기존의 설문 항목들간의 평면적 관계에만 국한 되었던 연구에 대해 설문데이터 다차원 연관규칙 마이닝 시스템을 설계하고 데이터 간의 연관규칙을 탐사한다. 즉, 직관적으로 분류될 수 있는 기준에 따라 클러스터링을 실행하여 데이터를 분류한 후 각 클러스터로부터 다차원 연관 규칙을 탐사하는 시스템을 제안함으로써 보다 강력한 연관규칙을 탐사한다.

  • PDF

gCRM and Spatial Data Mining (gCRM과 공간데이타마이닝)

  • Hwang, Jung-Rae;Li, Ki-Joune
    • 한국공간정보시스템학회:학술대회논문집
    • /
    • 2002.03a
    • /
    • pp.38-44
    • /
    • 2002
  • 고객관계관리(CRM)나 마케팅과 같은 경영방식에서도 대용량의 공간 데이터베이스를 사용하는 지리정보시스템(GIS)과 같은 응용분야를 접목하고 있다. gCRM은 지리정보시스템과 고객관계관리를 결합한 것으로, 이러한 실정을 단적으로 보여 주고 있는 경영방식이다. gCRM은 대용량의 데이터베이스로부터 관심 있는 분야를 찾아내고 분석하게 된다. 그러기 위해서는 데이터마이닝이라는 기술이 필요하다. 하지만, gCRM은 일반적인 데이터베이스뿐만 아니라 공간 데이터베이스 역시 많이 사용되어진다. 이러한 공간데이터베이스로부터 관심 있는 부분이나 관계 그리고 특성 등을 찾아내기 위해서는 공간데이타마이닝이 요구된다. 본 논문에서는 gCRM 솔루션들의 기능을 중심으로 다양한 공간데이타마이닝 기법과 어떠한 관계가 있는지를 살펴봄으로써 gCRM과 공간데이타마이닝이 접목할 수 있는 부분에 대하여 정리하였다.

  • PDF