• 제목/요약/키워드: Data-Warehouse

검색결과 348건 처리시간 0.024초

데이터 웨어하우스 환경에서의 설명기반 데이터 마이닝 (Explanation-based Data Mining in Data Warehouse)

  • 김현수;이창호
    • 한국지능정보시스템학회:학술대회논문집
    • /
    • 한국지능정보시스템학회 1999년도 춘계공동학술대회-지식경영과 지식공학
    • /
    • pp.115-123
    • /
    • 1999
  • 산업계 전반에 걸친 오랜 정보시스템 운용의 결과로 대용량의 데이터들이 축적되고 있다. 이러한 데이터로부터 유용한 지식을 추출하기 위해 여러 가지 데이터 마이닝 기법들이 연구되어왔다. 특히 데이터 웨어하우스의 등장은 이러한 데이터 마이닝에 있어 필요한 데이터 제공 환경을 제공해 주고 있다. 그러나 전문가의 적절한 판단과 해석을 거치지 않은 데이터 마이닝의 결과는 당연한 사실이거나, 사실과 다른 가짜이거나 또는 관련성 없는(trivial, spurious and irrelevant)내용만 무수히 쏟아낼 수 있다. 그러므로 데이터 마이닝의 결과가 비록 통계적 유의성을 가진다 하더라도 그 정당성과 유용성에 대한 검증과정과 방법론의 정립이 필요하다. 데이터 마이닝의 가장 어려운 점은 귀납적 오류를 없애기 위해 사람이 직접 그 결과를 해석하고 판단하며 아울러 새로운 탐색 방향을 제시해야 한다는 것이다. 본 논문에서는 데이터 마이닝 기법 중 연관규칙탐사로 얻어진 결과를 설명가능성 여부의 판단을 통해 검증하는 기법을 제안하며, 이를 통해 얻어진 검증된 지식을 토대로 일반화를 통한 새로운 가설을 생성하여 데이터 웨어하우스로부터 연관규칙을 검증하는 일련의 아텍쳐(architecture)를 제시하고다 한다. 먼저 데이터 마이닝 결과에 대한 설명의 필요성을 제시하고, 데이터 웨어하우스와 데이터 마이닝 기법들에 대한 간략한 설명과 연관규칙탐사에 대한 정의 및 방법을 보이고, 대상 영역에 대한 데이터 웨어하우스으 스키마를 보였다. 다음으로 도메인 지식(domain knowledge)과 연관규칙탐사를 통해 얻어진 결과를 표현하기위한 지식표현 방법으로 Relational Predicate Logic을 제안하였다. 연관규칙탐사로 얻어진 결과를 설명하기 위한 방법으로는 연관규칙탐사로 얻어진 연관규칙에 대해 Relational Predicate Logic으로 표현된 도메인 지식으로서 설명됨을 보이게 한다. 또한 이러한 설명(explanation)을 토대로 검증된 지식을 일반화하여 새로운 가설을 연역적으로 생성하고 이를 연관규칙탐사를 통해 검증한 후 새로운 지식을 얻는 반복적인 Explanation-based Data Mining Architecture를 제시하였다. 본 연구의 의의로는 데이터 마이닝을 통한 귀납적 지식생성에 있어 귀납적 오류의 발생을 도메인 지식을 통해 설명가능 함을 보임으로 검증하고 아울러 이러한 설명을 통해 연역적으로 새로운 가설지식을 생성시켜 이를 가설검증방식으로 검증함으로써 귀납적 접근과 연역적 접근의 통합 데이터 마이닝 접근을 제시하였다는데 있다.

  • PDF

Analysis of prescription frequency of herbs in traditional Korean medicine hospital using electronic medical records

  • Lee, Byung-Wook;Cho, Hyun-Woo;Hwang, Eui-Hyoung;Heo, In;Shin, Byung-Cheul;Hwang, Man-Suk
    • 대한한의학회지
    • /
    • 제40권4호
    • /
    • pp.29-40
    • /
    • 2019
  • Objectives: To analyze the prescription frequency of various herbs as either individual or major herbs (in terms of dosage) and their usage patterns in the treatment of different diseases for standardization of traditional Korean medicine. Methods: We analyzed the prescription database of patients at the Pusan National University Korean Medicine Hospital from the date of establishment of the hospital to February 2013. The complete prescription data were extracted from the electronic medical records of patients, and the prescription frequencies of individual herbs, particularly, of major herbs, were analyzed in terms of gender, age, and international classification of diseases (ICD) code. Results: The prescription frequency of individual herbs based on age and gender showed a similar pattern. Herbal mixtures were also distributed in a similar manner. The use of some herbs differed according to age and gender (Table 1.). The herbs that were used at high frequencies for a given ICD code had similar usage patterns in different categories. However, some major herbs in the "Jun (King)" category were used uniquely for a given ICD code (Table 2.). There was significant difference between male and female on ICD code E and N, but the other ICD codes had small differences. The ratio of herbal medicine by gender showed different usage patterns in each gender. Conclusions: The findings of our study provide fundamental data that reflect the real clinical conditions in South Korea, and therefore, can contribute to the standardization of TKM.

입원환자 데이터를 이용한 예약부도환자 이탈방지 모형 연구 (Informally Patients Prediction Model of Admission Patients)

  • 김은엽;함승우
    • 한국산학기술학회논문지
    • /
    • 제10권11호
    • /
    • pp.3465-3472
    • /
    • 2009
  • 본 병원에 축적된 의무기록과 데이터베이스에 있는 퇴원 환자 정보를 이용하여 이탈에 영향을 미치는 특성을 파악하여 활용 가능한 예측모형을 제시하고자 한다. 외래진료 방문환자 3,503명 중 충성고객 2,118명 60.5%, 이탈 고객 1,385명 39.5%을 추출하여 분석에 사용하였다. 생존한 변수는 성별, 연령(연령대), 지역, 보험구분, 입원경로, 진료과, 퇴원과, 퇴원형태, 협진여부, 수술여부, 진료예약여부, 환자구분을 기반으로 예측모형을 만들었다. 로지스틱 회귀분석을 실시한 결과 66.0%의 정확도를 나타냈고, 신경망을 통하여 예측한 결과 분석용 결과는 정분율은 69.79%이고, 검정용 결과 정분율은 63.64%였다. CHAID를 통하여 예측한 결과 분석용 결과 정분율을 83.75% 이고, 검정용 결과 정분율은 42.74%였다. 예측 모형을 활용한 이탈고객을 위한 관리와 병원의 신뢰를 높여야 할 것이다.

남극 세종기지에서의 풍력자원 국소배치 민감도 분석 (Sensitivity Analysis of Wind Resource Micrositing at the Antarctic King Sejong Station)

  • 김석우;김현구
    • 한국태양에너지학회 논문집
    • /
    • 제27권4호
    • /
    • pp.1-9
    • /
    • 2007
  • Sensitivity analysis of wind resource micrositing has been performed through the application case at the Antarctic King Sejong station with the most representative micrositing softwares: WAsP, WindSim and Meteodyn WT. The wind data obtained from two met-masts separated 625m were applied as a climatology input condition of micro-scale wind mapping. A tower shading effect on the met-mast installed 20m apart from the warehouse has been assessed by the CFD software Fluent and confirmed a negligible influence on wind speed measurement. Theoretically, micro-scale wind maps generated by the two met-data located within the same wind system and strongly correlated meteor-statistically should be identical if nothing influenced on wind prediction but orography. They, however, show discrepancies due to nonlinear effects induced by surrounding complex terrain. From the comparison of sensitivity analysis, Meteodyn WT employing 1-equation turbulence model showed 68% higher RMSE error of wind speed prediction than that of WindSim using the ${\kappa}-{\epsilon}$ turbulence model, while a linear-theoretical model WAsP showed 21% higher error. Consequently, the CFD model WindSim would predict wind field over complex terrain more reliable and less sensitive to climatology input data than other micrositing models. The auto-validation method proposed in this paper and the evaluation result of the micrositing softwares would be anticipated a good reference of wind resource assessments in complex terrain.

상호운용성을 지원하는 ITS 공간 데이터베이스의 위치참조 기법 (Location reference technique of ITS Space Database supporting interoperability)

  • 김숙희;최기주;장정아
    • 대한공간정보학회지
    • /
    • 제12권1호
    • /
    • pp.45-53
    • /
    • 2004
  • 본 연구의 목적은 객체지향의 개념을 도입하여 지능형 교통체계(Intelligent Transport System: 이하ITS)의 서비스를 위한 모든 공간 및 비공간 데이터를 객체화하여 이 기종 시스템 간에 상호 운용할 수 있는 방안을 연구하고, 상호운용을 위한 ITS 공간 데이터베이스의 위치참조기법을 제시하는 것이다. 본 연구에서 제안하는 위치참조기법의 시스템 기본구조는 공간 및 비공간 데이터를 저장하는 데이터 저장소와 데이터를 요청하는 사용자 응용 프로그램과 질의를 담당하는 질의 오브젝트 서비스, 상호 인터페이스를 담당하는 인터페이스 오브젝트 서비스, 공간 및 비공간 또는 이미지와 같은 데이터베이스가 저장된 오브젝트 위치에 대한 정보를 제공하는 네이밍 오브젝트 서비스를 포함한다. 또한 클래스에 대한 클래스 상속관계, 속성정보 등의 클래스에 대한 반복을 처리하고, 클래스에서 사용되는 속성을 관리하기 위해서 속성의 형식과 다양한 공간데이터 처리를 서비스하는 메타데이터 관리 오브젝트 서비스와 객체들의 수정, 삭제, 교환, 추가 등을 관리하는 항구적 오브젝트 서비스로 시스템의 기본 구조를 제시하였다. 이 기본구조는 서로 다른 이기종 시스템간에 ITS의 서비스를 위한 공간 데이터를 공유하고 상호운용 할 수 있도록 함으로써 데이터 관리, 유지에 있어서 많은 용이함을 제공할 것으로 기대된다.

  • PDF

효율적인 ROLAP 큐브 생성 방법 (An Efficient ROLAP Cube Generation Scheme)

  • 김명;송지숙
    • 한국정보과학회논문지:데이타베이스
    • /
    • 제29권2호
    • /
    • pp.99-109
    • /
    • 2002
  • ROLAP(Relational Online Analytical Processing)은 다차원적 데이타 분석을 위한 제반 기술로써, 전사적 데이타 웨어하우스로부터 고부가가치를 창출하는데 필수적인 기술이다. 질의처리 성능을 높이기 위해서 대부분의 ROLAP 시스템들은 집계 테이블들을 미리 계산해 둔다. 이를 큐브 생성이라고 하며, 이 과정에서 기존의 방법들은 데이타를 여러 차례 정렬해야 하고 이는 큐브 생성의 성능을 저하시키는 큰 요인이다. (1)은 MOLAP 큐브 생성 알고리즘을 통해 간접적으로 ROLAP 큐브를 생성하는 것이 훨씬 빠르다는 것을 보였다. 본 연구에서도 MOLAP 큐브 생성 알고리즘을 사용한 신속하고 확장적인 ROLAP 큐브 생성 알고리즘을 제시하였다. 분석할 입력 사실 테이블을 적절하게 조각내어 메모리 효율을 높였고, 집계 테이블들을 최소 부모 집계 테이블로부터 생성하도록 하여 큐브 생성 시간을 단축하였다. 제안한 방법의 효율성은 실험을 통해 검증하였다.

LDA 기법을 이용한 버스 승객의 잠재적 이동패턴 분석 (Latent mobility pattern analysis of bus passengers with LDA)

  • 조아;이경희;조완섭
    • Journal of the Korean Data and Information Science Society
    • /
    • 제26권5호
    • /
    • pp.1061-1069
    • /
    • 2015
  • 최근 교통 분야에서 발생하는 교통 빅데이터 (교통카드 데이터, ATMS 데이터 등)의 분석결과를 교통 정책에 활용하는 사례가 늘어나고 있는 추세이다. 또한 교통 데이터 분석 기법을 기존의 단순 빈도 분석 기법에서 다양한 데이터 마이닝 기법으로 확장하여 교통 데이터 속에 숨어있는 의미를 파악하려는 연구도 진행되고 있다. 본 연구에서는 교통카드 데이터에 대하여 토픽모델링 기법 중의 하나인 LDA (Latent Dirichlet Allocation) 기법을 적용하여 청주시 버스 승객들의 이동패턴을 분석한다. 이를 위해 교통카드 데이터의 하차 결측치를 추정하고, LDA 기법을 적용하여 이동패턴을 추출하였다. 또한 LDA 분석으로 도출된 값을 측정값으로 하여 다차원적 분석을 함으로써 청주시 버스 승객들의 이동패턴 특징을 파악할 수 있다. 분석 결과, 청주시의 경우 크게 1) 시외지역에서 터미널을 이용해 청주시에서 유입되는 패턴, 2) 주거지역에서 상업지역으로 이동하는 패턴, 3) 청주 인근 학교에서 상업 지역 (청주 중심가)로 이동하는 패턴을 발견할 수 있었다. 이동패턴은 도시 계획, 대중교통서비스 향상, 버스 노선 신설 등 다양한 교통정책의 수립에 활용될 수 있을 것으로 기대된다.

동일한 형태의 특징점을 갖는 천장 영상 이용 이동 로봇 위치추정 (Localization of a Mobile Robot Using Ceiling Image with Identical Features)

  • 노성우;고낙용;국태용
    • 한국지능시스템학회논문지
    • /
    • 제26권2호
    • /
    • pp.160-167
    • /
    • 2016
  • 본 논문은 천장 영상 정보를 이용한 이동 로봇 위치추정 방법을 제안한다. 지도상에 천장 영상의 랜드 마크의 위치는 미리 알고 있지만, 지도상의 랜드 마크와 감지된 랜드 마크 사이의 대응관계 정보는 주어지지 않는다. 단지, 로봇의 이동 시작 단계에서 랜드 마크들에 대한 상대적인 로봇의 위치가 주어진다. 로봇의 위치 및 천장 영상에서 감지된 특징점의 ID를 찾기 위해 파티클 필터 방법을 이용한다. 제안한 방법을 천장에 동일한 형태의 원형 랜드 마크를 가진 실내 환경에서 실험하여 성능을 검증하였다. 본 논문에서 제안한 위치추정 방법은 레이저 영역 센서에 의해 측정된 벽까지의 거리 또는 RF 나 초음파에 의해 측정된 비이컨까지의 거리 값에 큰 불확실성이 존재하는 물류 창고와 같은 환경에서 사용하기에 적합하다.

자원공유 수단으로서의 전문 데이터베이스 (Full-text databases as a means for resource sharing)

  • 노진구
    • 한국도서관정보학회지
    • /
    • 제24권
    • /
    • pp.45-79
    • /
    • 1996
  • Rising publication costs and declining financial resources have resulted in renewed interest among librarians in resource sharing. Although the idea of sharing resources is not new, there is a sense of urgency not seen in the past. Driven by rising publication costs and static and often shrinking budgets, librarians are embracing resource sharing as an idea whose time may finally have come. Resource sharing in electronic environments is creating a shift in the concept of the library as a warehouse of print-based collection to the idea of the library as the point of access to need information. Much of the library's material will be delivered in electronic form, or printed. In this new paradigm libraries can not be expected to su n.0, pport research from their own collections. These changes, along with improved communications, computerization of administrative functions, fax and digital delivery of articles, advancement of data storage technologies, are improving the procedures and means for delivering needed information to library users. In short, for resource sharing to be truly effective and efficient, however, automation and data communication are essential. The possibility of using full-text online databases as a su n.0, pplement to interlibrary loan for document delivery is examined. At this point, this article presents possibility of using full-text online databases as a means to interlibrary loan for document delivery. The findings of the study can be summarized as follows : First, turn-around time and the cost of getting a hard copy of a journal article from online full-text databases was comparable to the other document delivery services. Second, the use of full-text online databases should be considered as a method for promoting interlibrary loan services, as it is more cost-effective and labour saving. Third, for full-text databases to work as a document delivery system the databases must contain as many periodicals as possible and be loaded on as many systems as possible. Forth, to contain many scholarly research journals on full-text databases, we need guidelines to cover electronic document delivery, electronic reserves. Fifth, to be a full full-text database, more advanced information technologies are really needed.

  • PDF

유한요소해석을 이용한 Coal Silo Tunnel 취약부위의 구조안전성 분석 및 구조보강 (Structural Safety Analysis and Reinforcement for Weak Area of the Coal Silo Tunnel using Finite Elements Analysis)

  • 이현우;정성윤;송세암;김민수;김진형;김철
    • 한국정밀공학회지
    • /
    • 제29권4호
    • /
    • pp.461-468
    • /
    • 2012
  • Silo is a warehouse for storing granular materials such as grain, cement, petroleum compound and coal. When compared to other warehouses, the silo can use space efficiently. The coal silo are consists of silo, tunnel and extractor. Of these, there are not sufficient study and design data on tunnel. It depends heavily upon trial and error method by field engineers with several years of experience. Recently, silos are constructed with a large size, and tunnel becomes to be in danger of severe cracking and collapse by a huge load of coal. So it is necessary to analyze structural safety for tunnel. In this study, the problems of the tunnel are analyzed by field data, and reinforcement of structural weak area using FE analysis has been carried out to design the tunnel satisfying structural safety. From FE Analysis, the reinforced model which does not exceed the yield strength of the material has been proposed.