Search | Korea Science

빈발 패턴 네트워크에서 연관 규칙 발견을 위한 아이템 클러스터링

O, Gyeong-Jin;Jeong, Jin-Guk;Jo, Geun-Sik
- Proceedings of the Korea Inteligent Information System Society Conference
- /
- 2007.05a
- /
- pp.321-328
- /
- 2007
데이터마이닝은 대용량의 데이터에 숨겨진 의미있고 유용한 패턴과 상관관계를 추출하여 의사결정에 활용하는 작업이다. 그 중에서도 고객 트랜잭션의 데이터베이스에서 아이템 사이에 존재하는 연관규칙을 찾는 것은 중요한 일이 되었다. Apriori 알고리즘 이후 연관규칙을 찾기 위해 대용량 데이터베이스로부터 압축된 의미있는 정보를 저장하기 위한 데이터 구조와 알고리즘들이 제안되어 왔다. 본 논문에서는 정점으로 아이템을 표현하고, 간선으로 두 아이템집합을 표현하는 빈발 패턴 네트워크(FPN)이라 불리는 새 자료 구조를 제안한다. 빈발 패턴 네트워크에서 아이템 사이의 연관 관계를 발견하기 위해 이 구조를 어떻게 효율적으로 사용 하느냐에 초점을 두고 있다. 구조의 효율적인 사용을 위하여 한 아이템이 클러스터 내의 아이템과는 유사도가 높고, 다른 클러스터의 아이템과는 유사도가 낮도록 네트워크의 정점을 클러스터링하는 방법을 사용한다. 실험은 신뢰도, 상관관계 그리고 간선 가중치 유사도를 이용하여 네트워크에서 아이템 클러스터링의 정확도를 보여준다. 본 논문의 실험 결과를 통해 신뢰도 유사도가 네트워크의 정점을 클러스터링할 때 클러스터의 정확성에 가장 많은 영향을 미친다는 것을 알 수 있었다.
PDF

Implementation of PC-Cluster System for Efficient Bioinformatics Sequence Analysis (효율적인 생물정보 서열검색을 위한 PC-클러스터 시스템 구현)

공재근;좌용권;박정선;유선주;이문상
- Proceedings of the Korean Information Science Society Conference
- /
- 2004.04a
- /
- pp.37-39
- /
- 2004
최근 들어 유전자 서열의 생산량 증가에 비례하여 유전자 발현 마이크로 칩과 같은 새로운 분석방법과 기술들이 도입되면서 연구자들이 매일 수천 개의 서열을 효율적으로 분석해야 할 필요성이 증대되고 있다. 이러한 생명공학분야의 급속한 발전은 대용량 유전자 서열에 대한 빠른 분석이 가능한 컴퓨팅 자원을 요구하고 있으나 IT 인프라에 대한 막대한 투지비용으로 인해 관련 연구기관에서 쉽게 이들 컴퓨팅 자원을 도입하지 못하고 있는 실정이다. 본 연구에서는 저가의 PC 서버를 고속의 네트워크로 연결한 PC 클러스터를 활용하여 시스템의 안정성과 신뢰성을 보장함과 동시에 범용성을 지닌 생물정보 서열검색 시스템을 구축하였다. 이러한 효율적인 시스템 구축을 통해 생물정보 데이터베이스로 서열 검색 시스템을 제공하고, 대용량 서열 데이터베이스의 검색 시간을 단축하였다.
PDF

An Online Scaling Method for Improving the Availability of a Database Cluster (데이터베이스 클러스터의 가용성 향상을 위한 온라인 확장 기법)

Lee, Chung-Ho;Jang, Yong-Il;Bae, Hae-Yeong
- The KIPS Transactions:PartD
- /
- v.10D no.6
- /
- pp.935-948
- /
- 2003
An online scaling method adds new nodes to the shared-nothing database cluster and makes tables be reorganized while the system is running. The objective is to share the workload with many nodes and increase the capacity of cluster systems. The existing online scaling method, however, has two problems. One is the degradation of response time and transactions throughput due to the additional overheads of data transfer and replica's condidtency. The other is and inefficient recovery mechanism in which the overall scaling transaction is aborted by a fault. These problems deteriorate the availability of shared-nothing database cluster. To avoid the additional overheads throughout the scaling period, our scalingmethod consists of twophases : a parallel data transfer phase and a combination phase. The parallel data transferred datausing reduces the size of data transfer by dividing the data into the number of replicas. The combination phase combines the transferred datausing resources of spare nodes. Also, our method reduces the possibility of failure throughout the scaling period and improves the availability of the database cluster.
https://doi.org/10.3745/KIPSTD.2003.10D.6.935 인용 PDF KSCI

E-Commerce에서의 퍼지 클러스터링 알고리즘을 적용한 추천 시스템

Lyou, Hae-Ri;Kim, Moon-Hyun
- Proceedings of the Korea Inteligent Information System Society Conference
- /
- 2003.05a
- /
- pp.410-415
- /
- 2003
인터넷의 발전으로 전 세계적으로 다양한 인터넷 서비스들이 점차 확대되고 있으며, 특히 수익을 내는 방법으로서의 인터넷 전자상거래는 큰 비중을 차지하고 있다. 이에 수많은 사이트, 쇼핑몰은 상품과 고객들의 수많은 데이터를 데이터베이스 모듈로 관리하고 있다. 이렇게 고객에게 맞는 상품을 추천하기 위해 효율적으로 클러스터링 하는 방법이 요구된다. 이에 본 논문에서는 여러 클러스터링 방법 중에서 퍼지 이론을 기반으로 개선된 클러스터링 알고리즘을 이용하여 상품을 추천하고자 한다 이 방법은 클러스터의 개수가 한정되어 있는 기존의 방법에 클러스터의 유사도에 따른 유사성을 부여함으로써 더 세밀하고 정확한 클러스터링을 가능케 하여 이에 따른 개인의 성향에 맞게 개인화된 상품을 추천하는 시스템을 설계하고자 한다.
PDF

Building of Database Retrieval System Based on Knowledge using FCM (FCM을 이용한 지식기반 데이터베이스 검색 시스템의 구축)

박계각;서기열;천대일;양원재
- Journal of the Korean Institute of Intelligent Systems
- /
- v.11 no.1
- /
- pp.88-93
- /
- 2001
기존의 데이터베이스 검색시스템은 사용자의 검색 조건에 정확히 일치하는 데이터가 데이터베이스 내에 존재할 경우에만 사용자에게 해당 데이터를 제공할 수 있고, 사용자의 검색조건을 정확히 만족하는 데이터가 없을 경우에는 적절한 데이터를 제공할 수 없는 문제점이 있다. 이러한 문제를 해결하기 위하여 본 논문에서는 FCM의 클러스터증가 및 재초기화 알고리즘을 제안하였고, FCM을 이용하여 데이터베이스 내의 데이터로부터 구축된 지식기반 데이터베이스(KDB)와 구축된 이미지 데이터베이스와 연동을 통하여 사용자의 요구에 가장 근접한 데이터를 제시해 주는 검색시스템을 제안하였다. 본 연구에서 제안된 수법을 우체국의 우편주문안내책자를 이용한 선물고르기 DB 검색 시스템에 적용하여 그 유효성을 확인하였다.
PDF

A Spatial Data Mining Method by Clustering Analysis (클러스터링 분석에 의한 공간데이터마이닝 방법)

손은정;강인수;김태완;이기준
- Proceedings of the Korean Information Science Society Conference
- /
- 1998.10b
- /
- pp.161-163
- /
- 1998
지리정보시스템과 같이 방대한 양의 공간데이터를 다루는 응용시스템에서 공간데이터베이스로부터 규칙적인 특성이나, 혹은 관심 있는 지식을 추출해내는 공간데이터마이닝의 역할은 매우 중요하다. 이를 위해 지금까지 이루어진 방법들에는 여러 가지가 있지만 그 중에서 대표적인 방법이 클러스터링으로 이는 단지 기하학적인 거리에 기반을 둔 공간적인 집중성과 분포도를 찾는 데에만 한정되어 있다. 그러나, 공간데이터마이닝을 위해서는 공간클러스터가 형성된 원인을 분석하는 것 또한 필요하다. 따라서 본 연구에서는 공간 클러스터링에서 얻어진 결과를 다른 공간적인 객체와의 연관성을 분석하여 공간적 집중성과 분포도를 유발하는 원인을 찾는 방법을 다룬다. 우선 몇 가지의 거리를 정의하는 것에 의해 클러스터와 공간객체사이의 연관성을 분석하는 방법을 제시하고, 생성된 공간 클러스터가 다수의 공간객체에 영향을 받을 경우, 그 공간 클러스터를 각각 단위클러스터로 분리하는 방법을 제시한다.

병렬컴퓨터 구조가 업무에 미치는 영향

Korea Database Promotion Center
- Digital Contents
- /
- no.10 s.65
- /
- pp.89-97
- /
- 1998
본 기사에서는 현재 시장을 지배하는 세 종류의 병렬 컴퓨터 구조들, 즉 대칭 멀티 프로세서 구조(SMP), 클러스터 구조, 그리고 ccNUMA 구조(NUMA로 더 잘 알려져 있음)에 대한 오해에 관해 이야기하고자 한다. 각각의 구조들이 가진 특성들이 OLTP환경, 의사 결정 지원 작업 부하량, 고효용성, 그리고 시스템 관리 측면에 어떠한 영향을 끼치는가 하는 문제에 토론의 초점을 맞추고자 한다.
PDF

An implementation of parallel search system based on MPI Middleware (MPI 미들웨어에 기반한 병렬검색 시스템 구현)

이정훈;강미경
- Proceedings of the Korean Information Science Society Conference
- /
- 2003.04a
- /
- pp.52-54
- /
- 2003
본 논문은 MPI 미들웨어에 기반하여 데이터베이스에 포함되어 웹에 의해 제공되는 정보들을 고속으로 검색할 수 있는 분산 병렬 검색 시스템을 구현한다. 지리적으로 산재한 막대한 양의 정보를 다루어야 히는 생물정보 분야 응용의 요구에 부합하기 위하여, LINUX를 탑재한 3 대의 PC로 구성된 클러스터를 구축하고 CGI 구동 프로그램, 마스터와 슬레이브로 구성된 MPI 프로세스를 구현하였으며 메시지 큐. MPI 프리미티브. HTTP 1.1 프로토콜에 의해 서로 통신한다. 마스터는 CGI의 요청에 따라 슬레이브에게 명령을 내려 동시에 해당 웹 페이지에 대한 검색을 수행하며 이를 통합하여 CGI에게 전달한다. 마스터는 다수의 CGI 요청들을 직렬화할 뿐 아니라 슬레이브들과의 동기화에 의해 최종적인 검색 결과를 수행한다. 본 논문에서 구현된 클러스터는 특정 어댑터의 추가 구현에 의해 새로운 데이터베이스에 대한 검색 기능을 추가할 수 있으며 동일한 운영체제와 미들웨어를 갖는 노드를 추가함으로써 협력 검색에 있어서 보다 많은 컴퓨터를 참여시킬 수 있다.
PDF

Health Diagnosis System of Pet Dog Using ART2 Algorithm (ART2 알고리즘을 이용한 애견 진단 시스템)

Jung, Jae-Sung;Jun, Bong-Gi;Kim, Kwang-Baek
- Proceedings of the Korean Institute of Information and Commucation Sciences Conference
- /
- 2007.10a
- /
- pp.377-382
- /
- 2007
본 논문에서는 애견 질병에 대한 전문적인 지식이 부족한 일반인들을 대상으로 자신의 애견 건강상태를 파악 할 수 있는 진단 시스템을 제안한다. 제안된 진단 시스템은 105가지 질병과 각 질병의 증상을 데이터베이스에 구축하여 입력된 증상을 통해서 애견의 질병을 도출한다. 본 논문에서는 신경망의 자율 학습 방법인 ART2 알고리즘을 적용하여 질병을 클러스터링 하고 그 결과 값인 클러스터의 출력값과 연결강도를 데이터베이스에 저장한다. 각 질병의 증상과 관련된 질의 결과를 입력 벡터로 제시하여 학습된 질병 정보와 비교하여 애견의 건강 상태를 진단한다. 애견의 건강 상태를 진단하는데 있어서 질병과 증상의 정확한 정보는 매우 중요하다. 따라서 본 논문에서는 질병과 증상의 정보를 데이터베이스로 구축하고 질병과 증상 정보를 효율적으로 관리할 수 있도록 하였다. 제안된 진단 시스템을 구현하여 수의학 전문의가 분석한 결과, 본 논문에서 제안한 시스템이 애견 질병의 보조 진단 시스템으로서의 가능성을 확인하였다.
PDF

Realignment of Clients in Client-server Database System (클라이언트-서버 데이터베이스에서 의 온라인 클라이언트 재배치)

Park, Young-B.;Park, J.
- The KIPS Transactions:PartD
- /
- v.10D no.4
- /
- pp.639-646
- /
- 2003
Conventional two-tier databases have shown performance limitation in the presence of many concurrent clients. To this end, the three-tier architecture that exploits similarities in client's object access behavior has been proposed. In this system, clients are partitioned into clusters, and object requests can be then served in inter-cluster manner. Introducing an intermediate layer between server(s) and clients enables this. In this paper, we introduce the problem of client realignment in which access behavior changes, and propose on-line client clustering. This system facilitates adaptive reconfiguration and redistribution of sites. The core issue in this paper is to demonstrate the effectiveness of on-line client clustering. We experimentally investigate the performance of the scheme and necessary costs.
https://doi.org/10.3745/KIPSTD.2003.10D.4.639 인용 PDF KSCI

Search Result 62, Processing Time 0.023 seconds

이메일무단수집거부

이용약관

제 1 장 총칙

제 2 장 이용계약의 체결

제 3 장 계약 당사자의 의무

제 4 장 서비스의 이용

제 5 장 계약 해지 및 이용 제한

제 6 장 손해배상 및 기타사항

Detail Search

Image Search (β)