• 제목/요약/키워드: 역 연관규칙

검색결과 14건 처리시간 0.025초

Boolean Analyzer를 이용한 역 연관규칙의 발견 (Finding negative association rules with Boolean Analyzer)

  • 이종인;박상호;강윤희;박선;이주홍
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2003년도 가을 학술발표논문집 Vol.30 No.2 (1)
    • /
    • pp.187-189
    • /
    • 2003
  • 연관 규칙이 구매한 항목에 관심을 가져 구매 항목간의 규칙을 생성하는 것이라면 역 연관규칙은 구매하지 않은 항목에도 관심을 가짐으로써 더욱 효과적으로 데이터 마이닝을 하려는 시도이다. 역 연관규칙을 찾기 위한 기존의 방법들은 규칙의 일부분만 찾거나. 연관규칙을 찾는 알고리즘보다 더 복잡한 알고리즘의 사용으로 역 연관규칙을 찾는데 어려움이 있다. 이에 본 논문에서는 ITEM들 사이의 dependency를 이용하는 Boolean Analyzer를 사용하여 보다 간단한 과정으로 역 연관규칙을 생성하는 방법을 제시하고, 실험을 통하여 Boolean Analyzer로 역 연관규칙을 찾고 다른 알고리즘과 비교를 통해 보다 다양한 규칙을 찾을 수 있음을 보여준다.

  • PDF

상대적 규칙 정확도의 균형화에 의한 연관성 측도의 개발 (Development of association rule threshold by balancing of relative rule accuracy)

  • 박희창
    • Journal of the Korean Data and Information Science Society
    • /
    • 제25권6호
    • /
    • pp.1345-1352
    • /
    • 2014
  • 데이터마이닝 기법 중에서 연관성 규칙은 연관성 평가 기준을 기반으로 하여 데이터베이스에 포함되어 있는 항목들 간의 관련성을 탐색하는 기법이다. 일반적인 연관성 규칙 기법과는 달리 역의 연관성 규칙은 하나의 항목집합이 발생하지 않으면 다른 항목집합도 발생하지 않는다는 규칙을 찾아내는 것이다. 이러한 역의 연관성 규칙을 일반적인 연관성 규칙과 함께 생성하면 기업체에서 특정 제품을 판매하기 위해서는 그 제품만의 마케팅뿐만 아니라 더 나아가 어떤 제품의 마케팅이 필요한 지에 대한 정보를 파악할 수 있다. 이를 위해 본 논문에서는 이러한 두 종류의 연관성 규칙에 적용 가능한 균형화된 기여 상대적 규칙 정확도를 연관성 평가 기준으로 제안하고자 한다. 또한 Piatetsky-Shapiro (1991)가 제안한 흥미도 측도가 가져야 할 조건들을 점검한 후, 예제를 통하여 제안된 측도와 연관성 규칙에 적용 가능한 의학진단분야의 평가 측도들의 유용성을 비교하였다. 그 결과, 기여 상대적 정확도와 역의 기여 상대적 정확도의 크기가 다르게 나타나면 연관성의 정도를 명확하게 설명하기가 어려우므로 이들 두 측도를 동시에 고려한 균형화된 기여 상대적 규칙 정확도를 이용하는 것이 가장 바람직하다는 사실을 확인하였다.

역 연관규칙을 이용한 타겟 마케팅 (Target Marketing using Inverse Association Rule)

  • 황준현;김재련
    • 지능정보연구
    • /
    • 제9권1호
    • /
    • pp.195-209
    • /
    • 2003
  • 데이터마이닝의 목적은 알려지지 않은 유용한 정보를 얻어 경영에 활용하려는 것이다. 데이터마이닝의 한 기법인 연관규칙도 마찬가지의 목적을 가지고 있다. 하지만 연관규칙 기법으로 생성된 결과는 모두 같기 때문에 타겟 마케팅에 적용 시 그 마케팅 전략은 같을 수밖에 없다. 본 논문에서는 연관규칙을 이용하여 타겟 마케팅에 적용 시에 데이터마이닝의 목적에 부합하는 새로운 규칙을 제안한다. 새로운 규칙이란 연관규칙과 같이 고객이 구매한 항목에 대해 관심을 가져 구매 항목간의 규칙을 생성하는 것뿐만 아니라 구매하지 않은 항목에 대해서도 관심을 가짐으로써 구매하지 않은 항목간의 규칙을 생성하여 타겟 마케팅에 필요한 정보를 생성하는 것을 말한다. 이러한 정보를 이용하면 타겟 항목을 바로 마케팅 하는 전략뿐만 아니라 타겟 항목을 판매하기 위하여 다른 항목을 마케팅 하는 전략도 가능하게 된다. 그 이유는 새로운 규칙 에 의해 생성된 다른 항목의 마케팅이 타겟 항목의 판매를 촉진시키기 때문이다. 본 논문에서는 타겟 마케팅에 적용하기 위한 새로운 규칙과 전략을 설명하고 예제를 통하여 실제 데이터베이스에서 기존 전략 외에 새로운 전략을 생성시키는 과정을 설명한다.

  • PDF

모든 가능한 진단도구를 활용한 균형비교신뢰도의 제안 (Proposition of balanced comparative confidence considering all available diagnostic tools)

  • 박희창
    • Journal of the Korean Data and Information Science Society
    • /
    • 제26권3호
    • /
    • pp.611-618
    • /
    • 2015
  • 오늘날 정보 기술과 소셜미디어의 확산으로 인하여 빅 데이터에 관심이 집중되고 있다. 이를 처리하기 위한 기술 중의 하나가 데이터마이닝기법인데, 이들 중에는 연관성 규칙이 많이 활용되고 있다. 연관성 규칙은 방향에 따라 양, 음, 그리고 역의 연관성 규칙 등이 존재하며, 평가 기준을 설정하고자 하는 경우에는 이들 세 가지 연관성 규칙을 동시에 고려하는 것이 바람직하다고 할 수 있다. 이를 위해 본 논문에서는 의학진단분야에서 활용되고 있는 진단도구들 중에서 민감도, 특이도, 위양성도, 그리고 위음성도를 고려한 균형비교신뢰도를 제안하고자 한다. 또한 흥미도 측도가 가져야 할 조건들을 점검한 후, 예제를 통하여 측도의 유용성을 고찰하였다. 그 결과, 균형비교신뢰도는 비교신뢰도와 역의 비교신뢰도가 양의 값을 가지는 경우에는 양의 값을 가지며, 이들 두 값이 음인 경우에는 음으로 나타났다. 따라서 연관성 규칙의 평가 기준 관점에서 볼 때 비교신뢰도와 역의 비교신뢰도를 개별적으로 이용하기 보다는 균형비교신뢰도를 활용하는 것이 더 바람직하다고 할 수 있다.

병렬처리를 이용한 효율적인 수량 연관규칙 (Efficient Quantitative Association Rules with Parallel Processing)

  • 이혜정;홍민;박두순
    • 한국멀티미디어학회논문지
    • /
    • 제10권8호
    • /
    • pp.945-957
    • /
    • 2007
  • 수량 연관규칙은 대량의 데이터베이스에 존재하는 데이터 중 수량적 속성이 강한 데이터를 항목으로 만들어 이진 연관규칙에 적용한다. 만약 중요한 의미를 내포하는 수량 데이터의 정의역 범위가 넓을 경우 정의역을 최소지지도에 만족하는 적정 구간으로 분할하여 빈발구간 항목을 생성하는 작업이 필요하다. 이러한 빈발구간 항목은 어떻게 생성되었느냐에 따라 생성된 규칙의 신뢰도에 큰 영향을 미치게 된다. 따라서 본 논문에서는 빈발구간 항목을 효율적으로 생성하는 방법을 제시한다. 본 논문에서 제안하는 방법은 기존 방법들에 비해 의미가 있는 구간을 분실하지 않고 최소지지도에 근접하는 세밀한 빈발구간을 생성하기 때문에 데이터가 가진 특성의 손실을 최소화할 수 있는 효율적인 방법이다. 또한 병합이 불필요한 곳에서는 병합을 시도하지 않고 빈도가 높은 구간만을 취해 병합하므로 수량의 정의역이 넓을 경우 기존 방법에 비해 실행속도가 월등히 빠른 효율적인 방법이다. 그리고 인구센서스와 같은 실제로 사용되는 데이터를 이용하여 클루닉스 HPC 시스템에서 병렬처리 수행을 통하여 제안 방법이 우수함을 보였다.

  • PDF

다차원 데이터 큐브 모델을 이용한 구제역의 위기 대응 방안 분석 (Crisis Management Analysis of Foot-and-Mouth Disease Using Multi-dimensional Data Cube)

  • 노병준;이종욱;박대희;정용화
    • 한국콘텐츠학회논문지
    • /
    • 제17권5호
    • /
    • pp.565-573
    • /
    • 2017
  • 재난 재해 발생 시, 정부의 위기 대응방식에 대한 사후 평가는 향후 유사한 위기 상황이 발생할 경우를 대비하고 국가의 장기적인 위기관리의 초석이 되는 필수적인 단계이다. 본 논문에서는 국내에서 발생한 구제역에 관하여 정부에서 어떠한 대응 전략을 펼쳤는지를 언론에 보도된 기사 내용을 통해 분석한 연구로써, 먼저 온라인 뉴스 기사로부터 구제역에 관한 키워드들을 추출하여 데이터 큐브를 구성한 후, OLAP 연산과 연관규칙 분석을 수행함으로써 시간 축에 따른 정부의 위기상황 대응행동 및 그에 따른 사회적 파급 효과들을 분석한다. 구제역이 가장 심각했던 2010년 11월부터 2011년 12월까지 국내에서 발생한 구제역에 관한 정부의 위기 상황 대응 방법을 사례분석을 통해 분석하였다.

흥미도 측도 관점에서 상대적 인과 강도의 고찰 (A study on the relatively causal strength measures in a viewpoint of interestingness measure)

  • 박희창
    • Journal of the Korean Data and Information Science Society
    • /
    • 제28권1호
    • /
    • pp.49-56
    • /
    • 2017
  • 빅 데이터를 분석하기 위한 기법 중에서 연관성 규칙은 여러 가지 연관성 평가 기준을 이용하여 항목들 간에 연관성 유무를 탐색하는 기법이다. 이러한 연관성 규칙 기법은 규칙의 생성 방향에 따라 정과 부, 그리고 역의 연관성 규칙 등이 있다. 본 논문에서는 여러 가지 상대적 인과 강도를 흥미도 측도의 관점에서 어떤 유형의 연관성 규칙에 적용 가능한 지를 탐색하는 동시에 기존의 기본적인 평가측도 증에서 여러 가지 유형의 신뢰도들과의 관계를 규명하고자 하였다. 그 결과, 후항변수가 발생할 비율이 0.5 이상이면 Good이 제안한 측도 ($RCS_{IJ1}$)가 Lewis가 제안한 측도 ($RCS_{LR1}$) 보다 값의 변화폭이 더 크므로 $RCS_{IJ1}$이 더 바람직한 측도가 되며, 그 비율이 0.5 미만이면 $RCS_{LR1}$이 더 바람직하다고 할 수 있다.

역 연관규칙을 이용한 타겟 마케팅 (Target Marketing using Inverse Association Rule)

  • 황준현;김재련
    • 한국지능정보시스템학회:학술대회논문집
    • /
    • 한국지능정보시스템학회 2002년도 추계정기학술대회
    • /
    • pp.241-249
    • /
    • 2002
  • Making traditional plan of target marketing based on Association Rule has brought restriction to obtain the target of marketing. This paper is to present Inverse Association Rule as a new association rule for target marketing. Inverse Association Rule does not use information about relation between items that customers purchase like Association Rule, but use information about relation between items that customers do not pruchase. By adding Inverse Association Rule to target marketing, we generate new marketing rule to look for new target of marketing. From new marketing rule, this paper is to show direct marketing about target item and indirect marketing about another item associated with target item to sell target item. The reason is that sales of the item associated with target item have an influence on sales of target item.

  • PDF

연관규칙을 활용한 효율적인 정보통신윤리 교육 방법 연구 (The Study of an Efficient Information and Communication Ethics Education Based on Association Rule)

  • 조명흠;주길홍
    • 한국정보교육학회:학술대회논문집
    • /
    • 한국정보교육학회 2007년도 하계학술대회
    • /
    • pp.27-32
    • /
    • 2007
  • 인터넷이 발전함에 따라 정보화의 역기능 현상들도 방대해지고 있으며, 그에 대한 피해도 증가하고 있다. 이러한 상황 속에서 정보통신 윤리교육은 학생 개개인의 정보통신 윤리의식 수준과 정보화 역기능의 진단 및 파악 없이 동일한 교육 내용으로 이루어져 있기 때문에 체계화된 정보통신 윤리교육이 이루어지지 않고 있으며, 학생들의 정보통신 윤리의식조차 불명확해지고 있다. 이는 정보화의 역 기능으로 인해 발생되는 문제를 미리 예방할 수 없으며, 그에 대한 대처도 어렵게 하고 있다. 따라서 본 논문에서는 학생들의 정보화 사회의 역기능인 인터넷 중독을 진단하고 하위 중독 범주들 간의 연관 관계를 데이터마이닝 기법으로 탐사하여 개인별 추출 결과에 따른 특성화된 정보 통신 윤리 교육 방법을 설계하고자 한다.

  • PDF

2-패스 색인 기법과 규칙 기반 질의 처리기법을 이용한 고속, 고성능 질의 응답 시스템 (A Fast and Powerful Question-answering System using 2-pass Indexing and Rule-based Query Processing Method)

  • 김학수;서정연
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제29권11호
    • /
    • pp.795-802
    • /
    • 2002
  • 본 논문은 2-패스 점수 부여 방법에 기초한 정답 후보 색인기를 이용하여 고속, 고정밀의 질의 응답을 실현하는 한국어 질의 응답 시스템을 제안한다. 제안한 정답 후보 색인기의 색인 과정은 다음과 같다. 먼저, 대상 문서에 포함된 모든 정답 후보들을 추출한다. 그리고, 2-패스 점수 부여 방법을 이용하여 각 정답 후보와 밀접하게 연관된 주변 내용어들에게 점수를 부여한다. 마지막으로 데이터베이스에 각 정답과 점수가 부여된 내용어들을 역파일 형태로 저장한다. 사용자의 질의에 포함된 의도(질의 유형)을 파악하기 위해서는 수동으로 구축된 lexico-syntactic 패턴을 이용한다. 이러한 색인 방법과 질의 처리 방법을 이용하여, 제안된 질의 응답 시스템은 빠른 응답 시간을 보장하고 정확률을 향상시킨다.