• 제목/요약/키워드: 연관 연구

검색결과 8,966건 처리시간 0.038초

사용자 구분에 의한 지역적 연관규칙의 유도 (Deriving Local Association Rules by User Segmentation)

  • 박세일;이수원
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2001년도 봄 학술발표논문집 Vol.28 No.1 (B)
    • /
    • pp.250-252
    • /
    • 2001
  • 연관규칙 탐사기법은 트랜잭션을 대상으로 항목간, 또는 속성간의 연관관계를 발견하는 방법으로, 데이터 집합의 구조를 쉽게 통찰할수 있다는 장점으로 인하여 활발히 연구되어져 왔다. 그러나 현재까지의 연구들은 전체 사용자중 공통적인 특성을 지닌 사용자 그룹이 존재할 경우, 그러한 그룹별 연관규칙을 찾아낼 수 없다는 한계점을 지닌다. 본 논문에서는 이러한 점을 해결하기 위하여, 속성선택 및 사용자 구분 기법을 이용하여 사용자를 부분집합으로 구분하고, 그 부분집합별로 연관규칙을 발견한다. 또한 위와 같이 얻어진 연관규칙이 전체 사용자를 대상으로 한 연관규칙보다 해당 부분집합에 더욱 적합하다는 사실을 여러 연관규칙 평가치를 이용하여 평가한다.

  • PDF

퍼지집합을 이용한 실수값 속성 사이에 존재하는 연관규칙의 발견 (Finding Association Rules among Real-valued Items using Fuzzy Sets)

  • 이지형;이광형
    • 한국지능시스템학회:학술대회논문집
    • /
    • 한국퍼지및지능시스템학회 1996년도 추계학술대회 학술발표 논문집
    • /
    • pp.115-118
    • /
    • 1996
  • 연관규칙(Association Rule)은 데이터 베이스에 존재하는 속성들 사이의 관계를 기술하는 것으로, 간단하면서도 사용자에게 많은 정보를 줄 수 있다. 그러나, 지금까지는 이진 데이터베이스에 존재하는 연관규칙의 발견에 대해서 주로 연구되어 왔으며, 실수값 속성을 갖는 데이터에 관한 연구는 미비하였다. 본 논문에서는 퍼지집합을 이용하여 실수값 사이에 존재하는 연관규칙을 기술하고, 그것을 찾아내는 방법을 제시한다. 제시하는 방법은 사용자에 의해서 정의된 언어항을 이용하여, 실수값 속성을 가진 데이터를 이진 데이터로 재구성한다. 그리고 재구성된 이진 데이터에 기존의 연관규칙 발견 방법을 이용하여 연관규칙을 찾아내고, 찾아진 연관규칙을 정의된 언어항을 이용하여 다시 기술한다.

  • PDF

검색어의 연관법칙 (ARMS : Association Rule for sMall Set)

  • 문상준;최재걸
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2004년도 가을 학술발표논문집 Vol.31 No.2 (2)
    • /
    • pp.10-12
    • /
    • 2004
  • 검색엔진에 사용자가 입력한 검색어를 분석하면 상호 연관이 있는 검색어들을 찾아낼 수 있다. 검색어들간의 상호 연관성을 찾기 위해서 데이타 마이닝 분야의 연관법칙을 위한 알고리즘을 적용하였다. 그러나 이 알고리즘들은 모두 일정 횟수 이상 검색된 검색어간의 연관법칙에 집중되어 있어서 일정 횟수 이상 검색되지 않은 검색어들은 버려진다. 이 연구에서는 이런 검색어들을 스몰 셋(small set)이라고 정의하고 스몰 셋의 연관법칙을 찾기 위한 방법을 제시한다. 실험결과는 이 연구에 제시한 방법이 효과적으로 동작하는 것을 입증해준다.

  • PDF

상품군 연관망 기반의 상품가치 평가모형 (Product Value Evaluation Models based on Itemset Association Chain)

  • 장용식
    • 지능정보연구
    • /
    • 제16권2호
    • /
    • pp.1-17
    • /
    • 2010
  • 연관분석에 의한 연관규칙은 상품 간 연관성을 나타내고 있으며, 교차판매와 상품진열 등의 마케팅 전략에 활용되고 있다. 그러나, 교차판매 효과를 반영하는 더 실질적인 상품가치를 평가한다면, 상품구색과 이윤극대화 등의 기업 의사결정에 더 유용하게 활용될 수 있을 것이다. 본 연구는 단일상품 간의 연관망과 상품군 간의 연관망 기반에서 상품의 순수가치, 이득가치, 손실가치로 구성되는 유효가치를 바탕으로 상품의 가치를 평가하는 수학적 모형을 제시하고, 두 모형에 대해 각각 예시를 통한 평가과정을 기술하였다. 이 경우, 상품군은 단일상품을 포함하기 때문에 상품군 간 연관망 기반에서의 상품가치 평가모형은 단일상품 기반의 평가모형을 포함하고 있다. 모형의 실질적인 유용성을 보이기 위하여, 국내 한 온라인 쇼핑몰의 과거 1년 간 의류 관련 거래데이터 표본을 이용하여 상품분류군 간의 연관규칙을 발견하고 상품분류별 유효가치를 평가하는 실험을 하였다. 표본은 총 106개 상품분류와 48,044건의 거래 데이터로 이루어져 있다. 먼저, SPSS Clementine 12.0을 이용하여 상품분류군 간 18개의 연관규칙을 발견하였다. 한편, 순수가치와 연관규칙을 바탕으로 이득가치, 손실가치를 계산하고 유효가치를 평가하는 JAVA 어플리케이션을 구현하였다. 유효가치 평가의 실험결과, 순수가치보다 큰 유효가치를 갖는 상품분류가 있는 반면, 순수가치 보다 작은 유효가치를 갖는 상품분류를 확인하였다. 본 연구는 상품 연관망에서 일차적인 관계만을 고려한 유효가치를 평가하였다. 향후, 다단계 연관성의 교차판매 효과를 반영하는 고차적인 평가모형 연구는 보다 효과적인 유효가치 평가를 가능케할 것이다.

퍼지 연관규칙과 연관규칙의 성능 평가 (Performance Estimation of Fuzzr Quantitative Association Rules and Crisp Quantitative Association Rules)

  • 손영경;김명원
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 봄 학술발표논문집 Vol.29 No.1 (B)
    • /
    • pp.235-237
    • /
    • 2002
  • 연관규칙(association rule)이란 데이터 베이스에 존재하는 속성들 사이에 유사성 또는 패턴을 기술하는 것으로, 사용자에게 데이터에 관한 유용한 조보를 줄 수 있다. 그러나, 지금가지의 연관규칙은 이진 (boolean) 데이터 베이스에 존재하는 연관규칙의 발견에 대해서 주로 연구되어 왔으며, 정량적(수치적, quantitative) 속성을 갖는 데이터에 대한 연관규칙의 연구는 미비하였다. 그 이유는 정량적 속성을 갖는 데이터를 기호적(nominal) 속성값으로 바꾼 후 연관규칙 보다 성능이 우수함을 보이고 있다. 또한 본 논문에서는 퍼지 연관규칙에서 소속함수(항목, 아이템, 속성값)의 모양과 개수를 데이터 분포에 대한 통계적 특성을 나타내는 히스토그램을 이용하여 소속함수를 자동 생성하는 효율적인 연관규칙 추출방법을 제안한다

  • PDF

학술DB에서 SNA(Social Network Analysis) 기법을 이용한 연관검색어 제공방안 연구 (A Study on Providing Relative Keyword using The Social Network Analysis Technique in Academic Database)

  • 김경용;서정연;선충녕
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2011년도 제23회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.79-82
    • /
    • 2011
  • 본 논문은 다양한 주제 분야의 연구 성과물을 제공하는 학술DB에서 주제어(Keyword) 정보를 바탕으로 SNA(Social Network Analysis)기법을 적용해 검색어와 연관도가 높은 연관검색어를 제공하는 것을 그 목적으로 한다. 이를 위해 주제어들 간의 가중치(Weight)를 계산한 뒤 Ego Network 분석을 통해 검색어와 연관된 연관주제어를 추출하고 이를 기존 학술DB에서 제공한 연관검색어와 비교 정리하였다. 그리고 정리된 결과를 연관규칙 마이닝기법, 유사계수를 적용해 연관도측면에서 비교 평가하였다.

  • PDF

지역별 발생집중 화물량 추정을 위한 산업연관분석의 Nonsurvey법 개발에 관한 연구 (Development of Nonsurvey Method of Input-Output Analysis for Production and Attraction Freight Flow Estimation According to Region)

  • AN, Sihyoung;IIDA, Katuhiro;MORI, Yasuo
    • 대한교통학회지
    • /
    • 제16권1호
    • /
    • pp.79-98
    • /
    • 1998
  • 교통계획의 수립은 사람과 화물의 이동상태에 대한 파악으로부터 시작되며 화물이동상태를 파악 하기 위한 가장 기본적인 데이터는 지역별 발생집중 화물량일 것이다. 이러한 지역별 발생집중 화물량의 추계방법중 추계의 간편성과 경제상황변화의 반영이 용이하다는 점에서, 최근 학자들의 상당한 주목 을 받으며 연구되고 있는 것이 산업연관분석을 응용한 물류해석방법이다. 그러나 이방법은 대상지역의 산업연관표를 기본 data로 하기 때문에 해당지역의 산업연관표의 존재 여부에 따라서 그 적용범위가 제한된다. 이러한 문제점을 해결하기 위해서 연구되고 있는 방법이 Nonsurvey법이다. Nonsurvey법은 대 지역의 산업연관표로부터 그 지역에 포함된 소지역의 산업연관표를 여러 가지 보조적인 데이터를 이용해 서 간접적으로 추계하는 방법이다. 본연구에서는 이러한 Nonsurvey법의 하나로서 대지역의 산업연관표 와 지역분해된 각 소지역의 산업부문별 생산량만을 이용해서 각 소지역의 발생집중화물량을 추계하는 방법을 제안했다. 그리고 일본의 긴키(Kinki)지역과 이에 속하는 4부현을 대상으로 본연구의 방법으로 추계된 이출입양과 실제의 산업연관표상의 이출입량을 비교.분석함으로써 본 연구의 방법에 대한 검증을 실시했다. 본 연구에서 제아한 지역별 발생집중 화물량 추계방법의 특징은 다음과 같다. 첫째, 대지역내 각 소지역간의 이출입량이 분기계수라고 하는 산업관계표의 산업관계표의 행방향의 합에 대한 비율을 사용함으로서 간단히 추계가능 하다. 둘째, 추계된 소지역의 산업관계표는 대지역에 대한 시스템전체의 정합성이 유지된다. 셋째 분해되는 소지역의 수에 관계없이 각소지역의 이출입양에 대한 추계가 가능하다.

  • PDF

퍼지 일반화 계층을 이용한 일반화된 퍼지 정량 연관규칙 마이닝 (Mining Generalized Fuzzy Quantitative Association Rules with Fuzzy Generalization Hierarchies)

  • 한상훈;손봉기;이건명
    • 한국지능시스템학회:학술대회논문집
    • /
    • 한국퍼지및지능시스템학회 2001년도 춘계학술대회 학술발표 논문집
    • /
    • pp.8-11
    • /
    • 2001
  • 연관규칙 마이닝은 트랜잭션 데이터를 이루고 있는 항목간의 잠재적인 의존관계를 발견하는 데이터 마이닝의 한 분야이다. 정량 연관규칙이란 부류적 속성과 정량적 속성을 모두 포함한 연관규칙이다. 정량 연관규칙 마아닝을 위한 퍼지 기술의 응용, 정량 연관규칙 마이닝을 위한 일반화된 연관규칙 마이닝, 사용자의 관심도를 반영한 중요도 가중치가 있는 연관규칙 마이닝 등에 대한 연구가 이루어져 왔다. 이 논문에서는 중요도 가중치가 있는 일반화된 퍼지 정량 연관규칙 마이닝의 새로운 방법을 제안한다. 이 방법은 부류적 속성의 퍼지 개념 계층과 정량적 속성의 퍼지 언어항 일반화 계층을 일반화된 추출하기 위해 이용한다. 이것은 속성들의 수준별 일반화 계층과 속성의 중요도 가중치를 이용함으로써 사용자가 보다 융통성 있는 연관규칙을 마이닝할 수 있게 해준다.

  • PDF

Fault-Tree 기법을 이용한 해기사의 음주습관과 해양사고 사이의 연관성 분석에 관한 연구 (Study on Probability Analysis of Drinking Habits Affecting Marine Accidents Using Fault-Tree Analysis Method)

  • 조유경;임정빈;양원재
    • 한국항해항만학회:학술대회논문집
    • /
    • 한국항해항만학회 2012년도 추계학술대회
    • /
    • pp.145-147
    • /
    • 2012
  • 해양사고의 70-80%가 인적 오류(Human Factor)에 기인한 것으로 알려져 있다. 특히 인적 오류 중 선원의 피로도는 실제 해양사고로 이어질 개연성이 대단히 큰데, 이러한 피로도는 선원의 음주로부터 비롯된 경우가 존재하며 해양사고와 연관이 있을 것으로 추정된다. 그러나 이러한 선원의 음주습관과 해양사고의 연관성에 관한 연구는 아직 정립된 바가 없는 실정이다. 이에 본 연구에서는 음주습관이 신체 및 행동에 미치는 영향을 알아보고 과거 해양사고 통계를 분석하여 해기사의 음주습관과 해양사고의 연관성에 대해 Fault-Tree 기법을 적용하여 연구하였다. 연구결과, 해기사의 음주습관은 피로도와 직접 연관성을 밝혀 낼 수 있지만 해양사고와 직접적인 연관성은 미약한 것으로 파악되었다. 그러나 선원의 피로도와 직접 연관된 음주습관은 해양사고 유발 원인이기 때문에 본 연구결과에 대한 타당성은 추후 다양한 실험을 통한 연구한 것으로 조사된다.

  • PDF

데이터마이닝에서 수량연관규칙 탐사방법

  • 박원환
    • 한국통계학회:학술대회논문집
    • /
    • 한국통계학회 2003년도 춘계 학술발표회 논문집
    • /
    • pp.91-96
    • /
    • 2003
  • 연관규칙은 데이터베이스에 잠재되어 있는 유용한 정보를 탐사하는 방법으로 데이터마이닝의 한 분야이다. 이는 항목의 발생유무만을 고려하는 이진연관규칙에 대한 연구가 주였으나, 최근에는 항목의 수량까지 고려하는 수량연관규칙 탐사가 소개되고 있다. 수량연관규칙은 수량속성 항목을 임의의 방법으로 여러 개의 소구간 항목으로 분할한 후, 각각을 이진항목으로 취급하여 연관규칙을 탐사하는 방법이다. 본 논문에서는 분할된 여러 소구간 분할항목들 중에서 필요 소구간 항목만을 선택적으로 탐사하는 방법을 제안한다. 제안방법은 블린항목제약식을 사용하여 수량항목의 탐사범위를 제한함으로써 모든 분할을 탐사하지 않고 필요 소구간만을 탐사하기 때문에 탐사시간을 단축할 수 있다.

  • PDF