• 제목/요약/키워드: 데이터 집계

검색결과 215건 처리시간 0.026초

집계큐브리트리 :효율적인 범위-집계 질의의 수행을 위한 큐브트리 (Aggregate Cubetree : Cubetree for Efficient Execution of Range-Aggregate Query)

  • 홍석진;송병호;이석호
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2001년도 봄 학술발표논문집 Vol.28 No.1 (B)
    • /
    • pp.163-165
    • /
    • 2001
  • 데이터웨어하우스 환경에서는 범위-집계 질의를 효율적으로 수행하기 위해 데이터큐브로 저장뷰를 구성한다. 큐브트리란 이러한 저장뷰를 R-Tree형태로 구성하는 기법으로, 효율적인 데이터 접근성을 제공하지만 범위-집계 질의 범위 내의 모든노드를 접근해야 하는 단점이 있다. 이 논문에서는 중간노드의 MBR에 자식 노드 레코드들의 집단함수 값을 저장하여, 질의 범위에 포함되는 중간노드의 경우 단말노드를 접근하지 않고 효율적으로 범위-집계 질의를 수행할 수 있는 집계큐브트리를 제안하였다. 집계큐브트리는 기존의 큐브트리에 비해, 항상 적은 수의 노드 접근으로 질의를 수행하며 질의 범위의 크기가 커질수록 좋은 성능을 보인다.

  • PDF

시공간지원 집계 함수 설계 (Design of Aggregate Function for Spatiotemporal)

  • 신현호;최보윤;지정희;김상호;류근호
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2003년도 춘계학술발표논문집 (하)
    • /
    • pp.1503-1506
    • /
    • 2003
  • 시공간 데이터베이스는 실세계에 존재하는 다양한 유형의 객체에 대한 공간 관리와 이력정보를 동시에 제공함으로써 사용자에게 시공간 데이터에 대한 저장 및 질의 수단을 제공한다. 질의 연산 중 집계 연산은 특정한 조건을 만족하는 데이터에 대하여 계산을 수행한 결과 값을 반환하는 연산으로, 다양한 분야에서 데이터의 분석을 위해 사용된다. 그러나 기존의 집계에 대한 연구는 시간 또는 공간에만 편중되어 시간과 공간 제약을 모두 가진 실세계의 응용에 직접 적용할 수 없다. 따라서 이 논문에서는 실세계 응용들의 분석을 위한 시공간 집계함수를 제안하고, 실제 응용에서의 분석을 위한 질의 예를 보인다. 제안된 시공간 집계함수에 의해 사용자는 응용시스템에 따른 시공간데이터 분석을 위해 간략하고 편리한 질의 할 수 있다.

  • PDF

OLAP 큐브의 다중 차원계층구조에 대한 분석 (Analysis of Multiple Dimension Hierarchies of OLAP Cubes)

  • 박영선;김지현;임윤선;김명
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2004년도 가을 학술발표논문집 Vol.31 No.2 (2)
    • /
    • pp.115-117
    • /
    • 2004
  • 롤업과 드릴다운은 다차원 데이터 분석을 위한 주요 연산으로, 각 차원에 정의된 계층구조를 통해 상세 데이터로부터 점차적으로 되는 정보를 분석가에게 제공한다. 이러한 연산 속도를 고속화하기 위해 OLAP 시스템은 사전에 집계 테이블들을 생성해 놓는다. 각 차원은 다중 계층구조를 가질 수도 있으며, 이런 경우 집계 테이블들을 모두 생성하게 되면 데이터 폭발 현상이 발생하게 된다. 본 연구에서는 다중계층 구조를 분류하고, 집계 테이블과 데이터 큐브의 크기를 계산하는 모델을 정립하였다. 이를 통해 분석가는 다중 계층구조에 따른 큐브 크기를 미리 예측할 수 있으며 계층 구조의 모양과 개수를 변경하여 데이터의 양을 조절할 수 있다.

  • PDF

DSMS에서 영역을 포함하는 공간 연속질의 처리를 위한 R-tree기반의 집계기법 (Aggregation Method using R-tree for Spatial Continuous Query in DSMS)

  • 김상기;이연;이동욱;오영환;배해영
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2008년도 한국컴퓨터종합학술대회논문집 Vol.35 No.1 (C)
    • /
    • pp.80-84
    • /
    • 2008
  • DSMS는 USN과 같은 환경으로부터 스트림데이터를 실시간으로 입력 받아 등록된 연속질의를 처리하는 시스템이다. DSMS는 등록된 연속질의 처리를 위해 필요한 데이터를 버퍼에 관리하며, 스트림데이터의 저장기법에 따라 연속질의 처리 성능 및 버퍼 저장비용이 개선될 수 있으며, DSMS에서 연속질의는 특정 스트림데이터에 대해 일정한 기간 동안의 평균 값, 최대 소 값, 누적 값 등의 집계 연산을 요구하는 경우가 많다. 기존의 DSMS에서는 이러한 집계 연산이 필요한 연속질의의 효율적인 처리를 위해 LINT, BINT등의 자원 공유 집계 처리기법이 제안 되었다. 하지만 기존의 자원공유 집계 기법들은 위치 값을 포함하는 GeoSensing 데이터에 대한 고려를 하지 않았다. 본 논문에서는 공간 DSMS에서 공간영역질의 기반의 연속질의를 효율적으로 처리하기 위한 R-tree기반의 집계기법을 제안한다. 이는 각각의 연속질의에 포함된 공간 영역을 R-tree 인덱스로 구성하고, 연속질의에 필요한 공간 스트림데이터에 대한 집계값을 저장하여 연속질의를 처리하는 것이다. 제안기법은 공간 DSMS에서 공간영역 기반의 연속질의 처리 성능을 개선할 수 있으며, R-tree 기반으로 해당 영역에 대한 데이터 만을 버퍼에 관리하여 저장비용을 줄일 수 있다.

  • PDF

데이터 웨어하우징 환경에서 질의 처리를 위한 새로운 기법 (A New Method for Processing Queries in Data Warehouse Environment)

  • 김윤호;김진호;감상욱
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2001년도 봄 학술발표논문집 Vol.28 No.1 (B)
    • /
    • pp.121-123
    • /
    • 2001
  • 대용량의 데이터가 저장되는 데이터 웨어하우징 환경에서는 조인이나 집계 함수와 같은 고비용의 연산의 효율적인 처리는 매우 중요하다. 본 논문에서는 집계 함수(aggregate function)와 조인이 모두 포함된 질의를 처리하는 새로운 기법을 제안한다. 제안하는 기법은 먼저 차원 테이블(dimension table)을 미리 그룹핑한 후, 비트맵 조인 인덱스(bitmap join index)를 이용하여 조인을 처리하는 방식을 사용한다. 이 결과, 사실 테이블만을 접근하여 집계 함수를 처리함으로써 기존 기법이 가지는 성능 저하의 문제점을 해결할 수 있다. 기존 기법과 제안하는 기법에 대한 비용 모델(cost model)을 정립하고, 이를 기반으로 시뮬레이션을 수행함으로써 제안된 기법의 우수성을 규명한다.

  • PDF

무선 센서 네트워크 미들웨어에서의 레벨-기반 데이터 집계 질의 동기화 기법 (A Level-based Data Aggregation Query Synchronization Method for Wireless Sensor Network Middleware)

  • 홍승태;나소라;윤민;장재우
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2009년도 추계학술발표대회
    • /
    • pp.203-204
    • /
    • 2009
  • 최근 무선 센서 네트워크(Wireless Sensor Network)에 대한 관심이 증대되고 있으며, 센서노드의 제한된 에너지를 효율적으로 사용하기 위한 센서 네트워크 미들웨어에 대한 연구가 활발히 수행되어 왔다. 그러나 기존 연구들은 데이터 집계 질의 수행 시 각 센서 노드의 동기화를 라우팅 프로토콜에 의존하고 있으며, 미들웨어에서의 자체적인 동기화 기법에 대한 연구는 미흡한 실정이다. 따라서 본 논문에서는 센서 네트워크 미들웨어 자체적으로 데이터 집계 질의 동기화를 지원하는 레벨-기반 데이터 집계 질의 동기화 기법을 설계한다.

맵리듀스에서 집계 질의 스트림의 효율적인 처리 기법 (Efficient Processing of an Aggregate Query Stream in MapReduce)

  • 최현진;이기용
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제3권2호
    • /
    • pp.73-80
    • /
    • 2014
  • 맵리듀스는 빅데이터 분석 및 처리에 널리 사용되는 프로그래밍 모델이다. 빅데이터 분석을 위해 흔히 사용되는 질의 중 하나는 집계 질의(aggregate query)이다. 본 논문에서는 여러 사용자가 동시에 여러 집계 질의를 계속해서 요청하는 경우, 맵리듀스를 사용하여 이들 질의를 효율적으로 처리하는 방법을 제안한다. 제안 방법은 각 집계 질의를 개별적으로 처리하지 않고, 여러 집계 질의를 묶어 하나의 최적화된 맵리듀스 잡(job)으로 만들어 일괄 처리한다. 그 결과로 제안 방법은 단순 방법에 비해 시간당 처리하는 질의 수를 크게 증가시킨다. 성능 평가를 통해, 제안 방법은 단순 방법에 비해 질의 처리 속도를 크게 향상시킴을 보인다.

지오센서 네트워크에서 센서 노드의 효율적인 에너지 관리를 위한 지정 경로 기반 데이터 집계 처리 기법 (A Data Aggregation Scheme based on Designated Path for Efficient Energy Management of Sensor Nodes in Geosensor Networks)

  • 윤민;김용기;라빈드라 비스타;장재우
    • 한국공간정보시스템학회 논문지
    • /
    • 제12권1호
    • /
    • pp.10-17
    • /
    • 2010
  • 지오센서 네트워크에 활용되는 센서 노드는 제한된 자원과 전력을 지닌다. 따라서, 에너지를 효율적으로 사용하여 데이터를 집계하는 라우팅 기법 연구가 필수적이다. 무선 센서 네트워크에서의 일반적인 데이터 수집은 각 센서 노드에서 수집된 데이터를 멀티홉 방식으로 싱크노드로 전송하는 방식이다. 하지만, 이러한 방식은 두 가지의 문제점을 지닌다. 첫째, 기존 연구는 데이터를 전송하기 위해 부모 노드를 선정하는 과정에서 불필요한 데이터 전송을 요구한다. 둘째, 각각의 소스 노드는 서로 다른 전송 경로를 가지기 때문에 많은 전송 횟수가 발생한다. 이러한 문제점을 해결하기 위해, 본 논문에서는 효율적인 에너지 관리를 위한 지정 경로 기반의 데이터 집계 처리 기법을 제안한다. 제안하는 기법은 데이터를 전송할 경로를 미리 선정하여 불필요한 데이터 전송을 감소시키며, round-robin 메커니즘을 이용하여 모든 센서 노드가 데이터를 집계하는 데 참여하도록 한다. 마지막으로, 기존 연구인 directed diffusion(DD) 및 hierarchical data aggregation(HDA)과의 성능 평가를 통해 제안하는 기법이 에너지 효율적임을 보인다.

공간 데이터 재구축을 통한 음식업종 매출액 영향 요인 분석 : 이종 공간 데이터의 집계단위 변환을 중심으로 (Analyzing Influence Factors of Foodservice Sales by Rebuilding Spatial Data : Focusing on the Conversion of Aggregation Units of Heterogeneous Spatial Data)

  • 노은빈;이상경;이병길
    • 한국측량학회지
    • /
    • 제35권6호
    • /
    • pp.581-590
    • /
    • 2017
  • 이 연구에서는 서울연구원 제공 집계구 자료를 이용하여 유동인구와 공간 특성, 공간자기상관이 음식업종의 매출액에 미치는 영향을 분석한다. 최근 공공 분야의 빅데이터가 증가하고 있지만 자료집계 단위가 달라 연구에 어려움을 야기하는 경우가 많다. 본 연구에서도 종속변수인 매출액은 SKT 집계구 단위로, 공간 특성은 통계청 집계구와 행정동 단위로, 그리고 유동인구는 Point 정보로 구축되어 있다. 분석을 위해 먼저 SKT 집계구 단위로 모든 독립변수의 집계단위를 변환하였다. 공간자기상관 효과를 검정할 수 있는 모형인 SEM을 이용하여 회귀분석을 수행한 결과 매출액에 대한 공간자기상관의 영향이 확인되었으며, 또한 유동인구와 주변 종사자수, 집계 구 면적이 매출액에 정의 영향을 주는 것으로 나타났다. 또한, 강남구에 비해 중구, 영등포구, 송파구 매출액이 더 적은 것으로 나타났다. 이 같은 결과는 유동인구가 많고 주변 종사자수가 많은 지역, 그리고 음식업종 점포들이 몰려있는 지역이 창업에 유리하다는 것을 시사한다. 이 연구는 이종 공간 데이터의 집계단위 변환의 유용성 과 함께 지도상의 면적 비례로 집계단위를 변환하는 것의 한계를 보여줌으로써 후속 연구에 시사점을 제공한다.

로지트 모델 시물레이션에 의한 도시교통안전계획에 관한 연구

  • 김용수;이근철
    • 한국안전학회지
    • /
    • 제4권1호
    • /
    • pp.103-120
    • /
    • 1989
  • 최근 도시교통계획분야에 있어서 교통수요의 예측모델 또는 교통정책의 평가 모델로서 비집계(非集計) 모델에 관한 연구가 진행되고 있다. 이 비집계모델은 개개의 의사결정단위에 있어서 선택행동을 영역마다 집계하는 것이 아니고 의사결정레벨의 데이터률 그대로 모델로 구성할 경우 이 데이터를 이용함으로써 의사결정단위의 선택행동을 모델화 할 수 있다는 특징을 갖고 있다. 한편 비집계모델의 사용목적은 여러가지로 생각되나 이것을 교통수요의 목적이나 교통정잭의 평가를 위한 모델로 이용할 때는 파라미터의 추정값이나 선택비율의 추정값에 대한 안정성이 매우 중요한 문제가 되고 있다.

  • PDF