• 제목/요약/키워드: skyline

검색결과 160건 처리시간 0.041초

2-계층 그리드 블록을 이용한 효과적인 맵리듀스 기반 스카이라인 질의 처리 기법 (An Efficient MapReduce-based Skyline Query Processing Method with Two-level Grid Blocks)

  • 유형철;정성원
    • 정보과학회 논문지
    • /
    • 제44권6호
    • /
    • pp.613-620
    • /
    • 2017
  • 스카이라인 질의는 사용자들의 다양한 기준을 만족하는 데이터를 찾기 때문에 의사 결정 문제 등에서 폭넓게 사용되고 있다. 최근의 스카이라인 질의는 대용량 데이터베이스 처리를 위해 맵리듀스 프레임워크를 사용하는 연구들이 많이 진행되었으며 특히 맵리듀스에 기존의 색인 구조를 적용하는 방식으로 연구가 활발히 진행되고 있다. 스카이라인의 특징 중 하나는 원점에서 가까운 데이터일수록 더 많은 영역을 지배한다는 점이다. 하지만 기존의 색인 구조는 이와 같은 스카이라인의 특징을 반영하지 못하는 단점이 있었다. 본 논문에서는 그리드의 셀들을 스카이라인의 특징을 고려하여 묶는 그리드 블록 구조와 원점과 가까운 데이터가 없을 때도 사용 가능한 2계층 그리드 블록 구조, 그리고 2계층 그리드 블록 구조를 사용한 효율적인 스카이라인 질의 기법을 제안하였다.

데이터 샘플링 기반 프루닝 기법을 도입한 효율적인 각도 기반 공간 분할 병렬 스카이라인 질의 처리 기법 (An Efficient Angular Space Partitioning Based Skyline Query Processing Using Sampling-Based Pruning)

  • 최우성;김민석;;정재화;정순영
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제6권1호
    • /
    • pp.1-8
    • /
    • 2017
  • 다기준 의사결정 시 활용할 수 있는 스카이라인 질의는 다수의 선택지 중에서 사용자가 '선호하지 않을 만한'(uninteresting) 선택지를 제거함으로써 사용자가 검토해야 하는 선택지의 수를 대폭 감소시키기 때문에 대용량 데이터 분석 시 매우 유용하게 활용될 수 있다. 이러한 배경에서 대용량 데이터에 대한 스카이라인 질의를 분산 병렬 처리하는 기법이 각광을 받고 있으며, 특히 맵리듀스(MapReduce) 기반의 분산 병렬 처리 기법 연구가 활발히 진행되어 왔다. 맵리듀스 기반 알고리즘의 병렬성 제고를 위해서는 부하 불균등 문제 중복 계산 문제 과다한 네트워크 비용 발생 문제를 해소해야 한다. 본 논문에서는 부하 불균등 문제와 중복 계산 문제를 해소하면서도 데이터 샘플링 기반 프루닝을 통해 네트워크 비용 절감 시킬 수 있는 맵리듀스 기반 병렬 스카이라인 질의 처리 기법인 MR-SEAP(MapReduce sample Skyline object Equality Angular Partitioning)을 소개한다. 또한 다양한 관점에서의 실험 평가함으로써 제안 기법의 효용성을 다방면으로 검증했다.

영역객체를 위한 리버스 스카이라인 질의 처리 (Reverse Skyline Query Processing for Region Objects)

  • 한아;이종혁;박영배
    • 한국정보과학회논문지:데이타베이스
    • /
    • 제37권4호
    • /
    • pp.185-196
    • /
    • 2010
  • 이전의 리버스 스카이라인 질의 처리 기법들은 고정된 조건 값을 가지는 점객체 환경만을 고려하기 때문에, "가격이 5만원~7만원이고, 해변까지의 거리가 1km~2km인 호텔"와 같이 조건이 범위로 주어지는 영역객체 환경에서의 질의처리에는 부적합하다. 이러한 한계를 극복하기 위하여, 본 논문에서는 점객체 뿐만 아니라 영역객체 또한 지원 가능한 리버스 스카이라인 질의 처리 기법을 제안한다. 이는 첫째, 점객체 환경에서의 리버스 스카이라인 질의처리 기법 중 효율이 좋은 ERSL기법을 확장한 기법으로써 높은 성능을 기대할 수 있다. 또한 둘째, 영역객체와 제안하는 가지치기 기법과의 겹침 관계에 따라 결과객체의 중요도를 다르게 하여 질의자가 결과객체를 차별적으로 사용할 수 있도록 선택권을 제공한다는 새로운 특징이 있다. 본 기법은 영역객체를 지원하는 최초의 기법으로써 성능을 비교할 다른 대상기법이 없다. 그러므로 제안하는 기법의 성능 및 질의결과에 영향을 주는 조건이 무엇이며, 그에 따라 소모되는 실행시간을 측정하여 본 기법의 효율성을 증명하였다.

$L_1$ 메트릭에서의 이동 질의점에 대한 skyline 계산 (Computing the Skyline of Moving Query Points in $L_1$ metric)

  • 손완빈;황승원;안희갑
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2012년도 한국컴퓨터종합학술대회논문집 Vol.39 No.1(A)
    • /
    • pp.388-390
    • /
    • 2012
  • 본 논문에서는 $L_1$ 메트릭을 사용하는 평면상에 주어진 자료점의 집합 P로부터 질의점의 집합 Q에 대해 skyline이 되는 점들을 계산하는 문제를 다룬다. $L_1$ 거리는 도로망이 잘 발달된 도시 내의 이동 시간을 근사화해 주는 것으로 알려져 있다. 이 문제에서 각각의 질의점은 수직 또는 수평 방향으로 단위속도로 움직인다고 가정한다. 본 논문에서는 시간 0에서 $t_1$ 사이에 움직이는 질의점들에 대해서 skyline의 변화를 모두 계산하는 알고리즘을 제시한다. 또한 이 알고리즘이 O(${\mid}P{\mid}^2{\mid}Q{\mid}$) 시간에 모든 skyline을 계산 가능함을 보인다.

C언어의 유한요소해석 프로그램을 위한 Skyline Algorithm (Skyline Algorithm for Finite Analysis Programs Written in C Language)

  • 이재영
    • 전산구조공학
    • /
    • 제2권2호
    • /
    • pp.85-92
    • /
    • 1989
  • 이 논문은 C언어의 특성에 맞도록 skyline algorithm을 수정하여 제시하였다. 수정된 algorithm은 FORTRAN을 위한 종래의 algorithm에 비해서 프로그램의 구조를 개선하고 효율성을 높혀주는 이점이 있다. 강성행열의 조립과 분해를 단순화시키므로 프로그램의 실행시간이 현저히 단축된다. 장차 유한요소해석 프로그램의 개발에 실용적으로 활용될 수 있도록 C로 작성한 skyline algorithm의 원시프로그램 리스트를 수록하였다.

  • PDF

공간 분할 방법을 사용하는 Skyline 질의 방법의 문제점 비교 분석 (A Problem Analysis of Skyline Queries using Space Partitioning Techniques)

  • 임선영;박은영;박영호
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2012년도 추계학술발표대회
    • /
    • pp.1382-1384
    • /
    • 2012
  • 최근 대용량 혹은 복잡한 데이터에서의 빠른 검색을 돕는 Skyline 질의 처리에 대한 관심이 높아지고 있으며, 많은 응용프로그램에서 사용되고 있다. Skyline 질의는 데이터베이스의 튜플들을 공간상으로 표현하여 질의 처리를 할 수 있는 데, 이 때 빠른 처리를 위하여 공간 분할 기법이 사용된다. 본 논문에서는 공간 분할 기법을 사용한 Skyline 질의 방법들을 소개하고 문제점을 분석한다. 또한, 문제점 해결 방안을 함께 제시하며 기대 효과를 예측한다.

이동 객체의 부분차원 스카이라인 질의를 위한 효율적인 가지치기 기법 (An Efficient Pruning Method for Subspace Skyline Queries of Moving Objects)

  • 김진호;박영배
    • 한국정보과학회논문지:데이타베이스
    • /
    • 제35권2호
    • /
    • pp.182-191
    • /
    • 2008
  • 대부분의 스카이라인 질의에 대한 이전 연구들은 대상 객체의 정적 속성만을 고려하였다. 최근에는 모바일 응용 환경의 발전에 따라 이동 객체에 대한 연속적인 스카이라인 질의에 대한 필요성이 증대되고 있다. 연속적인 스카이라인 질의를 처리하기 위해 최근에 몇 가지 기법들이 제안되었지만, 이 기법들은 사용자가 관심을 가지는 일부 속성을 임의로 선택하는 부분차원 스카이라인 질의에 대해서는 고려하지 않았다. 이로 인하여 이동 객체와 부분차원을 동시에 고려해야 하는 모바일 응용에 있어서는 이전 연구들을 적용할 수 없다. 이 논문에서는 질의 시점에 이동 객체의 부분차원 스카이라인을 효율적으로 계산하기 위한 지배 객체 기반 가지치기 기법을 제안한다. 그리고 제안한 기법의 효율성을 증명하기 위해 모의실험을 통한 성능 평가를 수행한다.

범주형 데이터에 대한 스카이라인 질의 알고리즘 (Skyline Query Algorithm in the Categoric Data)

  • 이우기;최중호;송종수
    • 한국정보과학회논문지:컴퓨팅의 실제 및 레터
    • /
    • 제16권7호
    • /
    • pp.819-823
    • /
    • 2010
  • 스카이라인 질의는 다차원, 대량의 데이터 검색에서 효율적인 방법이다. '지배한다'의 개념을 활용하여 약 95%이상으로 알려진 불필요한 데이터 집합을 검색 대상에서 제외하고 필요한 데이터에 집중하게 만들기 때문이다. 지금까지의 스카이라인 질의 알고리즘들은 데이터 집합이 모두 수치형 데이터일 경우에만 한정하여 개발되었다. 따라서 데이터베이스 등에 저장된 대부분의 텍스트 데이터들은 기존 스카이라인 질의 알고리즘을 사용하여 결과를 얻을 수 없었다. 본 연구는 스카이라인 질의의 대상을 범주형 데이터라는 전혀 새로운 영역을 개척한 점에서 의미가 있다. 우선 범주형 데이터 거리를 2종류를 개발하고 이를 스카이라인 질의에 적용하였고, 실험에서는 ACM의 실제 논문데이터를 사용하여 처리시간 및 정확도 비율 등에서 그 효과성을 입증하였다.

Efficient Continuous Skyline Query Processing Scheme over Large Dynamic Data Sets

  • Li, He;Yoo, Jaesoo
    • ETRI Journal
    • /
    • 제38권6호
    • /
    • pp.1197-1206
    • /
    • 2016
  • Performing continuous skyline queries of dynamic data sets is now more challenging as the sizes of data sets increase and as they become more volatile due to the increase in dynamic updates. Although previous work proposed support for such queries, their efficiency was restricted to small data sets or uniformly distributed data sets. In a production database with many concurrent queries, the execution of continuous skyline queries impacts query performance due to update requirements to acquire exclusive locks, possibly blocking other query threads. Thus, the computational costs increase. In order to minimize computational requirements, we propose a method based on a multi-layer grid structure. First, relational data object, elements of an initial data set, are processed to obtain the corresponding multi-layer grid structure and the skyline influence regions over the data. Then, the dynamic data are processed only when they are identified within the skyline influence regions. Therefore, a large amount of computation can be pruned by adopting the proposed multi-layer grid structure. Using a variety of datasets, the performance evaluation confirms the efficiency of the proposed method.

Top-n 스카이라인 질의를 이용한 다차원 외판원 순회문제 기법 (Multi-Dimensional Traveling Salesman Problem Scheme Using Top-n Skyline Query)

  • 진창균;오덕신;김종완
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제9권1호
    • /
    • pp.17-24
    • /
    • 2020
  • 외판원 순회문제(Traveling Salesman Problem)는 세일즈맨이 한 도시(node)를 출발하여 모든 도시를 한 번씩 방문한 후 다시 출발점으로 되돌아오는 최적 경로를 반환한다. 이 기법은 도시의 수가 늘어날수록 연산횟수가 기하급수적으로 늘어나는 단점으로 인해 실생활에서 여러 노드(node)를 방문해야 하는 놀이동산이나 택배에 적용하기에는 탐색 성능에 한계가 있다. 또한, 최적 경로 탐색은 각 노드 사이의 거리를 1차원 속성으로 사용하기 때문에 이동시간, 관심도, 대기시간 등의 다차원속성을 고려하는 사용자의 요구를 만족하기 어렵다. 본 논문에서는 이와 같은 단점을 해결하기 위하여 Top-n 스카이라인 질의(Skyline query)를 이용한 다차원 외판원 순회문제(TS-MDT, Top-n Skyline-Multi Dimensional TSP) 알고리즘을 제안한다. 제안기법은 스카이라인의 지배원칙에 따라 다중 속성의 노드들을 제거함으로써 연산횟수의 감소를 통한 신속한 연산과 최적 경로를 반환한다. 실험에서는 1차원 속성의 데이터를 사용한 기존의 동적 계획법과 다차원속성을 처리하는 제안기법의 연산시간을 비교한 결과, 같은 데이터 개수일 때 다차원속성을 처리하는 제안기법이 더 빠른 것으로 나타났다.