• 제목/요약/키워드: 분산캐시

검색결과 74건 처리시간 0.025초

쿠버네티스에서 ML 워크로드를 위한 분산 인-메모리 캐싱 방법 (Distributed In-Memory Caching Method for ML Workload in Kubernetes)

  • 윤동현;송석일
    • Journal of Platform Technology
    • /
    • 제11권4호
    • /
    • pp.71-79
    • /
    • 2023
  • 이 논문에서는 기계학습 워크로드의 특징을 분석하고 이를 기반으로 기계학습 워크로드의 성능 향상을 위한 분산 인-메모리 캐싱 기법을 제안한다. 기계학습 워크로드의 핵심은 모델 학습이며 모델 학습은 컴퓨팅 집약적 (Computation Intensive)인 작업이다. 쿠버네티스 기반 클라우드 환경에서 컴퓨팅 프레임워크와 스토리지를 분리한 구조에서 기계학습 워크로드를 수행하는 것은 자원을 효과적으로 할당할 수 있지만, 네트워크 통신을 통해 IO가 수행되야 하므로 지연이 발생할 수 있다. 이 논문에서는 이런 환경에서 수행되는 머신러닝 워크로드의 성능을 향상하기 위한 분산 인-메모리 캐싱 기법을 제안한다. 특히, 제안하는 방법은 쿠버네티스 기반의 머신러닝 파이프라인 관리 도구인 쿠브플로우를 고려하여 머신러닝 워크로드에 필요한 데이터를 분산 인-메모리 캐시에 미리 로드하는 새로운 방법을 제안한다.

  • PDF

이동 클라이언트/서버 컴퓨팅환경에서의 캐싱 및 동시성 제어 (Caching and Concurrency Control in a Mobile Client/Sever Computing Environment)

  • 이상근;황종선;이원규;유헌창
    • 한국정보과학회논문지:소프트웨어및응용
    • /
    • 제26권8호
    • /
    • pp.974-987
    • /
    • 1999
  • 이동 컴퓨팅 환경에서 자주 접근하는 데이터에 대한 캐싱은 무선 채널의 좁은 대역폭에서 경쟁을 줄일 수 있는 유용한 기술이다. 그러나, 트랜잭션 캐시 일관성을 지원하는 전통적인 클라이언트/서버 전략은 클라이언트와 서버간에 많은 양의 통신을 필요로 하기 때문에 이동 클라이언트/서버 컴퓨팅 환경에서는 적절하지 않다. 본 논문에서는 브로드캐스트-기반 캐시 무효화 정책을 사용하면서 트랜잭션 캐시 일관성을 지원하는 OCC-UTS (Optimistic Concurrency Control with Update TimeStamp) 프로토콜을 제안한다. 접근한 데이터에 대한 일관성 검사 및 완료 프로토콜은 캐시 무효화 과정의 내부 과정으로 완전 분산 형태로 효율적으로 구현되며, 일관성 체크의 대부분이 이동 클라이언트에서 수행된다. 또한, 분석 모델에 기반한 성능 비교를 통해, 본 논문에서 제안하는 OCC-UTS 프로토콜이 다른 경쟁 프로토콜보다 높은 트랜잭션 처리율을 얻으며, 데이터 항목을 자주 접근하면 할수록 지역 캐시를 사용하는 OCC-UTS 프로토콜이 더 효율적임을 보인다. 이동 클라이언트의 접속 단절에 대해서는 무효화 브로드캐스트 윈도우를 크게 하여 접속 단절에 적절히 대처할 수 있다.Abstract In a mobile computing environment, caching of frequently accessed data has been shown to be a useful technique for reducing contention on the narrow bandwidth of the wireless channels. However, the traditional client/server strategies for supporting transactional cache consistency that require extensive communications between a client and a server are not appropriate in a mobile client/server computing environment. In this paper, we propose a new protocol, called OCC-UTS (Optimisitic Concurrency Control with Update TimeStamp), to support transactional cache consistency in a mobile client/server computing environment by utilizing the broadcast-based solutions for the problem of invalidating caches. The consistency check on accessed data and the commitment protocol are implemented in a truly distributed fashion as an integral part of cache invalidation process, with most burden of consistency check being downloaded to mobile clients. Also, our experiments based on an analytical model substantiate the basic idea and study the performance characteristics. Experimental results show that OCC-UTS protocol without local cache outperforms other competitor protocol, and the more frequent a mobile client accesses data items the more efficient OCC-UTS protocol with local cache is. With respect to disconnection, the tolerance to disconnection is improved if the invalidation broadcast window size is extended.

네트워크 트래픽 절감을 위한 캐시 배치 구조 (Cache Layout Management for Reducing Network Traffic)

  • 구태연;정영식;박종열
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2012년도 한국컴퓨터종합학술대회논문집 Vol.39 No.1(D)
    • /
    • pp.249-250
    • /
    • 2012
  • 스마트 캐쉬 시스템은 콘텐츠 전달망에서 콘텐츠 트래픽 양을 감소시키기 위해 필수적인 기술로써 가입자 네트워크 구간에 콘텐츠를 자동 저장하여 중복 전송을 최소화 하는 시스템이다. 부하 분산 시스템을 통해 특정 스마트 캐쉬 서버로 집중되는 요청을 분산하고 콘텐츠 요청자의 주소에 따른 최적의 스마트 캐쉬를 지정하는 기술이다. 이를 통해 스마트 캐쉬를 적용한 글로벌 딜리버리 클라우드 플랫폼을 구축하여 콘텐츠 전송 플랫폼 기술의 국내 기업 경쟁력을 확보할 수 있고, 차세대 콘텐츠 유통 시장에서의 기술력 확보와 국내 업체의 세계 시장 지배력 강화할 수 있다.

PON기반 5G 프론트홀의 캐싱 성능 평가 (Performance Evaluation of Caching in PON-based 5G Fronthaul)

  • 정복래
    • 융합정보논문지
    • /
    • 제10권1호
    • /
    • pp.22-27
    • /
    • 2020
  • 5G 인프라 보급과 더불어 기하급수적으로 증가하는 1인 미디어 방송, 유튜브와 같은 모바일 콘텐츠 서비스를 안정적으로 제공하기 위해서는 사용자 부근에 캐시 서버를 분산 배치하는 콘텐츠 전송 네트워크(CDN:Content Delivery Network) 도입이 필수적이다. 지역 캐시 없이 사용자가 콘텐츠 사업자(Content Provider)로부터 직접 서비스를 받는 트래픽이 늘어날수록 모바일 백홀(Backhaul)과 프론트홀(Fronthaul)에서 감당해야 할 부담은 상당히 증가하게 된다. 본 연구는 광기반 5G 프론트홀 구조와 캐싱 방법을 제안하여 모바일 백홀의 대역폭 및 서비스 품질을 개선하는 데 목적이 있다. 이를 위해 우선 전용 광케이블을 프론트홀로 사용하는 콘텐츠 전송 네트워크와 수동광가입자망(PON:Passive Optical Network)을 사용하는 구조를 제안한다. 그 위에 PON 캐싱에 특화된 집화된 콘텐츠 요청 방법을 제안하고 모델링과 시뮬레이션을 통해 그 성능을 기존의 방식과 비교한다. 제안된 PON 캐싱은 기존 캐싱이 없는 구조에 비해 최대 0.5초의 평균접근시간 감소, 1/n개의 수신된 요청 패킷 감소, 약 60% 백홀 대역폭 절감 효과를 나타냈다. 이 연구는 모바일 백홀 비용과 서비스 품질 사이에서 고민하는 통신사업자들에게 하나의 참고 자료가 될 수 있으며, 추후 캐시 적중률을 더욱 끌어올리는 방안으로 확장될 것이다.

CCN에서 응답시간 감소를 위한 생산자 거리 기반 캐시정책 (Cache Policy based on Producer Distance to Reduce Response Time in CCN)

  • 김건;권태욱
    • 한국전자통신학회논문지
    • /
    • 제16권6호
    • /
    • pp.1121-1132
    • /
    • 2021
  • 지금은 스마트폰, 태블릿 등 모바일기기를 사용하지 않는 사람을 찾는 것이 더 어려운 시대다. 손가락만 움직이면 접근 가능한 콘텐츠들이 넘쳐난다. 하지만 기존 네트워크는 넘치는 콘텐츠들로 인해 발생하는 문제들에 대해 효율적인 대응이 어려운 구조를 가지고 있다. 특히, 다수의 사용자가 동시에 집약적으로 서버에 콘텐츠를 요구할 시 발생하는 병목현상 문제가 대표적인데 이를 해소하기 위해 미래 네트워크의 대안으로 CCN이 등장했다. CCN은 중간노드의 In-Network Cache 기능을 통해 네트워크의 대역폭을 효율적으로 사용해 사용자들의 요청이 Server에 도달하기 위해 소요되는 트래픽을 개선해 네트워크 내에서 응답시간을 줄이고 트래픽 집중을 분산한다. 이런 CCN 환경에서 효율성을 향상시킬 수 있는 캐시정책을 제안한다.

로컬서버와 웹캐싱을 이용한 전자상거래 시스템의 지연속도 개선에 관한 연구 (A Study on Latency Time Improvement of Electronic Commerce System Using Local Server and Web Cashing)

  • 윤용기;고일석;임춘성
    • 정보처리학회논문지B
    • /
    • 제9B권5호
    • /
    • pp.555-562
    • /
    • 2002
  • 전자상거래 사용자와 대용량 멀티미디어 데이터의 증가로 인한 전자상거래 시스템의 급격한 부하 증가와 네트워크 트래픽의 증가는 클라이언트의 요청에 대한 서비스의 지연을 가져와 고객에 대한 고객만족도 감소와 기업의 경쟁력을 떨어뜨리는 요인이 되고 있다. 따라서 전자상거래 시스템의 효율적인 관리와 응답속도를 고려한 연구가 필요하다. 본 연구에서는 전자상거래 시스템의 부하 분산을 위해 캐시 기능을 가진 로컬서버 기반의 계층적 구조의 전자상거래 시스템을 설계하고 로컬 웹서버를 위한 분할된 웹캐시 알고리즘을 제안하며 실험을 통해 성능을 분석하였다.

클라우드 스토리지 최적화를 위한 고속 캐싱 및 대용량 파일 전송 기법 (A Scheme on High-Performance Caching and High-Capacity File Transmission for Cloud Storage Optimization)

  • 김태훈;김정한;엄영익
    • 한국통신학회논문지
    • /
    • 제37권8C호
    • /
    • pp.670-679
    • /
    • 2012
  • 최근 클라우드 컴퓨팅 환경의 보급과 함께 스토리지의 데이터양이 급증함에 따라 그에 따른 스토리지 저장 비용이 빠르게 증가하고 있다. 더불어, 사용자들의 다양한 서비스 및 데이터 요청으로 클라우드 스토리지의 부하 또한 급증하고 있다. 이러한 문제를 해결하기 위해 분산 파일 시스템을 통한 저비용 고성능 스토리지 환경을 제공하고자 하는 기존의 연구가 있었으나, 이에는 데이터 병렬처리, 임의위치 접근처리, 빈번한 작은 워크로드 접근처리 등의 취약점이 존재한다. 최근에는 캐싱 기술을 이용하여 이를 개선하려는 연구가 주목받고 있다. 본 논문에서는 분산 파일 시스템 환경에서 병렬 캐싱, 분산 캐싱과 공유 자원을 고려한 데이터 병렬 전송방법을 제공하는 CHPC(Cloud storage High-Performance Caching) 구조를 제안하며, 또한 이를 기존의 방법들과 비교 평가하여 스토리지 부하를 최적화하는 방법을 제시한다. 더불어, 제안 기법이 기존 클라우드 시스템에 비하여 스토리지 서버의 디스크 입출력 감소, 서버로 데이터의 요청이 집중되어 발생하는 병목현상 방지, 각 클라이언트의 중복되는 페이지 캐시 제거, 데이터 전송률 향상의 장점을 가짐을 보인다.

분산 메모리 시스템에서의 SPARQL 질의 처리 (SPARQL Query Processing in Distributed In-Memory System)

  • 작바랄 바트셀렘;이완곤;김강필;박영택
    • 정보과학회 논문지
    • /
    • 제42권9호
    • /
    • pp.1109-1116
    • /
    • 2015
  • 본 논문에서는 functional 프로그래밍과 분산 메모리 환경인 Spark를 통해 SPARQL 질의문 처리의 오버헤드를 줄일 수 있는 방법을 제안한다. 최근 몇 년간 시멘팁웹의 RDF 온톨로지 데이터는 폭발적으로 증가하고 있기 때문에, 대용량 온톨로지 데이터에 대한 질의문을 효율적으로 처리할 수 있는 방법이 주요 쟁점으로 떠오르고 있다. SPARQL 질의문 처리에 대한 기존의 연구들은 하둡의 맵리듀스 프레임워크에 초점을 맞추고 있다. 그러나 하둡은 분산 파일 처리를 기반의 작업을 수행하므로 성능 저하가 발생할 수 있다. 따라서 질의문 처리 속도를 향상 시키기 위해 본 논문에서는 분산 메모리 시스템을 통해 질의문을 처리할 수 있는 방법을 제안한다. 또한 SPARQL 질의어 사이의 Binding 값을 Propagation하기 위해서 Spark의 Join방식, Functional 프로그램의 Map, Filter 방식, Spark의 캐시 기능을 활용 하는 방식을 제안하고 있다. 본 논문의 실험 결과는 다른 기법들과 비교하여 높은 성능을 얻었다. 특히 현재 가장 빠른 성능을 보이는 SPARQL 질의 엔진인 Sempala와 유사하다는 결과를 얻었다.

범용 그리드 데이터 시스템의 구현 (Implementation of Universal Grid Data System)

  • 이상근;황석찬;최재영
    • 한국정보과학회:학술대회논문집
    • /
    • 한국정보과학회 2002년도 봄 학술발표논문집 Vol.29 No.1 (A)
    • /
    • pp.619-621
    • /
    • 2002
  • 90년대 중반에 등장한 그리드(GRID)는 지역적으로 분산되어 있으며 소유자가 서로 다른 다양한 컴퓨팅 자원의 효과적인 공유를 목적으로 하며, 시스템의 구축에 필요한 스케쥴링, 자원 관리, 보안, 성능 측정 및 상태 모니터링 등의 문제를 해결하기 위한 다양한 미들웨어 및 개발 도구가 연구되고 있다. 그리드 시스템에서 사용되는 데이터는 FTP 서버, 파일 시스템, 데이터베이스 등 여러 장치에 저장되어 개별적인 인터페이스를 통해 접근된다. 각각의 인터페이스론 통하여 접근하므로 사용 방법이 어렵고 확장성이 떨어지는 단점이 있다. 이러한 문제점을 해결하기 위하여, 본 연구에서는 데이터베이스, FTP, 파일 시스템에 산재한 그리드 데이터를 동시에 지원하고, URL을 통해 단일 인퍼페이스로 접근하게 해 주며, 3계층 구조와 데이터 캐시를 이용하여 성능과 확장성을 제공하는 시스템을 구현한다.

  • PDF

대용량 콘텐츠의 신속한 전송을 위한 효과적인 웹-캐싱 네트웍 구축전략에 관한 연구 (A Study on Construction of Web-caching Network for Rapid Transmission of Large Volume Contents)

  • 이주헌;조병룡
    • 한국데이타베이스학회:학술대회논문집
    • /
    • 한국데이타베이스학회 2001년도 추계 컨퍼런스: 인터넷 비즈니스 환경에서의 디지털 컨텐츠 기술 발전 및 활용을 위한 컨퍼런스
    • /
    • pp.536-554
    • /
    • 2001
  • 인터넷 이용자의 증가와 멀티미디어 등 대용량 콘텐츠에 대한 수요의 증가로 인해 데이터 트래픽은 기하 급수적으로 늘어나는 데 비해 네트웍 성능향상에 대한 투자는 이에 미치지 못함으로서 결과적으로 인터넷은 트래픽의 병목현상, 즉 정체현상이 발생하게 되었으며 점차 그 정도가 심해지고 있다. 이 문제를 해결하기 위해 제안하는 방안이 바로 전략적 CDN(Content Delivery Network) 이다. 현실적으로, 본 연구는 물리적인 망 증설만으로는 트래픽 체증 문제를 해결하기는 어려우므로 주요 ISP 네트웍에 전략적 캐시서버를 설치하여 CP의 콘텐츠를 각 ISP 네트웍마다 분산하여 저장하고 이용자의 요청 시 이용자의 인터넷 회선이 물려 있는 ISP 네트웍에서 바로 콘텐츠를 전송하여 데이터 손실과 속도 저하 등의 문제를 해결하는 CDN의 구성과 그 효과를 실증적으로 밝혔다.

  • PDF