대용량 데이터 처리 (Large-scale Data Processing) 1. 개요 대용량 데이터 처리란 단일 컴퓨팅 자원으로는 처리하기 어려운 방대한 양의 데이터를 효율적으로 수집, 저장, 분석하기 위해 분산 컴퓨팅 기술과 최적화된 알고리즘을 적용하는 일련의 과정을 의미한다. 현대 컴퓨팅 환경에서는 IoT 기기의 확산, SNS의 폭증, 고해상도 로그 데이…
검색 결과
검색어를 입력하세요.
Paxos (합의 알고리즘) 1. 개요 Paxos는 비동기 네트워크 환경에서 여러 개의 노드가 하나의 값에 대해 합의(Consensus)를 이룰 수 있도록 설계된 분산 컴퓨팅 알고리즘이다. 분산 시스템에서는 네트워크 지연, 패킷 손실, 혹은 일부 노드의 장애(Crash)가 빈번하게 발생한다. 이러한 환경에서 시스템의 일관성을 유지하기 위해서는 모든 정상 노…
대규모 데이터 처리 (Large-Scale Data Processing) 개요 대규모 데이터 처리(Large-Scale Data Processing)는 방대한 양의 데이터(빅데이터)를 효율적으로 수집, 저장, 분석 및 시각화하기 위한 기술적 접근법과 아키텍처를 포괄하는 개념입니다. 전통적인 단일 서버 기반의 데이터 처리 방식은 데이터의 볼륨(Volume),…
Apache Spark 개요 Apache Spark는 대규모 데이터 처리를 위한 오픈소스 분산 컴퓨팅 프레임워크. 2009년 UC 버클리의 AMPLab에서 개발을 시작했으며, 2010년에 오픈소스로 공되고 203년 Apache Software Foundation 인큐베이션 프로젝트로 채택된 이후, 빅데이터 처리 분야에서 가장 널리 사용되는 도구 중 하나로 …