리던던시 (Redundancy, 이중화) 1. 개요 리던던시(Redundancy, 이중화)란 시스템의 신뢰성을 높이기 위해 핵심 구성 요소나 기능을 중복으로 배치하여, 일부 요소에 장애가 발생하더라도 전체 서비스가 중단되지 않고 계속 작동하도록 설계하는 기술적 전략을 의미한다. 네트워크 및 시스템 설계에서 리던던시를 구축하는 근본적인 목적은 가용성(Avai…
검색 결과
"Replication"에 대한 검색 결과 (총 35개)
읽기 전용 복제본 (Read Replica) 개요 읽기 전용 복제본(Read Replica)이란 기본 데이터베이스(Primary/Source DB)의 데이터를 실시간으로 복제하여 읽기 전용 쿼리만을 처리하도록 설계된 복제 데이터베이스 인스턴스를 의미합니다. 현대적인 웹 서비스는 쓰기 작업(Create, Update, Delete)보다 읽기 작업(Read/S…
중앙 집중형 시스템 (Centralized System) (Alias: Central) 1. 개요 중앙 집중형(Centralized) 구조란 네트워크나 시스템의 모든 제어권, 데이터 처리, 관리 권한이 하나의 중앙 노드(Central Node) 또는 소수의 핵심 서버에 집중되어 있는 아키텍처를 의미합니다. 이 구조에서 말단 노드(Client/Edge)들은 …
액티브-패시브 (Active-Passive) 정의 및 개념 액티브-패시브(Active-Passive)는 시스템의 고가용성(High Availability, HA)을 보장하기 위한 이중화 구성 방식의 일종입니다. 두 대 이상의 서버를 준비하여 한 대는 실제 서비스를 제공하는 Active(활성) 상태로 두고, 다른 한 대는 장애 발생 시를 대비해 대기하는 Pa…
대용량 데이터 처리 (Large-scale Data Processing) 1. 개요 대용량 데이터 처리란 단일 컴퓨팅 자원으로는 처리하기 어려운 방대한 양의 데이터를 효율적으로 수집, 저장, 분석하기 위해 분산 컴퓨팅 기술과 최적화된 알고리즘을 적용하는 일련의 과정을 의미한다. 현대 컴퓨팅 환경에서는 IoT 기기의 확산, SNS의 폭증, 고해상도 로그 데이…
Hadoop 개요 아파치 하둡(Apache Hadoop)은 대용량 데이터를 분산 처리하기 위한 오픈소스 프레임워크로, 구글의 맵리듀스(MapReduce)와 구글 파일 시스템(GFS)을 기반으로 개발되었습니다. 하둡은 수천 대의 일반적인 하드웨어 서버로 구성된 클러스터에서 페타바이트(PB) 규모의 데이터를 저장하고 분석할 수 있는 능력을 제공합니다. 특히, …
Apache Kafka (아파치 카프카) 1. 개요 Apache Kafka는 고성능 분산 이벤트 스트리밍 플랫폼으로, 실시간 데이터 파이프라인 구축 및 스트림 분석을 위해 설계된 오픈소스 소프트웨어이다. 전통적인 메시지 큐(Message Queue, MQ)가 메시지의 전달과 소비 후 삭제라는 '전달' 중심의 역할에 집중했다면, Kafka는 데이터를 디스크에…
RTO (Recovery Time Objective, 복구 목표 시간) 1. 개요 RTO(Recovery Time Objective, 복구 목표 시간)란 재해나 시스템 장애가 발생했을 때, 중단된 비즈니스 프로세스나 IT 서비스를 정상 상태로 복구하는 데 걸리는 최대 허용 시간을 의미한다. RTO는 [[BCP]](Business Continuity Plan…
시뮬레이션 모델링 (Simulation Modeling) 1. 개요 시뮬레이션 모델링이란 현실 세계의 복잡한 시스템이나 프로세스, 특히 단순한 수학적 공식으로는 예측하기 어려운 복잡계(Complex Systems)를 수학적, 논리적 모델로 추상화하여 컴퓨터 상에서 모사하고, 다양한 시나리오를 실험함으로써 시스템의 동작을 분석하고 최적의 대안을 도출하는 기법…
ZFS (Zettabyte File System) ZFS는 Sun Microsystems에서 개발한 통합 파일 시스템이자 논리 볼륨 관리자(LVM)로, 대규모 데이터 저장소의 무결성 보장과 확장성, 관리 편의성을 극대화하기 위해 설계된 차세대 스토리지 솔루션입니다. 현재는 오픈 소스 프로젝트인 OpenZFS를 통해 리눅스, FreeBSD 등 다양한 OS에서…
단일 장애점 (Single Point of Failure, SPOF) 1. 개요 단일 장애점(Single Point of Failure, SPOF)이란 시스템을 구성하는 여러 요소 중 어느 하나가 고장 났을 때, 그 영향으로 인해 시스템 전체가 중단되는 지점을 의미한다. 현대의 고가용성(High Availability) 시스템 설계의 핵심 목표는 이러한 S…
데이터 통합 미들웨어 (Data Integration Middleware) 1. 개요 데이터 통합 미들웨어란 서로 다른 기종의 시스템, 애플리케이션, 데이터베이스 간의 데이터 교환, 변환, 전송을 자동화하고 관리하는 미들웨어 소프트웨어 또는 플랫폼을 의미한다. 이를 통해 분산된 데이터를 효율적으로 연결하여 하나의 일관된 뷰(Unified View)로 제공하…
배선 자원 (Routing Resources) 배선 자원(Routing Resources)이란 FPGA(Field Programmable Gate Array) 내부에서 구성 가능한 논리 블록(CLB, Slice 등)과 입출력 핀(I/O Pin) 사이의 신호를 전기적으로 연결하기 위해 구축된 물리적인 경로와 스위칭 네트워크의 집합을 의미한다. 1. 개요 FP…
Failover (장애 조치) 1. 개요 Failover(장애 조치)란 시스템의 일부 구성 요소에 장애가 발생했을 때, 예비 시스템(Backup System)이 자동으로 그 기능을 이어받아 서비스 중단을 최소화하는 고가용성(High Availability, HA) 메커니즘을 의미한다. Failover의 주된 목적은 단일 장애점(SPOF, Single Poi…
Paxos (합의 알고리즘) 1. 개요 Paxos는 비동기 네트워크 환경에서 여러 개의 노드가 하나의 값에 대해 합의(Consensus)를 이룰 수 있도록 설계된 분산 컴퓨팅 알고리즘이다. 분산 시스템에서는 네트워크 지연, 패킷 손실, 혹은 일부 노드의 장애(Crash)가 빈번하게 발생한다. 이러한 환경에서 시스템의 일관성을 유지하기 위해서는 모든 정상 노…
NexStorage SDS (소프트웨어 정의 스토리지 솔루션) 1. 개요 NexStorage SDS는 하드웨어 종속성을 제거하고 소프트웨어 계층에서 스토리지 자원을 관리 및 제어하는 엔터프라이즈급 소프트웨어 정의 스토리지([[소프트웨어 정의 스토리지|Software-Defined Storage]], SDS) 솔루션입니다. 본 솔루션은 기존의 전용 스토리지 …
Citus Citus는 PostgreSQL을 기반으로 하는 오픈 소스 분산 데이터베이스 확장 프로그램으로, 단일 서버의 성능 한계를 넘어 데이터를 여러 노드에 분산 저장하고 쿼리를 병렬로 처리함으로써 수평적 확장성(Horizontal Scalability)을 제공하는 솔루션입니다. 1. 개요 Citus는 표준 PostgreSQL의 기능을 그대로 유지하면서,…
데이터 동기화 (Data Synchronization) 1. 개요 데이터 동기화(Data Synchronization)란 두 개 이상의 장치, 데이터베이스 또는 시스템 간에 동일한 데이터를 유지하여 데이터의 일관성(Consistency)을 확보하는 프로세스를 의미한다. 현대의 컴퓨팅 환경은 분산 시스템과 멀티 디바이스 환경이 주를 이루고 있다. 사용자가 스…
Redis (Remote Dictionary Server) 1. 개요 Redis(Remote Dictionary Server)는 메모리 내 데이터 구조 저장소( Structure Store)로, 데이터베이스, 캐시, 메시지 브로커 및 스트리밍 엔진으로 활용되는 오픈 소스 소프트웨어입니다. 일반적인 관계형 데이터베이스(RDBMS)가 하드 디스크나 SSD에 데…
검정력 (Power) 검정력(檢定力, Statistical Power)은 통계학, 특히 가설 검정(Hypothesis Testing)에서 매우 중요한 개념으로, 귀무가설( )이 실제로 거짓일 때 이를 올바르게 기각하고 대립가설( )을 채택할 확률을 의미합니다. 즉, 실험이나 조사 설계 단계에서 "실제로 효과가 존재할 때, 그 효과를 발견할 수 있는 능력"을…