검색 결과

"메모리 대역폭"에 대한 검색 결과 (총 31개)

GPU

기술 > 하드웨어 > 그래픽 처리장치 | 익명 | 2026-08-17 | 조회수 21

GPU 개요 GPU(Graphics Processing Unit 그래픽 처리장치)는 이미지 비디오, 애니메이션 등 그래픽 데이터를 빠르고 효율적으로 처리하기 위해 설계된 전용 전자 회로입니다. 초기에는 주로 컴퓨터 그래픽스와 게임 렌더링에 사용되었지만, 현재는 인공지능(AI), 과학 계산, 데이터 분석, 블록체인 등 다양한 분야에서 중요한 역할을 하고 있습…

벡터화 처리

기술 > 수치계산 > 벡터연산 | 익명 | 2026-08-17 | 조회수 16

벡터화 처리 (Vectorization) 1. 개요 벡터화 처리(Vectorization)란 단일 명령어로 여러 개의 데이터 요소에 대해 동시에 동일한 연산을 수행하여 계산 효율을 극대화하는 컴퓨팅 기법이다. 전통적인 루프(Loop) 기반 처리는 스칼라(Scalar) 방식이라 하여, 한 번의 CPU 사이클에 하나의 데이터 쌍만을 처리한다. 반면, 벡터화 처…

scrypt

기술 > 보안 > 암호화 알고리즘 | 익명 | 2026-08-16 | 조회수 49

scrypt 개요 scrypt는 2009년 Tarsnap의 설립자인 Colin Percival에 의해 설계된 암호화 해시 함수이자 키 유도 함수(KDF, Key Derivation Function)입니다. scrypt는 기존의 pbkdf2나 bcrypt와 같은 알고리즘들이 CPU 연산량만을 늘려 공격을 방어하려 했던 한계를 극복하기 위해 설계되었습니다. 특…

Argon2

기술 > 보안 > 암호화 프로토콜 | 익명 | 2026-08-13 | 조회수 65

Argon2 1. 개요 Argon2는 패스워드 해싱(Password Hashing)을 위해 설계된 최신 패스워드 해싱 함수로, 2015년 암호화 커뮤니티의 '비밀번호 해싱 경쟁(Password Hashing Competition, PHC)'에서 우승하며 표준으로 채택된 알고리즘이다. 기존의 bcrypt나 scrypt와 같은 함수들은 CPU 연산 비용을 높여…

그래픽스 파이프라인

기술 > 소프트웨어 > 렌더링 공정 | 익명 | 2026-08-12 | 조회수 27

그래픽스 파이프라인 (Graphics Pipeline) 1. 개요 그래픽스 파이프라인이란 3차원 공간에 정의된 가상 장면(3D Scene)을 2차원 평면인 모니터 화면에 픽셀 단위로 출력하기 위해 거치는 일련의 연속적인 처리 과정을 의미한다. 이 프로세스는 추상화된 기하학적 데이터(정점, 인덱스 등)가 입력되어 래스터화(Rasterization)와 셰이딩(…

NPU

기술 > 인공지능 > 신경망 구성 요소 | 익명 | 2026-08-12 | 조회수 44

NPU (신경망 처리 장치) 1. 개요 NPU(Neural Processing Unit, 신경망 처리 장치)는 인간의 뇌 신경망을 모방한 인공신경망(Artificial Neural Network)의 연산을 효율적으로 처리하기 위해 설계된 AI 전용 가속기(Hardware Accelerator)이다. 딥러닝의 핵심인 대규모 행렬 연산을 빠르게 수행하도록 최적…

복소수

수학 > 복소해석학 > 복소수 | 익명 | 2026-08-05 | 조회수 106

복소수 복소수(複素數, Complex Number)는 실수부와 허수부로 구성된 수 체계로, 수학 전반과 물리학, 공학 등 다양한 분야에서 핵심적인 역할을 한다. 복소수는 2차 방정식의 해가 실수 범위에서 존재하지 않을 때 그 해를 표현할 수 있는 수학적 도구로 등장하였으며, 현대 수학에서 해석학, 대수학, 기하학 등과 깊은 연관을 맺고 있다. 특히 복소해석…

AMD EPYC Genoa

기술 > 컴퓨터하드웨어 > 서버프로세서 | 익명 | 2026-08-04 | 조회수 38

AMD EPYC Genoa AMD EPYC Genoa는 AMD(Advanced Micro Devices)가 2022년 11월에 출시한 제3세대 EPYC 서버 프로세서 라인업의 코드명입니다. 이 프로세서는 AMD의 차세대 Zen 4 마이크로아키텍처를 기반으로 하며, AM5 소켓을 사용하여 데스크톱 및 서버 플랫폼 간의 아키텍처 통합을 이루었습니다. Genoa…

재배치

기술 > 시스템프로그래밍 > 재배치 | 익명 | 2026-07-31 | 조회수 21

재배치 (Relocation) 개요 재배치(Relocation)란 프로그램이 메모리의 특정 물리적 주소에 고정되지 않고, 실행 시점에 가용한 메모리 공간에 따라 주소를 변경하여 적절하게 배치하는 프로세스를 의미합니다. 현대적인 운영체제는 멀티프로그래밍(Multiproument) 환경을 지원하기 때문에, 여러 프로세스가 동시에 메모리에 상주하게 됩니다. 이때…

NVIDIA GTX 580

기술 > 하드웨어 > 그래픽 처리장치 | 익명 | 2026-07-29 | 조회수 10

NVIDIA GeForce GTX 580 1. 개요 NVIDIA GeForce GTX 580은 2010년 11월 NVIDIA에서 출시한 Fermi(페르미) 아키텍처 기반의 하이엔드 그래픽 처리 장치(GPU)이다. 전작인 GTX 480의 설계 결함을 수정하고 공정 미세화를 통해 성능과 전력 효율을 개선한 모델로, 출시 당시 DirectX 11 기반의 고사양 …

TensorFlow

기술 > 인공지능 > 딥러닝 | 익명 | 2026-07-29 | 조회수 23

TensorFlow TensorFlow는 구글(Google)이 개발한 오픈 소스 기계 학습 및 딥러닝 프레임워크로, 다양한 규모의 머신러닝 모델을 구축하고 훈련하며 배포할 수 있도록 설계된 강력한 도구입니다. 특히 딥러닝 모델의 개발에 널리 사용되며, 연구자와 개발자 모두에게 높은 인기를 끌고 있습니다. TensorFlow는 유연한 아키텍처를 기반으로 하여…

AMD Athlon 64 X2

기술 > 하드웨어 > 프로세서 | 익명 | 2026-07-28 | 조회수 19

AMD Athlon 64 X2 개요 AMD Athlon 64 X2는 미국의 반도체 기업 AMD(Advanced Micro Devices)가 2005년 5월에 출시한 초기 양산형 데스크톱용 듀얼코어 프로세서입니다. 이 프로세서는 x86 아키텍처 기반의 64비트 컴퓨팅 시대를 본격적으로 열어젖힌 제품군 중 하나로, 기존의 싱글코어 아키텍처에서 벗어나 멀티코어 …

BLIS Framework

기술 > 소프트웨어 > 라이브러리 프레임워크 | 익명 | 2026-07-28 | 조회수 30

BLIS Framework BLIS Framework(BL-like Library Instantiation Software)는 고성능 선형 대수 연산을 위한 오픈소스 소프트웨어 라이브러리로 BLAS(Basic Linear Subprograms)와사한 인터페이스를 제공하면서도 보다 유연하고 최적화된 구현을 가능하게 하는 프레임워크입니다. BLIS는 수치 계산…

Generic Receive Offload

기술 > 네트워크 > 네트워크 기능 | 익명 | 2026-07-25 | 조회수 30

Generic Receive Offload (GRO) 1. 개요 Generic Receive Offload (GRO)는 네트워크 인터페이스 카드(NIC)를 통해 수신되는 다수의 작은 TCP 세그먼트들을 상위 네트워크 스택으로 전달하기 전에 하나의 큰 패킷으로 병합하여 처리하는 네트워크 최적화 기술이다. 현대 고속 네트워크 환경에서 패킷 하나하나를 개별적으로…

추론 속도

기술 > 성능 최적화 > 입출력 최적화 | 익명 | 2026-07-17 | 조회수 17

추론 속도 (Inference Speed) 1. 개요 추론 속도(Inference Speed)란 학습이 완료된 AI 모델에 새로운 입력 데이터를 넣었을 때, 모델이 예측 결과(출력)를 내놓기까지 걸리는 시간을 의미한다. AI 모델 서비스(Serving) 단계에서 추론 속도는 서비스의 실용성을 결정짓는 핵심 요소이다. 특히 실시간 상호작용이 필요한 챗봇, 자…

AMD Instinct MI300

기술 > 컴퓨터하드웨어 > 그래픽처리장치 | 익명 | 2026-07-16 | 조회수 19

AMD Instinct MI300 1. 개요 AMD Instinct MI300은 AMD가 설계한 데이터센터용 고성능 컴퓨팅(HPC) 및 인공지능(AI) 가속기로, 차세대 CDNA 3 아키텍처를 기반으로 한 칩렛(Chiplet) 설계의 정점을 보여주는 제품군이다. 본 제품은 거대 언어 모델(LLM)의 학습 및 추론, 복잡한 과학적 시뮬레이션 등 막대한 연산량…

Depthwise Separable Convolution 1. 개요 Depthwise Separable Convolution(깊이별 분리 합성곱)은 표준 합성곱(Standard Convolution) 연산을 공간적 필터링(Spatial Filtering)과 채널 간 결합(Channel Combination)이라는 두 개의 독립적인 단계로 분리하여 연산 효율…

MT/s

기술 > 컴퓨터하드웨어 > 성능지표 | 익명 | 2026-07-13 | 조회수 31

MT/s (MegaTransfers per second) 1. 개요 MT/s(MegaTransfers per second)는 초당 100만 번의 데이터 전송이 이루어지는 속도를 나타내는 단위로, 주로 컴퓨터 메모리(RAM)의 실질적인 데이터 전송 효율을 측정하는 성능 지표로 사용됩니다. 과거에는 메모리 속도를 단순히 클럭 주파수인 MHz(Megahertz)…

Basic Linear Algebra Subprograms

기술 > 수학 > 선형대수 | 익명 | 2026-07-13 | 조회수 42

Basic Linear Algebra Subprograms Basic Linear Algebra Subprograms(BL)는 선형대수 계을 위한 기본적인 연산들을 표화한 인터페이스 사양이다. BLAS는 벡터와렬의 덧셈 스칼라 곱, 내적, 행렬-벡터 곱, 행렬-행렬 곱 등과 같은 수치 선형대수의 핵심 연산들을 정의하며, 과학 계산, 머신러닝, 공학 시뮬레이…

반정밀도

기술 > 수치해석 > 수치적 표현 | 익명 | 2026-06-20 | 조회수 32

반정밀도 (Half-Precision) 반정밀도(Half-Precision)는 부동소수점 숫자를 표현하기 위해 16비트(2바이트)의 메모리 공간을 사용하는 데이터 형식입니다. 일반적으로 FP16(Floating Point 16) 또는 IEEE 754-2008 표준의 binary16 형식으로 불립니다. 전통적인 컴퓨팅 환경에서는 32비트 부동소수점인 단정밀도…