Z-score 표준화 Z-score 표준화(Z-score Standardization)란 데이터의 평균을 0, 표준편차를 1이 되도록 변환하는 데이터 전처리 과정입니다. 서로 다른 척도(Scale)를 가진 변수들을 동일한 기준으로 비교하거나, 특정 값이 전체 데이터 분포에서 어느 정도 위치에 있는지 파악하는 것을 목적으로 합니다. 수식 및 원리 Z-scor…
검색 결과
"numpy"에 대한 검색 결과 (총 268개)
AHE (Adaptive Histogram Equalization) 1. 개요 AHE(Adaptive Histogram Equalization, 적응형 히스토그램 평활화)는 이미지의 국부적인 영역(Local Region)마다 히스토그램 평활화를 독립적으로 적용하여, 이미지 전체의 대비(Contrast)를 균일하게 맞추는 대신 각 영역의 세부 디테일을 극대화…
SymPy 개요 SymPy는 파이썬(Python) 언어로 작성된 오픈소스 심볼릭 연산(Symbolic Computation) 라이브러리입니다. 일반적인 계산기가 숫자를 입력받아 결과값을 산출하는 것과 달리, SymPy는 수학적 기호(Symbol)를 그대로 유지하며 수식을 조작하고 해결하는 컴퓨터 대수 시스템(Computer Algebra System, CA…
ARIMA (자기회귀 누적 이동평균 모델) 1. 개요 ARIMA(AutoRegressive Integrated Moving Average) 모델은 시계열 데이터의 과거 값과 예측 오차를 이용하여 미래의 값을 예측하는 통계적 분석 모델이다. 특히 비정상 시계열을 차분을 통해 정상 시계열로 변환하여 분석하는 모델이라는 점이 핵심적인 정체성이다. 시계열 데이터가…
LBPH (Local Binary Patterns Histograms) 1. 개요 LBPH(Local Binary Patterns Histograms)는 이미지의 국소적인 텍스처(Texture, 질감) 특징을 추출하여 얼굴을 인식하는 컴퓨터 비전 알고리즘으로, LBP 연산자를 통해 얻은 텍스처 정보를 히스토그램 형태로 변환하여 비교하는 방식이다. 이 알고리…
UMAP (Uniform Manifold Approximation and Projection) 1. 개요 UMAP(Uniform Manifold Approximation and Projection)은 위상수학적 구조를 기반으로 하는 비선형 차원 축소(Dimension Reduction) 알고리즘으로, 고차원 데이터를 저차원(주로 2차원 또는 3차원)으로 투…
PyTorch 개요 PyTorch는 Meta AI(구 Facebook AI Research)에서 개발한 오픈 소스 머신러닝 라이브러리로, 파이썬(Python) 기반의 유연한 인터페이스와 강력한 GPU 가속 기능을 제공하는 딥러닝 프레임워크이다. 텐서 계산과 자동 미분 기능을 핵심으로 하며, 연구 단계의 빠른 프로토타이핑부터 대규모 상용 서비스 배포까지 폭넓…
직교행렬 (Orthogonal Matrix) 직교행렬은 전치행렬이 곧 역행렬이 되는 정방행렬로, 벡터의 내적과 길이를 보존하는 선형 변환을 나타내는 행렬이다. 목차 1. 정의 및 기본 개념 2. 주요 성질 3. 기하학적 의미 4. 직교군 (Orthogonal Group) 5. 직교행렬의 생성과 분해 6. 주요 응용 분야 1. 정의 및 기본 개념 1.1 수학…
옵션 가격 모델링 (Option Pricing Modeling) 1. 개요 옵션 가격 모델링이란 기초 자산의 가격 변동, 시간의 경과, 이자율 및 변동성 등의 변수를 수학적으로 분석하여 옵션의 이론적 공정 가치(Fair Value), 즉 옵션 프리미엄(Option Premium)을 산출하는 과정이다. 옵션 가격 모델링의 주된 목적은 매수자와 매도자 모두가 …
첨가량 최적화 (Additive Dosage Optimization) 1. 개요 첨가량 최적화란 재료의 특정 물성을 개선하거나 새로운 기능을 부여하기 위해 투입되는 첨가제(Additive)의 양을 통계적·실험적 방법으로 분석하여, 경제적 효율성을 포함하여 목표 성능을 극대화하면서 부작용을 최소화하는 최적의 함량을 결정하는 과정이다. 재료공학에서 첨가제는 소…
내부점법 (Interior Point Method) 1. 개요 내부점법(Interior Point Method)은 제약 조건이 있는 최적화 문제에서 실행 가능 영역(Feasible Region)의 내부를 통해 최적해로 접근하는 수치 최적화 알고리즘의 한 부류이다. 주로 선형 계획법(Linear Programming, LP) 및 비선형 계획법(Nonlinea…
추론 속도 (Inference Speed) 1. 개요 추론 속도(Inference Speed)란 학습이 완료된 AI 모델에 새로운 입력 데이터를 넣었을 때, 모델이 예측 결과(출력)를 내놓기까지 걸리는 시간을 의미한다. AI 모델 서비스(Serving) 단계에서 추론 속도는 서비스의 실용성을 결정짓는 핵심 요소이다. 특히 실시간 상호작용이 필요한 챗봇, 자…
좌특이벡터 (Left Singular Vector) 1. 개요 좌특이벡터(Left Singular Vector)는 임의의 행렬 에 대한 특이값 분해(Singular Value Decomposition, SVD)에서 결과 행렬 를 구성하는 열벡터들로, 행렬 에 의해 변환된 출력 공간(공역)의 정규직교 기저(Orthonormal Basis)를 형성하는 벡터를 …
목표 기반 인코딩 목표 기반 인코딩(Target-based Encoding)은 범주형 변수(Categorical Variable)를 수치형 변수로 변환 데이터 인코딩법 중 하나로, 특히 지도 학습(Supervised Learning)에서 목표 변수(Target Variable)와의 관계를 활용하여 인코딩을하는 방법입니다. 이 방은 단순한 레이블 인코딩(La…
지수함수 (Exponential Function) 1. 개요 지수함수란 변수가 지수 자리에 위치한 함수로, 일반적으로 (단, )의 형태로 정의되는 초월함수(Transcendental function, 대수 방정식으로 나타낼 수 없는 함수)이다. 지수함수는 값이 일정하게 증가하는 것이 아니라, 이전 값에 일정한 비율을 곱하며 급격하게 증가하거나 감소하는 '지…
스터지스 규칙 (Sturges' rule) 스터지스 규칙은 연속형 데이터의 도수분포표를 작성하거나 히스토그램을 그릴 때, 데이터의 총 개수를 바탕으로 최적의 계급(Bin) 수를 결정하기 위해 사용되는 통계적 공식이다. 1. 개요 데이터 분석 과정에서 원시 데이터를 구간별로 나누어 빈도를 측정하는 도수분포표(Frequency Distribution Table…
에너지 최소화 (Energy Minimization) 1. 개요 에너지 최소화(Energy Minimization)란 물리적 시스템의 포텐셜 에너지를 최소화하는 원자 또는 입자들의 좌표 배치를 찾는 수치적 최적화 과정으로, 시스템이 가장 안정된 상태인 평형 상태(Equilibrium State)에 도달하도록 하는 계산 기법이다. 2. 물리적 원리와 배경 2…
에지 검출 (Edge Detection) 1. 개요 에지 검출(Edge Detection)이란 디지털 이미지에서 픽셀 값이 격하게 변화하는 지점을 찾아내어 객체의 경계선을 추출하는 영상 처리 기법이다. 이미지 처리에서 '에지(Edge)'는 픽셀 값의 불연속성이 발생하는 지점으로, 이는 실제 세계에서 객체의 형태 변화, 조명의 변화, 또는 깊이의 차이로 인해…
조정 결정계수 (Adjusted R-squared) 조정 결정계수(Adjusted R-squared)는 회귀 분석에서 모델의 설명력을 나타내는 결정계수( )가 독립 변수의 개수가 증가함에 따라 무조건적으로 상승하는 단점을 보완하기 위해, 변수 개수에 따른 페널티를 부여하여 계산한 지표이다. 1. 개요 회귀 분석의 목적은 독립 변수( )들이 종속 변수( )의…
질문 응답 시스템 개요 질문 응답 시스템(Question Answering, QA)은 사용자가 자연어로 제시한 질문에 대해 정확하고 간결한 답변을 자동으로 생성하는 기술이다. 전통적인 정보 검색(IR) 시스템이 “문서 목록”을 반환한다면, QA 시스템은 “답변 자체”를 제공한다는 점에서 차별화된다. 최근 딥러닝, 특히 대규모 사전학습 언어 모델(Pre‑tr…