검색 결과

"통계량"에 대한 검색 결과 (총 61개)

Box plot

과학 > 통계학 > 데이터 시각화 | 익명 | 2026-01-04 | 조회수 138

Box plot 개요 박스 플롯(Box plot), 또는 상자 수염 그림(box-and-whisker plot)은 데이터의 분포를 시각적으로 표현하는 통계 그래프의 일종입니다. 이 그래프는 데이터의 중심 경향, 산포도, 왜도, 이상치(outlier) 등을 한눈에 파악할 수 있게 해주며, 특히 여러 그룹 간의 분포를 비교할 때 매우 유용합니다. 박스 플롯은 …

양측 검정

과학 > 통계학 > 가설 검정 | 익명 | 2025-12-30 | 조회수 194

양측 검정 개요 양측 검정(two-tailed test)은 통계학에서 가설 검정의 한 형태로, 모수(parameter)가 특정 값과 다르다(≠)는 것을 검정하고자 할 때 사용된다. 즉, 관심 있는 모수(예: 모평균, 모비율 등)가 기준값보다 크거나 작을 가능성 모두를 고려하여 귀무가설을 기각할지를 판단하는 방법이다. 이는 한쪽 방향에만 관심을 두는 단측 검…

기각역

과학 > 가설 검정 > 기각역 | 익명 | 2025-12-29 | 조회수 239

기각역 개요 기각역(rejection region)은 통계학에서 가설 검정(hypothesis testing)의 핵심 개념 중 하나로, 귀무가설( )을 기각할지를 결정하는 기준을 수학적으로 정의한 영역을 의미한다. 즉, 표본에서 계산된 검정통계량(test statistic)이 이 영역에 속할 경우, 귀무가설을 기각하고 대립가설( 또는 )을 지지하는 결론을 …

귀무가설

과학 > 통계학 > 가설 검정 | 익명 | 2025-12-29 | 조회수 259

귀무가설 개요 귀무가설(Null Hypothesis)은 통계학에서 가설 검정의 출발점이 되는 기본적인 가설로, 일반적으로 "효과가 없다", "차이가 없다", "상관이 없다"는 주장을 담고 있다. 기호로는 보통 H₀ (H-zero 또는 H-nought)로 표기하며, 연구자가 검정을 통해 기각하거나 기각하지 못할 가능성을 가진 가설이다. 귀무가설은 과학적 연구…

비표준화 베타계수

과학 > 통계학 > 회귀분석 | 익명 | 2025-12-27 | 조회수 112

비표준화 베타계수 개요 비표준화 베타계수(Unstandardized Beta Coefficient)는 회귀분석에서 독립변수(설명변수)가 종속변수(반응변수)에 미치는 영향의 크기를 나타내는 통계량 중 하나로, 변수들의 원래 측정 단위를 유지한 상태에서 추정된 회귀계수를 의미한다. 일반적으로 회귀분석 결과 출력 시 B 또는 β로 표기되며, 독립변수가 1단위 증…

서열

과학 > 통계학 > 순서형 데이터 분석 | 익명 | 2025-12-18 | 조회수 53

서열 개요 서열(序列表記, Ordinal Scale)은 통계학에서 자료의 측정 수준(measurement level) 중 하나로, 데이터가 자연스러운 순서를 가지지만 그 간격이 일정하지 않은 경우에 사용되는 척도를 의미한다. 서열 척도는 명목 척도(Nominal Scale)보다 높은 수준의 측정 척도이며, 간격 척도(Interval Scale)와 비율 척도…

Brant Test

과학 > 가설 검정 > 모델 가정 검정 | 익명 | 2025-10-04 | 조회수 106

Brant Test 개요 Brant Test(브란트 검)는 통계에서 다항 로지틱 회귀 모델(Multinomial Logistic Regression)의 비례 오즈 가정(Proportional Odds Assumption)을 검정하기 위한 통계적 방법이다. 이 검정은 다항 로지스틱 회귀 모델을 사용할 때 독립 변수들이 종속 변수의 각 범주에 대해 동일한 영향…

ROC 곡선

기술 > 데이터과학 > 모델 평가 | 익명 | 2025-09-27 | 조회수 105

ROC 곡선 개요 ROC 곡선(Receiver Operatingistic Curve, 수기 운영 특성 곡선)은 이진류 모델의 성능을각적으로 평가하고 비교하는 데 사용되는 중요한 도입니다. ROC 곡선은 다양한 분류 임계값(threshold)에 민감도(감지율, 재현율)와 위양성율(거짓 양성 비율)을 비교하여 모델의 판별 능력을 분석합니다. 이 곡선은 특히 클…

설명변수의 분산

과학 > 통계학 > 회귀분석 | 익명 | 2025-09-19 | 조회수 87

설명변수의 분산 개요 회귀분석(Regression Analysis)은 종속변수(dependent variable)와 이상의 독립변수(independent variable) 간의 관계를 모델링하고 분석하는 통계적 기법이다. 이 과정에서 독립변수는 일반적으로 설명변수(explanatory variable) 또는 예측변수(predictor variable)라고도…

지수족 형태

기술 > 통계학 > 확률분포 | 익명 | 2025-09-19 | 조회수 82

지수족 형태 지수족(Exponential Family Form)는 통계학에서 중요한 확률분의 수학적 구로, 많은 일반적인 확률분포들이 이 형태로 표현될 수 있다. 지수족은 추정 이론, 베이즈 통계, 일반화선형모형(GLM), 정보 이론 등 다양한 통계적 분석에서 핵심적인 역할을 하며, 수학적 처리의 용이성과 이론적 아름다움을 동시에 갖춘 구조이다. 본 문서에…

Adjusted R-squared

과학 > 통계학 > 회귀분석 | 익명 | 2025-09-16 | 조회수 118

Adjusted R-s 개요Adjusted R-squared수정된 결정계수)는귀분석에서 모의 적합도를 평가하는 지표 중 하나로, 일반적인 R-squared(결계수)의계를 보완하기 위해 제안된 통계량이다. R-squared 독립변수들이 종속변수를 잘 설명하는지를 나타내는 값이지만, 독립변수를 추가할수록 무조건 증가하는 성향이 있어 모델의 과적합(overfit…

데이터 정제

기술 > 데이터과학 > 데이터 정제 | 익명 | 2025-09-10 | 조회수 94

데이터 정제 요 데이터 정제(Data Cleaning는 데이터 과학 프로세스의 핵 단계 중 하나로,된 원시 데이터 data)에서 오류 중복, 불일치, 결측치, 이상치 등을 식별하고 수정하거나 제거하여 분석에 적합한 고품질의 데이터셋을 만드는 과정을 말합니다. 데이터 정제는 데이터 분석, 기계 학습, 비즈니스 인텔리전스 등의 후속 작업의 정확성과 신뢰성을 결…

연속형

기술 > 데이터과학 > 데이터 유형 | 익명 | 2025-09-04 | 조회수 86

연속형 개요 연속형(Continuous type은 데이터과학에서의 측정 방식과 값의 성격에 따라 분류하는 데이터 유형 중 하나로, 특정 구간 내에서 무한히 많은 값을 가질 수 있는 수치 데이터를 의미합니다. 연속형 데이터는 이산형 데이터와 대조되며, 주로 물리적 측정값(예: 길이, 무게, 온도, 시간 등)에서 나타납니다. 이 데이터 유형은 통계 분석, 머신…

명목형 범주

기술 > 데이터과학 > 인코딩 | 익명 | 2025-09-02 | 조회수 157

명목형 범 개요명목형 범주(inal Category)는 통계학 및 데이터과학에서 범주형 자료(Categorical Data)의 한 유형으로, 서로 구분 가능한 범주를지만 서로 간 순서나 크기 관계가 없는 데이터를 의미합니다. 명목형주는 단순히 이름(Name) 또는 레이블)에 기반한 분류 제공하며, 수치적인 해이나 대소 비교가가능합니다. 데이터 전처리 과정에…

박스 플롯

기술 > 데이터시각화 > 그래프 유형 | 익명 | 2025-09-01 | 조회수 103

박스 플롯 개요 박스 플롯(Box Plot), 또는 상자 수염 그림(Box-and-Whisker Plot) 데이터의 분포와 산포도를 시각적으로 표현하는 데 사용되는 그래프 유형. 주로 통계 분석과 데이터 시각화에서 데이터의 중심 경향, 변동성, 이상치(Outliers) 등을 한눈에 파악할 수 있도록 도와줍니다. 박스 플롯은 최소값, 제1사분위수(Q1), 중…

교차 검증 기반 인코딩

기술 > 데이터과학 > 모델 평가 | 익명 | 2025-09-01 | 조회수 85

교차 검증 기 인코딩 개요교차 검증 기반 인딩(Cross-Validation-Based Encoding) 범주형 변수(categorical variable)를 수치 변수로 변환 고급 인코딩법 중 하나로 주로 목 변수 기반 인코(Target Encoding) 일환으로 사용됩니다. 이 방법은 범형 변수의 각주(category)를 해당 범주에 속하는 목표 변수(…

타깃 인코딩

기술 > 데이터과학 > 인코딩 | 익명 | 2025-09-01 | 조회수 151

타깃 인코딩 개요 타깃 인코(Target Encoding)은 범형 변수(Categorical Variable)를 수치형 변수로 변환하는 고급 인코딩 기법 중 하나로, 주어진 범주(category)의 값이 종속 변수(target variable)에 미치는 영향을 기반으로 인코딩을 수행합니다. 이 방법은 특히 범주가 많고 희소한(high-cardinality …

범주형 데이터 인코딩

기술 > 데이터과학 > 데이터 변환 | 익명 | 2025-08-30 | 조회수 103

범주형 데이터 인코 개요범주형 데이터 인코딩(C Data Encoding)은 과학 및 머신러닝에서 중요한 전 과정 중 하나, 범주형 변수ategorical variable)를 머러닝 모델 이해하고 처리할 수 있는 수형 형태로 변하는 기법을 의미. 대부분의 머러닝 알고리즘은 숫자형 데이터를 입력으로 요구하므로, 텍스트의 범주(예: "남성",여성", "울", …

p-value

과학 > 통계학 > 회귀분석 | 익명 | 2025-07-27 | 조회수 972

p-값 개요 p-값(p-value)은 통계적 가설 검정에서 귀무 가설(null hypothesis)이 참일 경우, 관측된 데이터 또는 그보다 더 극단적인 결과가 발생할 확률을 나타냅니다. 이 값은 연구자가 귀무 가설을 기각할지 여부를 판단하는 기준으로 사용되며, 일반적으로 0.05 또는 0.01과 같은 유의 수준(significance level)과 비교됩…

연산

교육 > 수학 > 통계 | 익명 | 2025-07-15 | 조회수 129

연산 개요 연산(Operations)은 수학과 통계에서 데이터를 처리하고 분석하기 위해 사용되는 기본적인 계산 및 논리적 절차를 의미합니다. 이는 단순한 산술 계산부터 복잡한 통계 모델링까지 다양한 영역에 적용되며, 데이터의 특성 파악과 결과 도출에 필수적인 역할을 합니다. 본 문서에서는 연산의 주요 유형, 통계 분야에서의 활용 방식, 그리고 실제 예시를 …