검색 결과

"왜도"에 대한 검색 결과 (총 24개)

지수분포

과학 > 통계학 > 확률분포 모델 | 익명 | 2026-08-05 | 조회수 4

지수분포 지수분(Exponential Distribution) 통계학과률론에서 연속 확률분포 일종으로, 간의 시간 간격을 모델링하는 데 널리됩니다. 특히,아송 과정(Pson process)에서하는 사건 사이의 시간을 설명하는 적합한 분포로,뢰성 공학, 생존 분석, 대기 이론(Queueing theory) 등 다양한 응용 분야에서 중요한 역할을 합니다. 개요…

이항분포

과학 > 통계학 > 확률분포 모델 | 익명 | 2026-08-05 | 조회수 2

이항분포 (Binomial Distribution) 1. 개요 이항분포는 결과가 오직 두 가지(성공 또는 실패)로만 나타나는 [[베르누이 시행]](Bernoulli trial)을 독립적으로 번 반복했을 때, 성공한 횟수의 확률 분포를 나타내는 이산 확률 분포이다. 베르누이 시행이란 동전 던지기처럼 결과가 '앞면' 혹은 '뒷면'과 같이 상호 배타적인 두 가지…

정규분포

통계학 > 확률 분포 > 정규분포 | 익명 | 2026-08-01 | 조회수 6

정규분포 (Normal Distribution) 정규분포는 평균 와 분산 에 의해 완전히 결정되는 연속 확률 분포의 일종으로, 평균을 중심으로 좌우 대칭인 종 모양(Bell-curve)의 형태를 띠는 확률 분포이다. 1. 개요 정규분포는 통계학 및 자연과학에서 가장 중요하게 다뤄지는 확률 분포이다. 수많은 독립적인 무작위 변수들이 합쳐졌을 때 나타나는 보편…

중심극한정리

과학 > 통계학 > 통계 | 익명 | 2026-07-29 | 조회수 8

중심극한정리 (Central Limit Theorem, CLT) 1. 개요 중심극한정리(Central Limit Theorem, CLT)란 모집단의 분포 모양과 상관없이, 표본의 크기가 충분히 크다면 표본 평균들의 분포가 정규분포(Normal Distribution)에 근사한다는 통계학의 핵심 정리이다. 이 정리는 통계적 추론의 근간이 되며, 우리가 모집단…

평균

과학 > 통계학 > 회귀분석 | 익명 | 2026-07-28 | 조회수 16

평균 개요 평균은 통계학에서 자주 사용되는 중심 경향성 측도로, 데이터 집합의 대표값을 나타냅니다. 주로 산술 평균, 기하 평균, 조화 평균 등으로 구분되며, 회귀 분석과 같은 통계적 모델링에서 중요한 역할을 합니다. 본 문서에서는 평균의 정의, 종류, 통계학에서의 활용 및 회귀 분석과의 연관성을 설명합니다. 1. 평균의 정의와 종류 1.1 산술 평균 (A…

제2사분위수

과학 > 통계학 > 분위수 | 익명 | 2026-07-24 | 조회수 16

제2사분위수 (Second Quartile) 제2사분위수(Second Quartile, )는 데이터를 4등분 하는 세 개의 지점 중 두 번째 지점으로, 전체 데이터의 정확히 50%가 이 값보다 작거나 같고 나머지 50%가 이 값보다 크거나 같은 지점을 의미한다. 1. 정의 및 개념 분위수(Quantile)란 전체 데이터를 크기 순으로 나열했을 때 특정 비율…

Z-score 표준화

기술 > 데이터과학 > 데이터 정제 | 익명 | 2026-07-19 | 조회수 16

Z-score 표준화 Z-score 표준화(Z-score Standardization)란 데이터의 평균을 0, 표준편차를 1이 되도록 변환하는 데이터 전처리 과정입니다. 서로 다른 척도(Scale)를 가진 변수들을 동일한 기준으로 비교하거나, 특정 값이 전체 데이터 분포에서 어느 정도 위치에 있는지 파악하는 것을 목적으로 합니다. 수식 및 원리 Z-scor…

확률 분포

과학 > 통계학 > 확률분포 | 익명 | 2026-07-19 | 조회수 11

확률 분포 개요 확률 분포(Probability Distribution는 확률변의 가능한 값들과 각 값이 발생할 확률을 체계적으로 설명하는 수학적 함수이다. 통계학과 확률론의 핵심 개념 중 하나, 데이터의 특과 불확실성을량적으로 분석 예측하는 데 필수적인 도구이다. 확률 분포는 실험, 관측, 또는 이론적 모델에서 얻은 결과의 확률적 행동을 모델링하는 데 사…

스터지스 규칙

기술 > 데이터과학 > 데이터 분할 | 익명 | 2026-07-16 | 조회수 7

스터지스 규칙 (Sturges' rule) 스터지스 규칙은 연속형 데이터의 도수분포표를 작성하거나 히스토그램을 그릴 때, 데이터의 총 개수를 바탕으로 최적의 계급(Bin) 수를 결정하기 위해 사용되는 통계적 공식이다. 1. 개요 데이터 분석 과정에서 원시 데이터를 구간별로 나누어 빈도를 측정하는 도수분포표(Frequency Distribution Table…

벤담-호크버그 보정

수학 > 통계학 > 가설검정 | 익명 | 2026-07-14 | 조회수 7

비정규 분포 기반 표준오차 보정 (Non-normality Based Standard Error Correction) 1. 개요 비정규 분포 기반 표준오차 보정은 표본 크기가 작거나 데이터의 분포가 정규분포를 따르지 않는 비정규성(Non-normality)을 띨 때, 가설검정의 신뢰도를 높이기 위해 표준 오차(Standard Error)를 조정하는 통계적 …

Q2

과학 > 통계학 > 분위수 | 익명 | 2026-07-13 | 조회수 12

Q2 (제2사분위수) Q2(제2사분위수, Second Quartile)는 정렬된 데이터 집합을 4등분했을 때 두 번째로 위치하는 지점으로, 전체 데이터의 정확히 50%가 이 값보다 작거나 같고 나머지 50%가 이 값보다 크거나 같은 지점을 의미한다. 1. 정의 및 개념 Q2는 통계학에서 데이터의 중심 경향성을 나타내는 대표적인 지표 중 하나이다. 가장 핵심…

로그 변환

기술 > 데이터과학 > 로그 변환 | 익명 | 2026-07-12 | 조회수 38

로그 변환 개요 로그 변환(log transformation)은 데이터 과학 및 통계 분석에서 자주 사용되는 비선형 데이터 변환 기법으로, 주로 비대칭적이고 오른쪽으로 치우친(right-skewed) 연속형 변수의 분포를 정규 분포에 가깝게 만들기 위해 활용된다. 특히 지수적 성장 패턴을 보이거나 값의 범위가 매우 넓은 데이터(예: 소득, 인구, 웹 방문 …

이상치 탐지

기술 > 데이터과학 > 이상치 탐지 | 익명 | 2026-07-10 | 조회수 94

이상치 탐지 개요 이상치지(Outlier Detection)는 데이터학 및 통계 분석에서 중요한 역할을 하는 기법으로, 데이터 세트 내 다른 관측치와显著하게 다른 값을 가지는 데이터 포인트를 식별하는 과정을 의미한다. 이러한 데이터 포인트는 일반적인 패턴이나 분포에서 벗어나며, 때로는 측정 오류, 데이터 입력 실수, 혹은 진정한 특이 현상일 수 있다. 이상…

제곱근 변환

과학 > 통계학 > 데이터 변환 | 익명 | 2026-06-20 | 조회수 23

제곱근 변환 (Square Root Transformation) 개요 제곱근 변환(Square Root Transformation)은 통계학 및 데이터 분석에서 비정규 분포를 가진 데이터를 정규 분포에 가깝게 만들기 위해 적용하는 비선형 변환 기법 중 하나입니다. 특히 계수 데이터(count data)나 비율 데이터와 같이 0 이상의 값을 가지는 데이터의 …

Box plot

과학 > 통계학 > 데이터 시각화 | 익명 | 2026-01-04 | 조회수 118

Box plot 개요 박스 플롯(Box plot), 또는 상자 수염 그림(box-and-whisker plot)은 데이터의 분포를 시각적으로 표현하는 통계 그래프의 일종입니다. 이 그래프는 데이터의 중심 경향, 산포도, 왜도, 이상치(outlier) 등을 한눈에 파악할 수 있게 해주며, 특히 여러 그룹 간의 분포를 비교할 때 매우 유용합니다. 박스 플롯은 …

상자 수염 그림

과학 > 데이터 시각화 > 그래프 유형 | 익명 | 2025-10-06 | 조회수 85

상자 수염 그림 개요 상자 수염 그림(box-whisker plot, 줄여서박스플롯, box plot)은 통계학에서 데이터의포를 시각적으로 요약하기 널리 사용되는프 유형입니다. 그래프는 데이터 중심 경향,포도, 왜도, 이상치(outlier) 등을 한눈에 파악할 수 있도록 도와주며, 특히 여러 집단 간의 분포를 비교할 때 매우 유용합니다. 상자 수염 그림은 …

히스토그램

과학 > 통계학 > 데이터 시각화 | 익명 | 2025-10-01 | 조회수 86

히스토그램 개요 히스토그(Histogram)은 통계학 연속형 또는산형 수치 데이터 분포를 시각적으로 표현하는 대적인 그래프 도구이다. 데이터를 일정한 구간(빈, bin)으로 나누고, 각 구간 속하는 데이터의 빈도수(frequency) 또는 상대 빈도수(relative frequency)를 막대의 높이로 나타낸다. 히스토그램은 데이터의 중심 경향, 산포도, …

도수

과학 > 통계학 > 빈도 분포 | 익명 | 2025-09-30 | 조회수 61

도수 개요 도수(度數,)는 통계에서 특정한 값이나 구간이 자료(데이터) 집합 내 얼마나 자주 나타나는지를 나타내는 수치이다 즉, 도수는 어떤 사건이나 범주가 관측된 횟수를 의미하며, 데이터의 분포를 이해하고 분석하는 데 핵심적인 역할을 한다. 도수는 빈도 분포표(frequency distribution table) 작성, 히스토그램(histogram) 생성…

데이터 전처리

기술 > 데이터과학 > 분석 | 익명 | 2025-09-20 | 조회수 77

데이터 전처리 데이터 전처리(Data Preprocessing)는 데이터 과학 프로젝에서 분석 또는 기계 학습 모델을 구축하기 전에 원시 데이터를 정리하고 변환하는 과정을 의미합니다. 현실 세계의 데이터는 대부분 불완전하고, 일관되지 않으며, 중되거나 노이즈가 포함되어 있어 그대로 사용 경우 분석 결과의 신뢰도가 떨어질 수 있습니다. 따라서 데이터 전처리는…

설명변수의 분산

과학 > 통계학 > 회귀분석 | 익명 | 2025-09-19 | 조회수 80

설명변수의 분산 개요 회귀분석(Regression Analysis)은 종속변수(dependent variable)와 이상의 독립변수(independent variable) 간의 관계를 모델링하고 분석하는 통계적 기법이다. 이 과정에서 독립변수는 일반적으로 설명변수(explanatory variable) 또는 예측변수(predictor variable)라고도…