검색 결과

"테스트 데이터"에 대한 검색 결과 (총 81개)

테스트 데이터

기술 > 데이터과학 > 데이터 분할 | 익명 | 2026-08-12 | 조회수 18

테스트 데이터 개요 스트 데이터(Test Data는 데이터 과학 및 기계 학습 프로젝트에서 모델의능을 평가하기 위해 사용되는 데이터의 하 집합입니다.적으로 전체 데이터셋은 훈련(Training), 검증(Validation), 테스트(Test) 데이터로 분할되며, 이 중 테 데이터는 모델발 과정에서 최종 평가 단에서 사용됩니다 테스트 데이터는 모이 훈련 과에…

테스트 데이터

기술 > 데이터과학 > 데이터 유형 | 익명 | 2026-06-20 | 조회수 27

테스트 데이터 (Test Data) 개요 테스트 데이터(Test Data)는 소프트웨어 개발, 시스템 테스트, 데이터 분석 모델 검증 등 다양한 기술적 과정에서 사용 목적으로 생성되거나 수집된 가상의 또는 실제 데이터의 집합을 의미합니다. 소프트웨어 공학이나 데이터 과학 분야에서 '테스트 데이터'는 시스템의 기능적 정확성, 성능, 보안성 및 데이터 처리 로…

테스트 자동화

기술 > 데이터과학 > 분석 | 익명 | 2026-08-09 | 조회수 36

테스트 자동화 (Test Automation) 1. 개요 테스트 자동화란 소프트웨어 테스트 프로세스를 사람이 직접 수행하는 대신, 특정한 도구와 스크립트를 사용하여 자동으로 실행하고 검증하는 기술적 방법론을 의미한다. 수동 테스트(Manual Testing)가 테스터의 직관과 경험을 바탕으로 탐색적 테스트를 수행하는 데 강점이 있다면, 테스트 자동화는 반복…

주택 가격 예측

기술 > 데이터과학 > 분석 | 익명 | 2026-08-09 | 조회수 20

주택 가격 예측 (House Price Prediction) 1. 개요 주택 가격 예측이란 머신러닝 기반의 회귀 분석을 통해 특정 주택의 가치를 예측하는 과정이다. 이 과정의 주된 목적은 과거의 거래 패턴과 주택의 물리적·환경적 특성 사이의 상관관계를 학습하여, 새로운 데이터가 입력되었을 때 정확한 가격을 산출하는 회귀(Regression) 모델을 구축하는…

총 거래 횟수

경제 > 시장 및 비즈니스 > 마케팅 | 익명 | 2026-08-07 | 조회수 12

총 거래 횟수 (Total Transaction Count) 총 거래 횟수(Total Transaction Count)란 특정 기간 동안 비즈니스 플랫폼 내에서 발생한 모든 개별 거래의 총합을 의미하는 정량적 지표이다. 1. 정의 및 개념 총 거래 횟수는 기업이 제공하는 상품이나 서비스가 고객에 의해 구매, 결제 또는 교환된 횟수를 단순 합산한 수치이다. …

스무딩 타깃 인코딩

기술 > 데이터과학 > 데이터 정제 | 익명 | 2026-08-06 | 조회수 62

스무딩 타깃 인코딩 스무딩 타깃코딩(Smoothing Target Encoding은 범주형 변수를 수치형 변수로 변환하는 데이터 정제 기법 중 하나로, 특히 머신러닝 모델의 성능 향상을 위해 널리 사용된다. 이 기법은 범주형 변수의 각 카테고리에 대해 해당 카테고리가 목표 변수(target variable)에 미치는 영향을 수치로 표현하면서, 소수의 샘플로…

어휘 사전

기술 > 자연어처리 > 데이터 전처리 | 익명 | 2026-08-06 | 조회수 62

어휘 사전 (Vocabulary) 1. 개요 어휘 사전(Vocabulary)이란 자연어 처리(NLP)에서 모델이 처리할 수 있는 모든 고유한 토큰(Token, 텍스트의 최소 의미 단위)의 집합을 의미하며, 텍스트 데이터를 컴퓨터가 이해할 수 있는 수치형 벡터로 변환하기 위한 기초 매핑 테이블 역할을 한다. 2. 어휘 사전 구축 과정 어휘 사전 구축은 원시 …

전역 정규화

기술 > 머신러닝 > 모델 학습 | 익명 | 2026-08-06 | 조회수 34

전역 정규화 (Global Normalization) 1. 개요 전역 정규화(Global Normalization)란 머신러닝 모델 학습 전, 데이터셋 전체의 통계량(평균, 표준편차, 최솟값, 최댓값 등)을 산출하여 모든 개별 데이터를 일정한 범위나 분포로 변환하는 데이터 전처리 기법이다. 이 과정의 주된 목적은 서로 다른 단위(Unit)나 스케일을 가진 …

감독 학습

기술 > 인공지능 > 머신러닝 | 익명 | 2026-08-05 | 조회수 41

감독 학습 개요 감독 학습(Supervised Learning)은 인공지능, 특히 머신러닝 분야에서 가장 기초적이고 널리 사용되는 학습 방식 중 하나입니다. 이 방법은 입력 데이터와 그에 대응하는 정답(레이블)이 쌍으로 주어진 상태에서 모델이 입력과 출력 사이의 관계를 학습함으로써 새로운 입력에 대한 정확한 출력을 예측할 수 있도록 합니다. 감독 학습은 분…

데이터 증강

기술 > 데이터과학 > 데이터 증강 | 익명 | 2026-08-05 | 조회수 124

데이터 증강 (Data Augmentation) 1. 개요 데이터 증강(Data Augmentation)이란 기존의 학습 데이터를 인위적으로 변형하거나 생성하여 데이터셋의 양을 늘리고 다양성을 확보하는 데이터 전처리 기법이다. 머신러닝과 딥러닝 모델, 특히 파라미터 수가 많은 심층 신경망은 학습 데이터가 부족할 경우 훈련 데이터에만 지나치게 최적화되어 새로…

데이터 과학

기술 > 데이터과학 > 데이터 과학 | 익명 | 2026-08-05 | 조회수 65

데이터 과학 (Data Science) 1. 개요 데이터 과학(Data Science)은 정형 및 비정형 데이터로부터 유의미한 통찰(Insight)과 지식을 추출하기 위해 수학, 통계학, 컴퓨터 과학 및 도메인 지식을 융합하여 활용하는 다학제적 분야이다. 현대 사회에서 데이터 과학은 단순한 통계 분석을 넘어, 방대한 양의 데이터(Big Data)를 처리하고…

조화 평균

기술 > 수학 > 통계 | 익명 | 2026-08-04 | 조회수 79

조화 평균 (Harmonic Mean) 조화 평균은 주어진 수들의 역수의 산술 평균을 구한 뒤, 다시 그 결과의 역수를 취하여 계산하는 평균값으로, 주로 비율이나 속도와 같이 단위당 기준이 변하는 값의 평균을 구할 때 사용됩니다. 정의 및 개념 조화 평균은 데이터 집합의 역수(Reciprocal, 어떤 수 에 대해 가 되는 수)들의 산술 평균의 역수로 정의…

L2 정규화

기술 > 머신러닝 > 정규화 | 익명 | 2026-07-31 | 조회수 53

L2 정규화 개요 L2 정규화(2 Regularization), 또는 리지 정규화(Ridge Regularization), 중치 감소(Weight Decay)는 머신러닝 및 딥러닝 모델에서 과적합(Overfitting)을 방지하기 위해 사용되는 대표적인 정규화 기법 중 하나입니다. 이 방법은 모델의 가중치에 제약을 가하여 복잡성을 줄이고, 학습 데이터에 지…

API 지원

기술 > 프로그래밍 > API | 익명 | 2026-07-31 | 조회수 43

API 지원 개요/소개 API(응용 프로그래밍 인터페이스)는 소프트웨어 간 상호작용을 가능하게 하는 핵심 기술로, 현대의 디지털 생태계에서 필수적인 역할을 합니다. API 지원은 개발자가 API를 효과적으로 활용하고 문제를 해결할 수 있도록 제공하는 다양한 자원과 프로세스를 의미합니다. 이 문서는 API 지원의 주요 유형, 중요성, 최선의 실천 방법, 도전…

데이터 리크

기술 > 데이터과학 > 데이터 전처리 | 익명 | 2026-07-29 | 조회수 28

데이터 리크 (Data Leakage) 개요 데이터 리크(Data Leakage)란 머신러닝 모델을 학습시킬 때, 모델이 예측해야 할 타겟(Target) 정보나 테스트 데이터셋의 정보가 학습 데이터셋에 의도치 않게 포함되어 모델의 성능이 비정상적으로 높게 측정되는 현상을 말한다. 데이터 리크가 발생하면 학습 단계에서는 매우 높은 정확도와 낮은 오차를 보이지…

Swish 활성화 함수

기술 > 인공지능 > 활성화 함수 | 익명 | 2026-07-28 | 조회수 18

Swish 활성화 함수 1. 개요 Swish는 Google Brain 팀이 제안한 자기 게이팅(Self-Gating) 메커니즘 기반의 비선형 활성화 함수로, 깊은 신경망에서 ReLU(Rectified Linear Unit)보다 더 나은 성능을 보이기 위해 설계되었습니다. Swish 함수는 입력값 에 시그모이드(Sigmoid) 함수를 곱한 형태로 정의되며, …

분류

기술 > 데이터과학 > 분석 | 익명 | 2026-07-28 | 조회수 98

분류 (Classification) 개요 분류(Classification)는 데이터과학에서 가장 핵심적인 기계학습(ML) 기법 중 하나로, 주어진 데이터를 사전 정의된 범주 또는 클래스에 할당하는 과정을 의미합니다. 이는 지도학습(Supervised Learning)의 대표적 유형으로, 입력 데이터(X)와 그에 해당하는 레이블(Y)을 기반으로 모델을 학습시…

배열 슬라이싱

기술 > 데이터과학 > 데이터 인덱싱 | 익명 | 2026-07-27 | 조회수 18

배열 슬라이싱 (Array Slicing) 1. 개요 배열 슬라이싱(Array Slicing)이란 배열이나 리스트와 같은 선형 데이터 구조에서 특정 인덱스 범위를 지정하여 연속된 요소들의 부분 집합을 추출함으로써 새로운 부분 배열을 생성하는 기법이다. 이 작업의 주된 목적은 전체 데이터셋 중 분석이나 처리가 필요한 특정 구간만을 효율적으로 분리하여 데이터 …

Overfitting

기술 > 인공지능 > 머신러닝 | 익명 | 2026-07-26 | 조회수 43

과적합 (Overfitting) 1. 개요 과적합(Overfitting)이란 머신러닝 모델이 학습 데이터(Training Data)에 지나치게 최적화되어, 새로운 데이터나 실제 환경의 데이터(Unseen Data)에 대해서는 예측 성능이 현저히 떨어지는 현상을 말한다. 모델이 데이터의 일반적인 패턴을 학습하는 것이 아니라, 학습 데이터에 포함된 무작위한 노…