검색 결과

"overfitting"에 대한 검색 결과 (총 195개)

Overfitting

기술 > 인공지능 > 머신러닝 | 익명 | 2026-07-26 | 조회수 40

과적합 (Overfitting) 1. 개요 과적합(Overfitting)이란 머신러닝 모델이 학습 데이터(Training Data)에 지나치게 최적화되어, 새로운 데이터나 실제 환경의 데이터(Unseen Data)에 대해서는 예측 성능이 현저히 떨어지는 현상을 말한다. 모델이 데이터의 일반적인 패턴을 학습하는 것이 아니라, 학습 데이터에 포함된 무작위한 노…

TensorBoard

기술 > 인공지능 > 모델 평가 | 익명 | 2026-08-17 | 조회수 23

TensorBoard 목차 1. 개요 2. 주요 기능 및 시각화 도구 3. 작동 원리 및 데이터 흐름 4. 설치 및 기본 사용법 5. PyTorch 연동 설정법 6. 원격 서버 접속 및 포트 포워딩 7. 심화 활용 및 분석 기법 8. 로그 파일 삭제 및 관리 방법 9. 장단점 및 대체 도구 1. 개요 TensorBoard는 딥러닝 모델의 학습 과정을 시각화…

결측치

기술 > 데이터과학 > 분석 | 익명 | 2026-08-17 | 조회수 21

결측치 개요 결측치(Missing Values)는 데이터 수집 또는 처리 과정에서 특정 값이 누락된 상태를 의미합니다. 이는 데이터 분석 및 머신러닝 모델의 정확도와 신뢰성에 중대한 영향을 미칠 수 있으며, 적절한 대응 전략이 필수적입니다. 결측치는 다양한 원인으로 발생할 수 있으며, 이를 이해하고 처리하는 것은 데이터 과학에서 중요한 단계입니다. 결측치의…

환각 현상

기술 > 자연어처리 > 언어 모델링 | 익명 | 2026-08-13 | 조회수 74

환각 현상 정의 환각 현상(Hallucination)이란 LLM(대규모 언어 모델)이 학습 데이터에 없는 내용을 마치 사실인 것처럼 자신 있게 생성하는 현상을 말한다. 이는 모델이 논리적으로는 그럴듯해 보이지만, 실제 사실과는 다른 허위 정보를 생성하는 일종의 생성 오류이다. 발생 원인 환각 현상은 LLM의 기본 작동 원리와 데이터의 한계로 인해 발생하며,…

텍스처 붕괴

기술 > 인공지능 > 생성 모델 문제 | 익명 | 2026-08-12 | 조회수 9

텍스처 붕괴 (Texture Collapse) 텍스처 붕괴란 생성형 AI 이미지 모델이 이미지를 생성하는 과정에서 특정 영역의 세부 묘사가 무너지거나, 부자연스러운 패턴이 반복적으로 나타나며 시각적 품질이 급격히 저하되는 현상을 말합니다. 이는 주로 모델이 학습 데이터의 분포를 정확하게 재현하지 못하거나, 생성 설정값이 임계치를 벗어났을 때 발생합니다. 정…

테스트 데이터

기술 > 데이터과학 > 데이터 분할 | 익명 | 2026-08-12 | 조회수 17

테스트 데이터 개요 스트 데이터(Test Data는 데이터 과학 및 기계 학습 프로젝트에서 모델의능을 평가하기 위해 사용되는 데이터의 하 집합입니다.적으로 전체 데이터셋은 훈련(Training), 검증(Validation), 테스트(Test) 데이터로 분할되며, 이 중 테 데이터는 모델발 과정에서 최종 평가 단에서 사용됩니다 테스트 데이터는 모이 훈련 과에…

Pseudo-labeling

기술 > 인공지능 > 준지도 학습 | 익명 | 2026-08-10 | 조회수 24

Pseudo-labeling (의사 라벨링) 1. 개요 Pseudo-labeling(의사 라벨링)은 라벨이 없는 데이터(Unlabeled Data)에 대해 모델이 예측한 결과값 중 신뢰도가 높은 것을 임시 정답(Pseudo-label)으로 간주하여 다시 학습 데이터셋에 포함시키는 준지도 학습(Semi-supervised Learning) 기법이다. 학계에서…

편향성

기술 > 인공지능 > 윤리 및 편향 | 익명 | 2026-08-09 | 조회수 49

편향성 (Bias) 1. 개요 편향성(Bias)이란 정보 처리 과정에서 특정 방향으로 치우쳐 객관성을 잃거나, 통계적 추정치가 실제 모수(Parameter)와 체계적으로 차이가 나는 상태를 의미한다. 인지적 관점에서는 인간의 뇌가 정보를 효율적으로 처리하기 위해 사용하는 지름길(Heuristics)로 인해 발생하는 판단 오류를 뜻하며, 통계 및 기술적 관점…

Pseudo R-squared

과학 > 통계학 > 회귀분석 | 익명 | 2026-08-09 | 조회수 19

Pseudo R-squared (의사 결정계수) 1. 개요 Pseudo R-squared(의사 결정계수)란 전통적인 선형 회귀의 결정계수( )를 일반화 선형 모델(GLM)로 확장하기 위해, 로지스틱 회귀(Logistic Regression)나 프로빗 모델(Probit Model)과 같은 비선형 모델에서 모델의 적합도(Goodness-of-fit)를 측정하기…

기술 > 인공지능 > 모델 평가 | 익명 | 2026-08-09 | 조회수 76

R² 개요 R²(R-squared, 결정계수)는 통계학 및 기계학습에서 회귀 모델의 성능을가하는 대표 지표 중 하나입니다. R² 모델이 종속 변수(dependent variable)의 분산 중 얼마나 많은 부분을 설명할 수 있는지를 나타내는 값으로, 일반적으로 0에서 1 사이의 값을 가집니다. 이 값이 1에 가까울수록 모델이 데이터의 변동성을 잘 설명하고 …

다중 선형 회귀

기술 > 인공지능 > 머신러닝 | 익명 | 2026-08-09 | 조회수 39

다중 선형 회귀 다중 선형 회귀(Multiple Linear Regression)는 하나의 종속 변수(dependent variable)와 두 개 이상의 독립 변수(independent variables) 간의 선형 관계를 모델링하는 통계적 기법이다. 머신러닝과 통계학에서 널리 사용되며, 특히 수치 예측 문제(regression problems)에서 기본이…

주택 가격 예측

기술 > 데이터과학 > 분석 | 익명 | 2026-08-09 | 조회수 20

주택 가격 예측 (House Price Prediction) 1. 개요 주택 가격 예측이란 머신러닝 기반의 회귀 분석을 통해 특정 주택의 가치를 예측하는 과정이다. 이 과정의 주된 목적은 과거의 거래 패턴과 주택의 물리적·환경적 특성 사이의 상관관계를 학습하여, 새로운 데이터가 입력되었을 때 정확한 가격을 산출하는 회귀(Regression) 모델을 구축하는…

혼합 알고리즘

기술 > 알고리즘 > 하이브리드 최적화 | 익명 | 2026-08-07 | 조회수 13

혼합 알고리즘 (Hybrid Algorithm) 1. 개요 혼합 알고리즘(Hybrid Algorithm)이란 두 개 이상의 서로 다른 알고리즘을 결합하여, 각 알고리즘이 가진 개별적인 단점을 보완하고 장점을 극대화함으로써 문제 해결의 효율성과 정확도를 높이는 최적화 기법이다. 현대의 복잡한 계산 문제들은 단일 알고리즘만으로는 해결하기 어려운 경우가 많다. …

데이터 편향

기술 > 인공지능 > 머신러닝 | 익명 | 2026-08-07 | 조회수 65

데이터 편향 개요 데이터 편향(Data Bias)은 머신러닝 모델 훈련에 사용되는 데이터셋에 시스템적으로 왜곡된 패턴이 존재하는 현상으로, 모델의 예측 결과에 불공정성이나 오류를 유발할 수 있습니다. 이러한 편향은 데이터 수집, 전처리, 모델링 전 단계에서 발생할 수 있으며, 사회적 불평등을 심화시키거나 법적 문제를 야기할 수 있습니다. 예를 들어, 얼굴 …

스무딩 타깃 인코딩

기술 > 데이터과학 > 데이터 정제 | 익명 | 2026-08-06 | 조회수 54

스무딩 타깃 인코딩 스무딩 타깃코딩(Smoothing Target Encoding은 범주형 변수를 수치형 변수로 변환하는 데이터 정제 기법 중 하나로, 특히 머신러닝 모델의 성능 향상을 위해 널리 사용된다. 이 기법은 범주형 변수의 각 카테고리에 대해 해당 카테고리가 목표 변수(target variable)에 미치는 영향을 수치로 표현하면서, 소수의 샘플로…

어휘 사전

기술 > 자연어처리 > 데이터 전처리 | 익명 | 2026-08-06 | 조회수 49

어휘 사전 (Vocabulary) 1. 개요 어휘 사전(Vocabulary)이란 자연어 처리(NLP)에서 모델이 처리할 수 있는 모든 고유한 토큰(Token, 텍스트의 최소 의미 단위)의 집합을 의미하며, 텍스트 데이터를 컴퓨터가 이해할 수 있는 수치형 벡터로 변환하기 위한 기초 매핑 테이블 역할을 한다. 2. 어휘 사전 구축 과정 어휘 사전 구축은 원시 …

모델 다양성

기술 > 인공지능 > 앙상블 | 익명 | 2026-08-05 | 조회수 17

모델 다양성 (Model Diversity) 1. 개요 모델 다양성(Model Diversity)이란 [[앙상블 학습]](Ensemble Learning) 시스템 내에서 결합되는 개별 학습 모델들이 서로 다른 예측 패턴을 가지거나, 서로 다른 종류의 오류를 범하는 정도를 의미한다. 앙상블 학습은 여러 개의 [[약한 학습기]](Weak Learner)를 결합…

감독 학습

기술 > 인공지능 > 머신러닝 | 익명 | 2026-08-05 | 조회수 31

감독 학습 개요 감독 학습(Supervised Learning)은 인공지능, 특히 머신러닝 분야에서 가장 기초적이고 널리 사용되는 학습 방식 중 하나입니다. 이 방법은 입력 데이터와 그에 대응하는 정답(레이블)이 쌍으로 주어진 상태에서 모델이 입력과 출력 사이의 관계를 학습함으로써 새로운 입력에 대한 정확한 출력을 예측할 수 있도록 합니다. 감독 학습은 분…

독립변수

과학 > 통계학 > 회귀분석 | 익명 | 2026-08-05 | 조회수 181

독립변수 개요 독립변수(independent variable)는 통계학, 특히 회귀분석에서 중요한 개념 중 하나로, 어떤 결과나 현상에 영향을 미칠 수 있다고 가정되는 변수를 의미한다. 독립변수는 종속변수(dependent variable)의 변화를 설명하거나 예측하는 데 사용되며, 실험이나 관찰 연구에서 연구자가 조작하거나 통제할 수 있는 변수로 정의되기…