검색 결과

"SSPL"에 대한 검색 결과 (총 12개)

테스트 데이터

기술 > 데이터과학 > 데이터 분할 | 익명 | 2026-08-12 | 조회수 20

테스트 데이터 개요 스트 데이터(Test Data는 데이터 과학 및 기계 학습 프로젝트에서 모델의능을 평가하기 위해 사용되는 데이터의 하 집합입니다.적으로 전체 데이터셋은 훈련(Training), 검증(Validation), 테스트(Test) 데이터로 분할되며, 이 중 테 데이터는 모델발 과정에서 최종 평가 단에서 사용됩니다 테스트 데이터는 모이 훈련 과에…

Elasticsearch

기술 > 검색 엔진 > 全文 검색 | 익명 | 2026-08-07 | 조회수 54

Elasticsearch 1. 개요 Elasticsearch는 Apache Lucene 기반의 분산 검색 및 분석 엔진으로, 대량의 데이터를 실시간으로 저장, 검색, 분석할 수 있도록 설계된 시스템이다. (2021년부터 라이선스가 SSPL 및 Elastic License로 변경되어 현재는 '소스 공개(Source Available)' 모델로 운영되고 있다.…

ELK 스택

기술 > 데이터 수집 > 로그 관리 | 익명 | 2026-08-07 | 조회수 40

ELK 스택 (ELK Stack) ELK 스택은 Elasticsearch, Logstash, Kibana라는 세 가지 오픈소스 프로젝트를 결합하여 대량의 데이터를 실시간으로 수집, 저장, 분석 및 시각화하는 통합 로그 관리 솔루션이다. 최근에는 경량 데이터 수집기인 Beats가 추가됨에 따라, Elastic 사에서는 이를 통합하여 Elastic Stack이…

데이터 리크

기술 > 데이터과학 > 데이터 전처리 | 익명 | 2026-07-29 | 조회수 29

데이터 리크 (Data Leakage) 개요 데이터 리크(Data Leakage)란 머신러닝 모델을 학습시킬 때, 모델이 예측해야 할 타겟(Target) 정보나 테스트 데이터셋의 정보가 학습 데이터셋에 의도치 않게 포함되어 모델의 성능이 비정상적으로 높게 측정되는 현상을 말한다. 데이터 리크가 발생하면 학습 단계에서는 매우 높은 정확도와 낮은 오차를 보이지…

Redis

기술 > 데이터베이스 > 인메모리 데이터베이스 | 익명 | 2026-07-11 | 조회수 27

Redis 개요 Redis(Remote Dictionary Server)는 고성능의 인메모리 데이터 구조 저장소(in-memory data structure store)로, 주로 캐싱, 메시지 브로커, 세션 저장소, 실시간 애플리케이션 데이터 처리 등에 활용되는 오픈소스 데이터베이스 시스템입니다. Redis는 키-값(Key-Value) 기반의 저장 구조를 …

아파치 라이선스

기술 > 소프트웨어 개발 > 라이선스 | 익명 | 2026-06-20 | 조회수 36

아파치 라이선스 (Apache License) 아파치 라이선스(Apache License)는 아파치 소프트웨어 재단(Apache Software Foundation, ASF)에서 개발한 자유 소프트웨어 및 오픈 소스 소프트웨어 라이선스입니다. 현재 널리 사용되는 버전은 2008년에 발표된 아파치 라이선스 2.0(Apache License 2.0)이며, 이는…

RepeatedKFold

기술 > 데이터과학 > 모델 평가 | 익명 | 2026-06-20 | 조회수 47

RepeatedKFold RepeatedKFold(중복 K-폴드 교차 검증)는 머신러닝 모델의 성능을 평가할 때 사용되는 교차 검증(Cross-Validation) 기법 중 하나입니다. 기존의 K-폴드 교차 검증(K-Fold Cross-Validation)을 여러 번 반복하여 수행함으로써, 데이터의 분할 방식에 따른 편향(Bias)을 줄이고 모델 평가의 신…

Time Series Cross-Validation

기술 > 데이터과학 > 모델 평가 | 익명 | 2025-10-02 | 조회수 83

Time Series Cross-ValidationTime Series Cross-Validation(시계 교차 검증은 시계열 데이터 특화된 모 평가 기법, 일반적인 교차 검증(Cross-Validation) 방식이 가정하는의 독립성 동일 분포(i.d.) 조건이 시계열 데이터에서는 성립하지 않기 때문에발된 방법이다. 시계열 데이터는 시간 순에 따라 관측값이…

K-겹 교차 검증

기술 > 데이터과학 > 모델 평가 | 익명 | 2025-09-18 | 조회수 117

K-겹 교차 검증 개요 K-겹 교차 검증(-Fold Cross Validation)은신러닝 및 데이터 과학 분야에서 모델의 성능을 평가하는 데 널리 사용되는 통계적 기법입니다. 이 방법은 주어진 데이터셋을 학습과 검증에 반복적으로 나누어 모델의 일반화 능력을 보다 신뢰성 있게 평가할 수 있도록 도와줍니다. 특히, 데이터 양이 제한적일 때 전체 데이터를 효율…

교차 검증

기술 > 데이터과학 > 분석 | 익명 | 2025-09-17 | 조회수 328

교차 검증 개요 교차 검(Cross-Validation, CV) 기계학습 통계 모델의 성능을가하고 과적(overfitting) 방지하기 위해 사용되는 기법입니다. 모델이 훈련 데이터만 잘 맞추어져 새로운 데이터에 대해서는 성능이 저하되는 문제를 사전에 검출하기 위해, 데이터를 여러 번 나누어 학습과 검증을 반복하는 방식으로 작동합니다. 특히 데이터 양이 제…

K-Fold Cross-Validation

기술 > 데이터과학 > 모델 평가 | 익명 | 2025-09-03 | 조회수 148

K-Fold Cross- K-Fold Cross-Validation(K-겹 교차 검증)은 머신러닝과 통계 모델의 성능을 평가하기 위해 널리 사용되는 기입니다. 이 방법은 데이터를 여러 개의 부분으로 나누어 반복적으로 훈련과 검증을 수행함으로써 모델의 일반화 능력을 더 정확하게 평가할 수 있도록 도와줍니다. 특히, 데이터셋의 크기가 제한적일 때 과적합(ove…

교차 검증 기반 인코딩

기술 > 데이터과학 > 모델 평가 | 익명 | 2025-09-01 | 조회수 95

교차 검증 기 인코딩 개요교차 검증 기반 인딩(Cross-Validation-Based Encoding) 범주형 변수(categorical variable)를 수치 변수로 변환 고급 인코딩법 중 하나로 주로 목 변수 기반 인코(Target Encoding) 일환으로 사용됩니다. 이 방법은 범형 변수의 각주(category)를 해당 범주에 속하는 목표 변수(…