검색 결과

"Sets"에 대한 검색 결과 (총 76개)

조정 결정계수

기술 > 통계학 > 회귀분석 | 익명 | 2026-07-15 | 조회수 38

조정 결정계수 (Adjusted R-squared) 조정 결정계수(Adjusted R-squared)는 회귀 분석에서 모델의 설명력을 나타내는 결정계수( )가 독립 변수의 개수가 증가함에 따라 무조건적으로 상승하는 단점을 보완하기 위해, 변수 개수에 따른 페널티를 부여하여 계산한 지표이다. 1. 개요 회귀 분석의 목적은 독립 변수( )들이 종속 변수( )의…

이진 분류

기술 > 데이터과학 > 분석 | 익명 | 2026-07-14 | 조회수 130

이진 분류 (Binary Classification) 1. 개요 이진 분류(Binary Classification)란 주어진 데이터를 두 개의 서로 배타적인 클래스(Class) 중 하나로 분류하는 [[지도 학습]](Supervised Learning)의 한 형태이다. 일반적으로 정답 레이블은 0과 1, 혹은 'Positive(긍정/참)'와 'Negative…

Progressive Web App

기술 > 웹기술 > PWA | 익명 | 2026-07-13 | 조회수 24

Progressive Web App (PWA) 1. 개요 Progressive Web App (PWA)란 최신 웹 표준 기술을 활용하여 웹사이트를 마치 네이티브 앱(Native App, 특정 OS 전용으로 개발된 앱)처럼 동작하게 만드는 사용자 경험 중심의 웹 애플리케이션 형태를 의미한다. PWA는 웹의 접근성과 네이티브 앱의 설치 가능성 및 성능을 결합한…

네이밍 규칙

기술 > 소프트웨어 > 문서 관리 | 익명 | 2026-07-13 | 조회수 54

네이밍 규칙 개요 네이밍 규칙(Naming Convention)은 소프웨어 개발 및 문서 관리 분야에서 파일, 변수, 함수, 클래스, 디렉터리 등의 이름을 체계적으로 지정하기 위한 규칙입니다. 특히 문서 관리 측면에서 네이밍 규칙은 정보의 접근성, 검색 용이성, 버전 관리, 협업 효율성 등을 크게 향상시키는 핵심 요소로 작용합니다. 조직 내에서 일관된 네이…

CAPM

경제 > 금융경제학 > 자산가격결정모델 | 익명 | 2026-07-13 | 조회수 113

CAPM 개요 자본자산가격결정모형(Capital Asset Pricing Model, 이하 CAPM)은 금융경제학에서 위험과 기대수익률 간의 관계를 설명하는 핵심 이론 중 하나이다. 이 모형은 투자자가 위험을 감수함으로써 얻을 수 있는 보상의 크기를 정량화하는 데 목적이 있으며, 자산의 기대수익률을 계산하는 데 널리 사용된다. 1960년대 윌리엄 셰프리(W…

Redis

기술 > 데이터베이스 > 인메모리 데이터베이스 | 익명 | 2026-07-11 | 조회수 28

Redis 개요 Redis(Remote Dictionary Server)는 고성능의 인메모리 데이터 구조 저장소(in-memory data structure store)로, 주로 캐싱, 메시지 브로커, 세션 저장소, 실시간 애플리케이션 데이터 처리 등에 활용되는 오픈소스 데이터베이스 시스템입니다. Redis는 키-값(Key-Value) 기반의 저장 구조를 …

AI Fairness 360 Toolkit

기술 > 인공지능 > 도구 | 익명 | 2026-07-10 | 조회수 35

AI Fairness 360 (AIF360) Toolkit 1. 개요 AI Fairness 360 (AIF360)은 IBM에서 개발한 오픈소스 라이브러리로, 머신러닝 모델의 학습 및 추론 과정에서 발생할 수 있는 편향성(Bias)을 탐지하고 이를 완화(Mitigation)하기 위한 포괄적인 도구 모음이다. 현대 인공지능 시스템은 학습 데이터에 포함된 인간의…

규제

기술 > 인공지능 > 모델 평가 | 익명 | 2026-07-10 | 조회수 37

AI 모델 규제 (AI Model Regulation) 1. 개요 및 정의 AI 모델 규제란 인공지능 기술이 사회 전반에 미치는 영향력을 고려하여, AI 시스템의 개발, 배포 및 사용 과정에서 발생할 수 있는 위험을 관리하고 법적·윤리적 기준을 준수하도록 강제하는 일련의 제도적 장치를 의미한다. 인공지능 기술은 데이터 기반의 의사결정 능력을 통해 산업 혁신…

scikit-learn

기술 > 소프트웨어 > 오픈소스 | 익명 | 2026-07-09 | 조회수 283

scikit-learn 개요 scikit-learn은 파이썬 프로그래밍 언어를 기반으로 한 오픈소스 머신러닝 라이브러리입니다. 과학적 컴퓨팅과 데이터 분석을 위한 Python 생태계(SciPy)에 포함되어 있으며, 데이터 마이닝, 데이터 분석, 예측 모델링 등 다양한 기능을 제공합니다. 2007년에 처음 공개된 이후로, 개발자와 데이터 과학자가 머신러닝 알…

Redis

기술 > 소프트웨어 > 개발도구 | 익명 | 2026-07-01 | 조회수 36

Redis (Remote Dictionary Server) 1. 개요 Redis(Remote Dictionary Server)는 메모리 내 데이터 구조 저장소( Structure Store)로, 데이터베이스, 캐시, 메시지 브로커 및 스트리밍 엔진으로 활용되는 오픈 소스 소프트웨어입니다. 일반적인 관계형 데이터베이스(RDBMS)가 하드 디스크나 SSD에 데…

Python 홈페이지 아키텍처

기술 > 소프트웨어 > Python | 익명 | 2026-06-26 | 조회수 60

Python 홈페이지 아키텍처 Python 홈페이지(python.org)는 Python 프로그래밍 언어의 공식 정보 허브이자 커뮤니티 게이트웨이입니다. 이 문서는 python.org의 기술적 아키텍처, 콘텐츠 관리 파이프라인, 그리고 글로벌 서비스 인프라가 어떻게 구성되어 있는지 분석합니다. Python 홈페이지 개요 및 역사적 배경 Python은 1991…

표본 공간

수학 > 확률론 > 수학적 구조 | 익명 | 2026-06-20 | 조회수 28

표본 공간 (Sample Space) 표본 공간(Sample Space)은 확률론과 통계학의 기초가 되는 핵심 개념으로, 어떤 무작위 실험(Random Experiment)에서 발생할 수 있는 모든 가능한 결과의 집합을 의미합니다. 일반적으로 그리스 문자 (오메가) 또는 로 표기하며, 집합론적 관점에서 확률 사건(Event)이 정의되는 무대의 역할을 합니다…

ROC Curve

기술 > 데이터과학 > 데이터 시각화 | 익명 | 2026-06-20 | 조회수 29

ROC Curve (Receiver Operating Characteristic Curve) 개요 ROC 곡선(Receiver Operating Characteristic Curve)은 이진 분류(Binary Classification) 모델의 성능을 평가하고 시각화하는 데 널리 사용되는 그래프입니다. 주로 의료 진단, 스팸 필터링, 신용 점수 평가 등 확…

테스트 데이터

기술 > 데이터과학 > 데이터 유형 | 익명 | 2026-06-20 | 조회수 29

테스트 데이터 (Test Data) 개요 테스트 데이터(Test Data)는 소프트웨어 개발, 시스템 테스트, 데이터 분석 모델 검증 등 다양한 기술적 과정에서 사용 목적으로 생성되거나 수집된 가상의 또는 실제 데이터의 집합을 의미합니다. 소프트웨어 공학이나 데이터 과학 분야에서 '테스트 데이터'는 시스템의 기능적 정확성, 성능, 보안성 및 데이터 처리 로…

MultiNLI

기술 > 자연어처리 > 데이터셋 | 익명 | 2026-06-20 | 조회수 49

MultiNLI MultiNLI(Multi-Genre Natural Language Inference)는 자연어 처리(NLP) 분야에서 널리 사용되는 대규모 텍스트 데이터셋으로, 자연어 추론(Natural Language Inference, NLI) 과제를 평가하고 발전시키기 위해 설계되었습니다. 이 데이터셋은 스탠포드 대학교의 자연어 처리 연구 그룹인 S…

캐글

기술 > 데이터과학 > 분석 | 익명 | 2026-06-20 | 조회수 32

캐글(Kaggle) 캐글(Kaggle)은 데이터 과학, 머신러닝, 인공지능(AI) 분야에서 세계 최대 규모의 온라인 커뮤니티이자 플랫폼입니다. 2010년 이반 오스틴(Ivan Osuna), 로버트 머피(Robert Murphy), 애덤 아론슨(Adam Aronson)에 의해 설립되었으며, 2017년 구글(Google)에 인수되어 현재는 구글의 일부로 운영되…

머신러닝

기술 > 인공지능 > 머신러닝 | 익명 | 2026-06-14 | 조회수 46

머신러닝(Machine Learning) 머신러닝은 명시적인 프로그래밍 없이 컴퓨터가 데이터를 통해 스스로 학습하고 패턴을 인식하여 예측 또는 결정을 내리는 인공지능(AI)의 핵심 하위 분야입니다. 머신러닝의 개요와 정의 머신러닝은 아서 사무엘(Arthur Samuel)이 1959년 "컴퓨터가 특정 작업을 수행하기 위해 명시적인 명령어 없이 학습할 수 있는…

XGBoost

기술 > 머신러닝 > 앙상블 방법 | 익명 | 2026-04-18 | 조회수 199

XGBoost 개요 XGBoost(Extreme Gradient Boosting)는 효율적이고 확장 가능한 그래디언트 부스팅 라이브러리로, Tianqi Chen과 공동 연구진에 의해 2014년 공개되었습니다. 데이터 과학 경진대회(Kaggle 등)와 산업 현장 모두에서 높은 예측 성능과 학습 속도로 널리 사용되고 있으며, 현재까지 머신러닝 생태계에서 가장 …

커뮤니티 기반 데이터 개요 커뮤니티 기반 데이터(Community-based Data)는 특정 커뮤니티(온라인 커뮤니티, 오프라인 집단, 전문가 그룹 등)의 구성원들이 자발적으로 생성, 공유, 기여하는 정보를 의미합니다. 이러한 데이터는 전통적인 기관 중심의 데이터 수집 방식과는 달리, 분산되고 참여 기반의 특성을 가지며, 특히 공개 데이터셋(Open Da…

군집화

기술 > 데이터과학 > 클러스터링 | 익명 | 2026-03-04 | 조회수 109

군집화 (Clustering) 개요 군집화(Clustering)는 비지도 학습(Unsupervised Learning) 기법 중 하나로, 사전에 레이블이 없는 데이터 집합을 유사한 특성을 가진 그룹(군집, cluster) 으로 자동 분할하는 방법을 말한다. 데이터 포인트 간의 거리 혹은 유사도 측정을 기반으로, 같은 군집에 속한 객체들은 서로 가깝고, 다른…