신경 복원 기반 방법 (Neural Rendering / Neural Reconstruction) 1. 개요 신경 복원 기반 방법은 딥러닝 모델, 특히 다층 퍼셉트론(MLP)이나 가우시안 분포와 같은 신경망 기반의 표현법을 사용하여 3차원 장면의 기하학적 구조와 외관 정보를 학습하고, 이를 통해 새로운 시점의 이미지를 생성하는 기술이다. 이 기술은 광범위하…
검색 결과
"학습 데이터"에 대한 검색 결과 (총 249개)
대규모 언어 모델 (Large Language Model, LLM) 1. 개요 대규모 언어 모델(Large Language Model, 이하 LLM)은 방대한 양의 텍스트 데이터를 학습하여 인간과 유사한 자연어를 이해하고 생성할 수 있도록 설계된 거대 인공 신경망 모델이다. LLM은 수십억 개 이상의 파라미터(Parameter, 모델 내부의 가중치로 학습을…
합성 데이터 (Synthetic Data) 1. 개요 합성 데이터(Synthetic Data, 가상 데이터라고도 함)란 실제 세계에서 수집된 데이터가 아니라, 알고리즘이나 통계적 모델을 통해 인위적으로 생성된 데이터를 의미한다. 실제 데이터(Real-world Data)가 관찰된 사실의 기록이라면, 합성 데이터는 실제 데이터의 통계적 특성, 상관관계, 분포…
대표성 편향 (Representativeness Bias) 1. 개요 대표성 편향(Representativeness Bias)이란 어떤 대상이 특정 집단의 전형적인 특성과 유사하다는 이유만으로, 그 대상이 해당 집단에 속할 확률이 높다고 판단하는 인지적 오류를 의미한다. 이는 사람들이 확률적 판단을 내릴 때 수학적인 확률 계산보다는 직관적인 '유사성'이나 …
예측 불확실성 (Predictive Uncertainty) 1. 개요 예측 불확실성(Predictive Uncertainty)이란 통계적 모델이나 머신러닝 알고리즘이 특정 입력값에 대해 출력값을 예측할 때, 그 예측 결과가 얼마나 불확실한지를 나타내는 척도이다. 일반적으로 '예측 오차(Prediction Error)'가 실제 정답과 예측값 사이의 거리라는 …
데이터 마이닝 개요 데이터 마이닝(Data Mining)은 대량의 데이터에서 숨겨진 패턴, 상관관계, 추세 및 유용한 정보를 추출하는 데이터 분석 기술의 한 분야입니다. 이는 데이터베이스 지식 발견(Knowledge Discovery in Databases KDD) 프로세스의 핵심 단계로, 통계학, 기계학습, 데이터베이스 기술 등이 융합된 다학제적 접근을 …
GPU 기반 공격 (GPU-based Attacks) GPU 기반 공격이란 그래픽 처리 장치(GPU)의 강력한 병렬 연산 능력을 악용하여 특정 보안 체계를 무력화하거나 데이터를 탈취하는 공격 기법을 의미합니다. GPU는 수천 개의 코어를 통해 단순 반복 계산을 동시에 처리할 수 있어, 암호 해독, 무차별 대입 공격(Brute-force Attack), 딥페…
스테레오 시차 (Stereo Disparity) 스테레오 시차(Stereo Disparity)란 두 개의 서로 다른 시점에서 촬영된 이미지 쌍에서 동일한 객체가 나타나는 위치의 픽셀 좌표 차이를 의미하며, 이를 통해 3차원 공간상의 깊이(Depth) 정보를 복원하는 컴퓨터 비전의 핵심 개념이다. 1. 개요 인간은 두 눈이 일정 거리 떨어져 있어 왼쪽 눈과 …
DialoGPT 1. 개요 DialoGPT는 Microsoft에서 개발한 대화형 생성 모델로, 대규모 텍스트 코퍼스로 사전 훈련된 GPT-2(Generative Pre-trained Transformer 2) 모델을 Reddit의 대화형 데이터셋으로 미세 조정(Fine-tuning)하여 인간과 유사한 다회차 대화(Multi-turn Conversation)…
LBPH (Local Binary Patterns Histograms) 1. 개요 LBPH(Local Binary Patterns Histograms)는 이미지의 국소적인 텍스처(Texture, 질감) 특징을 추출하여 얼굴을 인식하는 컴퓨터 비전 알고리즘으로, LBP 연산자를 통해 얻은 텍스처 정보를 히스토그램 형태로 변환하여 비교하는 방식이다. 이 알고리…
UMAP (Uniform Manifold Approximation and Projection) 1. 개요 UMAP(Uniform Manifold Approximation and Projection)은 위상수학적 구조를 기반으로 하는 비선형 차원 축소(Dimension Reduction) 알고리즘으로, 고차원 데이터를 저차원(주로 2차원 또는 3차원)으로 투…
인공지능의 편향과 차별 (AI Bias and Discrimination) 1. 개요 인공지능의 편향과 차별이란 AI 모델이 학습 데이터의 불균형이나 알고리즘의 설계 결함으로 인해 특정 보호 집단(Protected Group, 인종, 성별, 연령, 종교 등)에 대해 체계적으로 불리하거나 왜곡된 결과를 출력하는 현상을 의미한다. 현대 사회에서 AI는 채용, …
목표 기반 인코딩 목표 기반 인코딩(Target-based Encoding)은 범주형 변수(Categorical Variable)를 수치형 변수로 변환 데이터 인코딩법 중 하나로, 특히 지도 학습(Supervised Learning)에서 목표 변수(Target Variable)와의 관계를 활용하여 인코딩을하는 방법입니다. 이 방은 단순한 레이블 인코딩(La…
HOG (Histogram of Oriented Gradients) 1. 개요 HOG(Histogram of Oriented Gradients)는 이미지 내 객체의 형태와 구조를 포착하기 위해 국소적인 기울기(Gradient) 방향의 분포를 특징 벡터로 추출하는 컴퓨터 비전 알고리즘이다. 이 기술의 핵심은 이미지의 픽셀 강도 변화(기울기)가 객체의 외곽선(…
선호도 학습 (Preference Learning) 1. 개요 선호도 학습(Preference Learning)이란 개별 항목에 대한 절대적인 수치(Score)를 예측하는 대신, 두 개 이상의 항목 간의 상대적인 우선순위나 선호 관계를 학습하는 머신러닝의 한 분야이다. 일반적인 회귀(Regression) 모델이 "이 항목의 점수는 85점이다"라는 절대값을 …
평가 가이드라인 1. 개요 평가 가이드라인이란 평가 지표의 정의, 평가자가 준수해야 할 판정 기준, 그리고 데이터 수집 및 검증 절차를 체계화한 문서이다. 인공지능(AI) 모델과 같은 복잡한 시스템은 출력값이 가변적이기 때문에, 평가자의 주관에 따라 결과가 달라질 위험이 크다. 따라서 명확한 가이드라인을 통해 평가 간의 일관성(Consistency)을 확보…
NexStorage SDS (소프트웨어 정의 스토리지 솔루션) 1. 개요 NexStorage SDS는 하드웨어 종속성을 제거하고 소프트웨어 계층에서 스토리지 자원을 관리 및 제어하는 엔터프라이즈급 소프트웨어 정의 스토리지([[소프트웨어 정의 스토리지|Software-Defined Storage]], SDS) 솔루션입니다. 본 솔루션은 기존의 전용 스토리지 …
빅데이터 분석 (Big Data Analytics) 1. 개요 빅데이터 분석이란 기존의 데이터베이스 관리 도구로는 수집, 저장, 관리, 분석하기 어려울 정도로 거대한 규모와 복잡성을 가진 데이터 집합(Big Data)으로부터 유의미한 패턴, 상관관계, 추세 및 통찰력을 추출하는 고도의 분석 프로세스를 의미한다. 전통적인 데이터 분석이 정형 데이터(Struc…
질문 응답 시스템 개요 질문 응답 시스템(Question Answering, QA)은 사용자가 자연어로 제시한 질문에 대해 정확하고 간결한 답변을 자동으로 생성하는 기술이다. 전통적인 정보 검색(IR) 시스템이 “문서 목록”을 반환한다면, QA 시스템은 “답변 자체”를 제공한다는 점에서 차별화된다. 최근 딥러닝, 특히 대규모 사전학습 언어 모델(Pre‑tr…
OECD AI Principles (OECD 인공지능 원칙) 1. 개요 OECD AI Principles는 경제협력개발기구(OECD)가 2019년 5월에 채택한 인공지능(AI) 개발 및 활용에 관한 국제적인 가이드라인입니다. 이 원칙은 AI가 인간의 권리를 존중하고, 민주적 가치를 수호하며, 지속 가능한 성장을 촉진하는 방향으로 발전하도록 하기 위해 설계되…