초기화

최장 공통 부분 수열

익명 • 2026-08-01 • 조회수 28

최장 공통 부분 수열 개요 최장통 부분 수열(Longest Subsequence, 이하 LCS)은 개 이상의 문자열(또는 수열)에서 동시에 나타나는 부분 수열(subsequence) 중 가장 긴 것을 찾는 문제입니다. 이 알고리즘은 자연어처리(NLP), 생물정보학, 버…

BPE

익명 • 2026-07-31 • 조회수 86

BPE (Byte Pair Encoding) 1. 개요 BPE(Byte Pair Encoding)는 자연어 처리(NLP)에서 텍스트를 효율적으로 분절하기 위해 사용되는 서브워드(Subword) 토큰화 알고리즘으로, 빈도 기반의 문자 쌍 병합을 통해 단어와 문자 단위의 …

맞춤법 교정

익명 • 2026-07-29 • 조회수 64

맞춤법 교정 맞춤법 교정(Orthographic Correction)은 자연어 처리(Natural Language Processing, NLP) 분야에서 사용자의 텍스트에 포함된 맞춤법 오류를 자동으로 탐지하고 수정하는 기술을 의미합니다. 한국어 같이 높은 형태소 복잡…

LLM

익명 • 2026-07-28 • 조회수 118

LLM (거대 언어 모델) 1. 개요 LLM(Large Language Model, 거대 언어 모델)은 방대한 양의 텍스트 데이터를 학습하여 인간과 유사한 자연어를 이해하고 생성할 수 있도록 설계된 인공신경망 기반의 딥러닝 모델이다. 여기서 '거대(Large)'함은 크…

코퍼스

익명 • 2026-07-26 • 조회수 72

코퍼스 개요 코퍼스(Corpus)는 자연어(NLP, Natural Language Processing) 분에서 핵심적인 자료로, 특정 목적을 위해 체계적으로 수집·정리된 대규모 텍스트 데이터의 집합을 의미한다.수형은 '코퍼스(corpus)', 복수형은 '코퍼스(corp…

음소

익명 • 2026-07-20 • 조회수 31

음소 (Phoneme) 음소란 말소리를 구별하는 최소한의 단위입니다. 즉, 하나의 소리가 바뀌었을 때 단어의 뜻이 달라지게 만드는 가장 작은 소리의 단위를 의미합니다. 정의 및 특징 음소는 실제로 발음되는 구체적인 소리(음성)가 아니라, 화자의 머릿속에 추상적으로 존재…

소프트맥스

익명 • 2026-07-20 • 조회수 94

소프트맥스 (Softmax) 소프트맥스(Softmax) 함수는 입력받은 벡터의 각 요소를 0과 1 사이의 값으로 변환하며, 출력된 모든 값의 총합이 1이 되도록 만드는 함수입니다. 주로 딥러닝의 다중 분류(Multi-class Classification) 모델에서 출력…