BERT 개요 BERT(Bidirectional Encoder Represent from Transformers)는어 처리(NLP)야에서 혁신적인과를 이룬러닝 기반 언어 모델로, 구글(Google) 연구팀이 2018년에 발표한 머신러닝 모델이다. BERT는 이전의 단방향 언어 모델들과 달리 양방향 컨텍스트(Bidirectional Context)를 활용하여…
검색 결과
"구문 분석"에 대한 검색 결과 (총 60개)
언어적 표현 (Linguistic Expression) 1. 개요 핵심 용어: 상징(Symbol): 실제 대상과 직접적인 물리적 연관성은 없으나, 사회적 약속에 의해 특정 의미를 갖게 된 기호. 언어 체계(Language System): 특정 공동체가 사용하는 문법, 어휘, 음운 규칙의 집합. 언어적 표현이란 인간이 자신의 생각, 감정, 의도 등을 특정한 …
피연산자 (Operand) 1. 개요 피연산자(Operand)란 컴퓨터 프로그래밍 및 수학적 연산에서 연산자(Operator)에 의해 처리되는 대상이 되는 값이나 데이터를 의미한다. 연산자가 '무엇을 할 것인가'라는 동작을 정의한다면, 피연산자는 '무엇을 대상으로 할 것인가'라는 데이터를 제공하며, 이 둘의 조합을 통해 하나의 연산식(Expression)이…
중간 코드 생성 개요 중간 코드 생성( Code Generation)은 컴파일러의 핵심 단계 중 하나, 소스 코드 고수준 언어에서 하드웨어에 독립적인 중간 표현(Intermediate Representation,)으로 변환 과정입니다. 이 단계는 컴파일러의 프론트엔드(소스 언어 파싱)와 백엔드(기계어 생성)를 연결하는 다리 역할을 하며, 최적화 및 플랫폼 …
CRF: 조건부 확률 필드 (Conditional Random Field) 개 조건부 확률 필드(Conditional Random Field, 이하 CRF)는 주어진 입력 시퀀스에 기반하여 출력 레이블 시퀀스를 예측하는 확률적 그래프 모델의 일종입니다. 자연어처리(NLP) 분야에서 특히 토큰 수준의 레이블링 작업, 예를 들어 개체명 인식(Named Enti…
빌드 아티팩트 (Build Artifact) 1. 개요 빌드 아티팩트(Build Artifact)란 소프트웨어 빌드 프로세스의 결과물로 생성되는, 배포 가능하거나 실행 가능한 형태의 파일 또는 파일 집합을 의미한다. 소프트웨어 개발 생명주기(SDLC, Software Development Life Cycle)에서 아티팩트는 소스 코드라는 '설계도'가 실제 …
키워드 (Keyword) 키워드(Keyword)는 프로그래밍 언어에서 컴파일러나 인터프리터가 특별한 의미를 가지도록 예약된 특정 문자열을 의미합니다. 일반적으로 식별자(변수명, 함수명, 클래스명 등)로 사용할 수 없으며, 언어의 문법 구조를 정의하거나 특정 연산, 제어 흐름, 데이터 타입 등을 나타내는 데 사용됩니다. 개요 프로그래밍 언어는 인간이 이해하기…
추상 구문 트리 개요 추상 구문 트리(Abstract Syntax Tree, 이하 AST)는 소스 코드의 구조를 계층적이고 추상화된 형태로 표현한 트리 구조입니다. 컴파일러나 인터프리터가 소스 코드를 해석하고 분석하는 과정에서 핵심적인 역할을 하며, 구문 분석(파싱) 단계 이후 생성됩니다. AST는 실제 코드의 구문적 요소(예: 괄호, 세미콜론 등)를 생략…
코퍼스 개요 코퍼스(Corpus)는 자연어(NLP, Natural Language Processing) 분에서 핵심적인 자료로, 특정 목적을 위해 체계적으로 수집·정리된 대규모 텍스트 데이터의 집합을 의미한다.수형은 '코퍼스(corpus)', 복수형은 '코퍼스(corpora)'로 사용된다. 자연어처리 시스템은 언어의 구조, 의미, 사용 패턴을 학습하기 위해…
DSL (도메인 특화 언어) DSL(Domain-Specific Language, 도메인 특화 언어)은 소프트웨어 공학에서 특정 문제 영역(Domain)을 해결하기 위해 설계된 특수 목적의 컴퓨터 언어이다. 1. 개요 DSL은 범용적인 문제를 해결하기 위해 설계된 GPL(General-Purpose Language, 일반 목적 언어)과 대조되는 개념이다. …
드래곤북 (Dragon Book) 《컴파일러: 원리와 실제(Compilers: Principles, Techniques, and Tools)》는 [[컴파일러]] 설계와 구현에 관한 이론적 기초와 실무적 기법을 집대성한 컴퓨터 과학 분야의 세계적인 표준 교과서이다. 1. 개요 정식 명칭은 《Compilers: Principles, Techniques, and…
의미 분석 의미 분석(Semantic Analysis)은파일러가 소스 코드를 해석하는 과정 중 중요한 단계로, 문법적으로 올바른 코드가 실제로 프로그래밍 언어의 의미 체계에 부합하는지를 검사하는 작업입니다. 이 단계는 구문 분석(Syntax Analysis) 이후에 수행되며, 컴파일러가 프로그램의 논리적 구조와 의미를 이해하고 오류를 탐지하며 최적화를 준비…
ROCm (Radeon Open Compute) 개요 ROCm(Radeon Open Compute)은 AMD가 개발한 오픈 소스 GPU 컴퓨팅 플랫폼으로, GPU의 병렬 처리 능력을 활용하여 고성능 연산(HPC) 및 인공지능(AI) 모델의 학습과 추론을 가능하게 하는 소프트웨어 스택입니다. NVIDIA의 폐쇄적인 CUDA(Compute Unified Dev…
지식 그래프 (Knowledge Graph) 1. 개요 지식 그래프(Knowledge Graph)는 실세계의 개체(Entity)들 사이의 관계를 네트워크 형태로 표현하여 컴퓨터가 데이터의 의미와 맥락을 이해할 수 있도록 구축한 지식 베이스입니다. 단순한 데이터베이스가 데이터를 표(Table) 형태의 저장소로 관리하는 것과 달리, 지식 그래프는 데이터 간의 …
조사 (Postposition) 1. 개요 조사란 체언(명사, 대명사, 수사) 뒤에 붙어 그 말이 문장 안에서 가지는 문법적 관계를 나타내거나 특별한 의미를 더해주는 형태소이다. 한국어는 어근에 조사가 결합하여 문법적 기능을 수행하는 교착어(Agglutinative Language)적 특성을 가지며, 조사의 선택에 따라 동일한 단어라도 주어, 목적어, 보어…
파서 생성기 (Parser Generator) 1. 개요 파서 생성기(Parser Generator)란 프로그래밍 언어의 문법을 정의한 명세서를 입력받아, 해당 문법에 맞는 구문 분석기(Parser) 소스 코드를 자동으로 생성해 주는 개발 도구이다. 컴파일러의 전처리 과정은 일반적으로 어휘 분석(Lexical Analysis) 구문 분석(Syntax Ana…
품사 태깅 (Part-of-Speech Tagging) 1. 개요 품사 태깅(Part-of-Speech Tagging, POS Tagging)이란 자연어 처리(NLP) 과정에서 텍스트의 각 단어(또는 형태소)에 대해 문법적 범주인 품사를 할당하는 과정을 말한다. 이는 텍스트 분석의 가장 기초적인 단계 중 하나로, 단어의 표면적인 형태뿐만 아니라 문맥 내에서…
LSP (Language Server Protocol) 개요 LSP(Language Server Protocol)는 코드 편집기(IDE)와 언어 분석 도구(언어 서버) 간의 상호 운용성을 표준화하기 위해 Microsoft가 제안한 프로토콜입니다. 2016년 처음 공개된 이후, LSP는 프로그래밍 언어의 구문 분석, 의미 분석, 자동 완성, 정의 찾기, 리팩…
빌드 라이프사이클 (Build Lifecycle) 개요 빌드 라이프사이클(Build Lifecycle)은 소프트웨어 개발 과정에서 소스 코드를 컴파일, 테스트, 패키징, 배포하기까지의 일련의 자동화된 단계를 의미합니다. 현대의 소프트웨어 공학에서 빌드 라이프사이클은 단순한 코드 컴파일을 넘어, 품질 보증(QA), 의존성 관리, 아티팩트 생성, 그리고 배포 …
시퀀스 라벨링 (Sequence Labeling) 시퀀스 라벨링(Sequence Labeling)은 자연어 처리(NLP) 분야에서 입력된 연속적인 데이터 시퀀스(일반적으로 단어 또는 문자 단위)에 대해 각 요소마다 해당하는 클래스 라벨을 예측하는 지도 학습 문제입니다. 이는 문장의 구조적 이해를 바탕으로 개별 토큰의 의미를 파악하는 데 핵심적인 역할을 하며…