검색 결과

"텍스트 마이닝"에 대한 검색 결과 (총 23개)

카테고리:

PoS

기술 > 데이터과학 > 분석 | 익명 | 2025-07-14 | 조회수 114

# PoS (Part-of-Speech Tagging) ## 개요 PoS(Part-of-Speech) 태깅은 자연어 처리(NLP) 분야에서 문장 내 단어의 문법적 역할을 식별하는 기술로, 텍스트 데이터를 구조화하여 분석에 활용합니다. 이는 언어학과 컴퓨터 과학의 교차점에서 발전한 기법으로, 데이터 과학에서 텍스트 마이닝, 정보 검색, 기계 번역 등 다양한...

#Part-of-Speech Tagging #Natural Language Processing #Text Mining #Rule-Based Methods #Statistical Models #Neural Networks #BERT #Information Retrieval #Sentiment Analysis #Penn Treebank

K-평균

기술 > 데이터과학 > 분석 | 익명 | 2025-07-12 | 조회수 105

# K-평균 ## 개요 K-평균(K-Means)은 데이터를 **군집화(Clustering)**하는 대표적인 비지도학습(unsupervised learning) 알고리즘입니다. 주어진 데이터 포인트를 사전에 정의된 **K개의 군집**으로 분류하여, 각 군집 내 데이터 간 유사도를 최대화하고, 다른 군집과의 차이를 최소화하는 방식으로 작동합니다. 이 ...

#K-Means #Clustering #Unsupervised Learning #Centroids #Euclidean Distance #Scikit-learn #Data Science #Customer Segmentation #Image Compression

계층적 분류

기술 > 데이터과학 > 분석 | 익명 | 2025-07-11 | 조회수 100

# 계층적 분류 (Hierarchical Clustering) ## 개요/소개 계층적 분류(Hierarchical Clustering)는 데이터 포인트 간의 유사도를 기반으로 계층 구조를 형성하여 클러스터를 생성하는 비단순 군집화 방법이다. 이 기법은 **계층적 구조**(Dendrogram)로 시각화되며, 데이터의 자연적인 계층 구조를 탐지하는 데 유용하...

#Hierarchical Clustering #Agglomerative #Divisive #Dendrogram #Ward's Method #Euclidean Distance #Cosine Similarity #Scikit-learn #R hclust #Weka

처음 이전 1 2