본문 바로가기
🤖

AI 427개 용어

LLM·에이전트·RAG·임베딩·프롬프트 등 AI 시대 필수 용어

Red Teaming (AI)👁 102
AI 시스템의 취약점·잘못된 동작을 의도적으로 탐색하는 적대적 테스트.
Synthetic Training Data👁 102
LLM으로 학습 데이터를 생성하는 기법. 저자원 언어·특수 도메인에 필수.
System Prompt👁 102
모델의 역할·톤·제약을 설정하는 최상위 지시. 대화 전체에 영향.
XML 태그 프롬프트👁 102
Claude가 선호하는 구조화 프롬프트. <document>·<question> 등.
Agent Benchmarks👁 101
SWE-bench·WebArena·GAIA·AgentBench 등 에이전트 평가 표준.
CNN👁 101
Convolutional Neural Network
이미지 처리에 최적화된 신경망. Convolution·Pooling 층으로 공간 특징 추출.
DataLoader👁 101
PyTorch·TensorFlow의 배치 데이터 공급자. 병렬 로딩·셔플·증강.
Giskard👁 101
LLM·ML 모델 테스트·Red Team 오픈소스. 편향·환각·보안 검증.
MCP Inspector👁 101
MCP 서버 개발·디버깅 도구. 공식 웹 기반 inspector.
Modal👁 101
서버리스 Python·AI 클라우드 플랫폼. GPU·큰 모델 배포에 특화.
Repetition Penalty👁 101
반복 토큰에 페널티. 같은 단어·구 반복 방지.
ResNet👁 101
Residual Network
Microsoft가 제안한 잔차 연결(skip connection) 기반 딥 CNN. 2015년 ImageNet 우승.
ROC AUC👁 101
이진 분류 모델의 임계값 독립적 성능 지표. 1.0이 완벽, 0.5가 무작위.
Stable Diffusion👁 101
Stability AI가 오픈소스화한 text-to-image 모델. 로컬 실행 가능, 생태계 방대.
Vertex AI👁 101
Google Cloud의 관리형 AI 플랫폼. Gemini·PaLM·오픈모델 통합.
Voyage AI👁 101
고품질 임베딩·리랭커 특화 업체. Claude/Anthropic 공식 추천.
WebArena👁 101
에이전트가 실제 웹사이트를 탐색·작업 수행하는 벤치마크.
Windsurf👁 101
Codeium의 AI 에디터. Cursor 경쟁. Cascade 자율 에이전트.
CLIP👁 100
Contrastive Language-Image Pre-training
OpenAI의 이미지-텍스트 공동 임베딩 모델. Stable Diffusion의 텍스트 이해 기반.
Cohere👁 100
엔터프라이즈 LLM·임베딩·리랭커 전문 AI 회사. 2019년 캐나다에서 창업.
ElevenLabs👁 100
Voice Cloning·TTS 선두. 초고품질 감정 표현 음성.
MAE👁 100
Mean Absolute Error
예측과 실제 차이의 절댓값 평균. MSE보다 이상치에 견고.
OpenAI Assistants API👁 100
스레드·Retrieval·Code Interpreter 통합 에이전트 API.
Pooling (CNN)👁 100
특징 맵의 공간 크기를 줄이는 연산. Max·Average Pooling.
Reasoning Model👁 100
추론 모델
답변 전에 긴 내부 추론을 거치도록 학습된 LLM. OpenAI o1/o3, Claude Mythos 계열이 대표.
RLAIF👁 100
Reinforcement Learning from AI Feedback
AI가 평가자 역할을 해 사람 라벨을 대체. RLHF의 비용 대안.
Test-Time Compute👁 100
추론 시 더 오래 생각해 성능 향상. Scaling Law의 새 축.
Chunking👁 99
RAG 파이프라인의 첫 단계. 긴 문서를 임베딩·검색에 적합한 단위로 분할.
Constitutional AI👁 99
Anthropic이 제안한 정렬 방법. 사람 대신 AI가 헌법적 원칙으로 자기 출력을 평가·개선.
CoT vs ToT vs GoT👁 99
Chain·Tree·Graph of Thoughts. 추론 확장 기법.
Gemma👁 99
Google DeepMind의 경량 오픈소스 LLM. Gemini 아키텍처 기반, 로컬·엣지 실행 최적화.
GRU👁 99
Gated Recurrent Unit
LSTM을 단순화한 변형. 게이트 수를 줄여 학습 빠르고 성능은 유사.
Image Classification👁 99
이미지에 클래스 레이블을 부여하는 가장 기본적인 CV 작업. ImageNet 벤치마크.
Image Segmentation👁 99
이미지의 각 픽셀을 클래스로 분류하는 CV 작업. 의료·자율주행에 필수.
LangSmith👁 99
LangChain 팀의 LLM 관측·평가 플랫폼. 프로덕션 LLM 디버깅·A/B.
LLM 평가 지표👁 99
BLEU·ROUGE·BERTScore·LLM-Judge·Pass@k.
Plan-and-Execute Agent👁 99
LLM이 먼저 전체 계획을 세우고 단계별 실행. ReAct 대비 효율.
Process Reward Model👁 99
최종 답이 아닌 중간 과정에 보상. Reasoning 모델의 핵심.
Prompt Management👁 99
프롬프트를 코드 밖에서 관리. 버전·A/B·비개발자 편집.
Pydantic AI👁 99
Pydantic 창시자가 만든 Python AI 에이전트 프레임워크. 타입 안전 강조.
SigLIP👁 99
Google의 CLIP 개선판. Sigmoid loss로 효율적 학습.
Temperature 튜닝👁 99
0에 가까우면 결정적, 1 이상은 창의적. 작업별 권장값.
Top-K Sampling👁 99
확률 상위 K개 토큰에서만 샘플링. Top-p(nucleus)와 함께 사용.
AutoGPT👁 98
2023년 화제가 된 자율 에이전트. GPT-4에 목표만 주면 스스로 작업 분해·실행.
BPE👁 98
Byte Pair Encoding
자주 등장하는 문자 쌍을 병합해 서브워드 어휘를 구축하는 토큰화 기법. GPT·Llama가 사용.
Deep Research👁 98
OpenAI·Gemini·Claude의 심층 조사 에이전트 기능.
Grounding👁 98
LLM 응답을 검증 가능한 출처·사실에 연결하는 것. 환각 방지.
HumanEval👁 98
OpenAI의 코드 생성 벤치마크. 164개 Python 함수 완성.
Instruction Tuning👁 98
지시-응답 페어 데이터로 LLM을 파인튜닝. ChatGPT 탄생의 핵심.
kNN👁 98
k-Nearest Neighbors
새 데이터의 가장 가까운 k개 이웃의 라벨로 분류하는 알고리즘.