TECH NOTES
기술노트
현장에서 검증된 개발 지식을 기록합니다.
321
AI
LLM 양자화 — GPTQ·AWQ·GGUF, INT4가 뭘 버리고 뭘 지키나
가중치를 4비트로 줄여도 왜 멀쩡한지, GPTQ·AWQ·GGUF의 차이와 Q4_K_M 같은 이름 읽는 법, 품질과 크기의 스위트스폿까지 정리한 로컬 LLM 양자화 가이드.
AI
LoRA vs QLoRA vs Full Fine-tuning 비교 분석
대규모 언어 모델의 파인튜닝 기법인 LoRA, QLoRA, Full Fine-tuning의 원리와 성능, 비용을 비교하여 최적의 방법을 선택합니다.
AI
AI 파인튜닝 실전 — QLoRA로 저비용 커스텀 모델
AI 파인튜닝 실전 — QLoRA로 저비용 커스텀 모델 — 실무에서 바로 적용할 수 있는 가이드입니다.