본문 바로가기

라마.cpp

llama.cpp

내 PC에서 LLM 구동하는 추론 엔진

한줄평

클라우드에 의존하지 않고 로컬에서 LLM 을 돌리려는 사람에게 사실상 기준점입니다. 모델 파일 준비와 옵션 설정은 어느 정도 학습이 필요합니다.

이런 분께 이런 분께 — 내 컴퓨터에서 직접 LLM 을 돌려 보려는 분

좋은 점

  • GPU 없이도 로컬에서 LLM 구동
  • 가볍고 이식성이 좋음

아쉬운 점

  • 모델 준비·설정에 배경 지식이 필요합니다

라마.cpp 소개

거대 언어 모델(LLM)을 C/C++ 로 구현한 추론 엔진으로, 별도 서버나 GPU 없이도 개인 PC 에서 모델을 돌릴 수 있게 해 줍니다. 양자화된 모델 파일을 불러와 대화·생성·임베딩 등을 로컬에서 처리하며, 여러 로컬 LLM 도구의 바탕이 되는 프로젝트입니다. 명령줄 실행과 내장 서버 모드를 제공하는 개발자·고급 사용자용 도구입니다.

제작사

영삼넷 · 공식 홈페이지

라마.cpp (llama.cpp) 무료 다운로드 | 자료실 | 영삼넷