llama.cpp 공식 홈페이지, llama.app에서 로컬 코딩 에이전트와 통합

llama.cpp의 공식 홈페이지인 llama.app이 공개되었습니다. llama serve 명령어로 모델을 서빙하고, pi-llama 플러그인을 설치하면 Pi 코딩 에이전트가 자동으로 로컬 모델을 발견합니다. 설정이나 API 키가 필요 없으며, 파일과 요청이 모두 로컬에 머무릅니다. 또한 llama.cpp는 노트북부터 클러스터까지 모든 하드웨어에서 최적화되어 동작하며, Apple Silicon, RTX 5090, H100 등 다양한 GPU와 CPU를 지원합니다.
파일은 사용자의 머신에 머무르고, 요청은 절대 외부로 나가지 않습니다.