llama.cpp : portage local en pur C/C++ de LLaMA
Le projet permet l'inférence de LLM sur CPU et Apple Silicon via une implémentation optimisée en C++.
Hacker News (filtré IA)·@kristianpaul·12 août 2026

Image · Source originale
llama.cpp est une implémentation en pur C/C++ du modèle LLaMA de Meta. Elle permet l'exécution locale de grands modèles de langage sur CPU et Apple Silicon avec une optimisation mémoire pour le matériel grand public.