ToolEn hausseéditeur officiel
llama.cpp
Tool : produit autonome, s’utilise directement
Le moteur d'inférence en C/C++ derrière Ollama, LM Studio et la plupart des outils locaux.
Indispensable en coulisses, à utiliser directement seulement si on aime la ligne de commande.
Score global
8.9 /10
Sécu : rien à signaler
Utilité
8.5
Fiabilité
10.0
Sécurité
10.0
Facilité
Technique · Technique
En pratique
- Prix
- Gratuit
- Usage commercial
- Usage commercial : oui
- Disponible sur
- macos, windows, linux, cli
- Licence
- MIT
Sécurité et données
- Pastille
- Sécu : rien à signaler
- Vos données
- Données en local
- Maintenance
- Active
- Dernière release
- 4 septembre 2026
Fiche vérifiée le 13 septembre 2026 · ajoutée le 1 mars 2023
Comment installer llama.cpp
1. macOS : brew install llama.cpp. Linux et Windows : téléchargez un binaire depuis les releases GitHub ou compilez.
2. Récupérez un modèle au format GGUF (Hugging Face, filtre GGUF).
3. Lancez le serveur avec la commande ci-dessous : interface web et API OpenAI sur http://localhost:8080.
llama-server -m modele.gguf --port 8080