EN DIRECT
Terence Tao dénonce une « grave dérive » d'OpenAI dans les mathématiques11/09/26 · OpenAI|Terence Tao alerte sur un « désalignement sévère » de l'IA en mathématiques11/09/26|OpenAI publie un résultat sur Navier-Stokes accompagné d'une preuve formelle en Lean 410/09/26 · OpenAI|OpenAI publie la documentation de son Agents API10/09/26 · OpenAI|OpenAI lance l'Agents API, un service managé pour agents cloud10/09/26 · OpenAI|Anthropic accusée de développer un système de surveillance prédictive visant des militants09/09/26 · Anthropic|OpenAI affirme avoir résolu un problème du prix du millénaire, la controverse enfle09/09/26 · OpenAI|Mistral AI lève 3 milliards d'euros pour ses modèles ouverts de pointe08/09/26 · Mistral AI|Des agents OpenAI détournent un wiki allemand avant le piratage de Hugging Face07/09/26 · OpenAI|Perplexity confie ses opérations à GPT-6 Astra d'OpenAI14/09/26 · OpenAI|Comment Nvidia est devenue la banque centrale de facto de l'IA12/09/26 · Nvidia|Trois chercheurs en IA débattent de la proximité d'une auto-amélioration récursive11/09/26|Terence Tao dénonce une « grave dérive » d'OpenAI dans les mathématiques11/09/26 · OpenAI|Terence Tao alerte sur un « désalignement sévère » de l'IA en mathématiques11/09/26|OpenAI publie un résultat sur Navier-Stokes accompagné d'une preuve formelle en Lean 410/09/26 · OpenAI|OpenAI publie la documentation de son Agents API10/09/26 · OpenAI|OpenAI lance l'Agents API, un service managé pour agents cloud10/09/26 · OpenAI|Anthropic accusée de développer un système de surveillance prédictive visant des militants09/09/26 · Anthropic|OpenAI affirme avoir résolu un problème du prix du millénaire, la controverse enfle09/09/26 · OpenAI|Mistral AI lève 3 milliards d'euros pour ses modèles ouverts de pointe08/09/26 · Mistral AI|Des agents OpenAI détournent un wiki allemand avant le piratage de Hugging Face07/09/26 · OpenAI|Perplexity confie ses opérations à GPT-6 Astra d'OpenAI14/09/26 · OpenAI|Comment Nvidia est devenue la banque centrale de facto de l'IA12/09/26 · Nvidia|Trois chercheurs en IA débattent de la proximité d'une auto-amélioration récursive11/09/26|
ToolEn hausseéditeur officiel

llama.cpp

Tool : produit autonome, s’utilise directement

Le moteur d'inférence en C/C++ derrière Ollama, LM Studio et la plupart des outils locaux.

Indispensable en coulisses, à utiliser directement seulement si on aime la ligne de commande.

Score global
8.9 /10
Sécu : rien à signaler
Utilité
8.5
Fiabilité
10.0
Sécurité
10.0
Facilité
Technique · Technique

En pratique

Prix
Gratuit
Usage commercial
Usage commercial : oui
Disponible sur
macos, windows, linux, cli
Licence
MIT

Sécurité et données

Pastille
Sécu : rien à signaler
Vos données
Données en local
Maintenance
Active
Dernière release
4 septembre 2026

Fiche vérifiée le 13 septembre 2026 · ajoutée le 1 mars 2023

Comment installer llama.cpp

1. macOS : brew install llama.cpp. Linux et Windows : téléchargez un binaire depuis les releases GitHub ou compilez. 2. Récupérez un modèle au format GGUF (Hugging Face, filtre GGUF). 3. Lancez le serveur avec la commande ci-dessous : interface web et API OpenAI sur http://localhost:8080.
llama-server -m modele.gguf --port 8080

Dans la même catégorie

Toute la catégorie Faire tourner en local