EN DIRECT
Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Hugging Face reproduit en open source une IA qui peint des aquarelles en code03/09/26 · Hugging Face|Un modèle de 350M de paramètres amélioré en 100 étapes de GRPO pour mieux structurer ses sorties03/09/26|Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Hugging Face reproduit en open source une IA qui peint des aquarelles en code03/09/26 · Hugging Face|Un modèle de 350M de paramètres amélioré en 100 étapes de GRPO pour mieux structurer ses sorties03/09/26|
24 Go

Meilleur LLM local pour 24 Go de VRAM

Les modèles à poids ouverts qui tiennent sur une RTX 3090/4090 ou une carte 24 Go en quantification Q4, classés par Elo LMArena. C'est le palier où un poste de travail fait tourner un modèle réellement utile en analyse documentaire, code et RAG, sans envoyer une donnée dehors.

#ModèleElo ArenaRAM (Q4)HébergementLicence
1🇺🇸Gemma 4 31B
Google
145121 GoAuto-hébergeableapache-2.0
2🇺🇸Gemma 4 26B-A4B
Google
143818 GoAuto-hébergeableapache-2.0
3🇺🇸Gemma 3 27B
Google
136519 GoAuto-hébergeablegemma
4🇨🇳Qwen3 32B
Alibaba
134723 GoAuto-hébergeableapache-2.0
5🇺🇸Gemma 3 12B
Google
13429 GoAuto-hébergeablegemma
6🇨🇳QwQ 32B
Alibaba
133623 GoAuto-hébergeableapache-2.0
7🇺🇸gpt-oss-20b
OpenAI
131715 GoAuto-hébergeableapache-2.0
8🇺🇸Gemma 3n E4B
Google
13177 GoAuto-hébergeablegemma
9🇺🇸Nemotron 3 Nano 30B-A3B
NVIDIA
131421 GoAuto-hébergeablenvidia-open-model
10🇺🇸Granite 4.1 8B
IBM
13067 GoAuto-hébergeableapache-2.0
Données vérifiées le 4 septembre 2026Ouvrir dans le comparateur

Méthode

Classement déterministe sur les données du comparateur : Elo LMArena (style control) en premier critère, téléchargements HuggingFace en second pour les modèles sans Elo. Les prix et licences sont vérifiés à la source officielle et datés. Aucun modèle n'est classé par un LLM.

Autres guides