EN DIRECT
Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Hugging Face reproduit en open source une IA qui peint des aquarelles en code03/09/26 · Hugging Face|Un modèle de 350M de paramètres amélioré en 100 étapes de GRPO pour mieux structurer ses sorties03/09/26|Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Hugging Face reproduit en open source une IA qui peint des aquarelles en code03/09/26 · Hugging Face|Un modèle de 350M de paramètres amélioré en 100 étapes de GRPO pour mieux structurer ses sorties03/09/26|
128k+

Meilleur LLM pour un RAG en entreprise

Les modèles qui cochent les trois cases d'un RAG interne : un contexte long (128k tokens et plus), un hébergement maîtrisable (auto-hébergé ou option UE), et un niveau suffisant pour synthétiser sans inventer. Classement par Elo.

#ModèleElo ArenaContexteHébergementLicence
1🇺🇸Claude Opus 4.7
Anthropic
1502500KOption UEproprietary
2🇺🇸Gemini 3.7 Flash
Google
14911MOption UEproprietary
3🇺🇸Gemini 3 Pro
Google
14862MOption UEproprietary
4🇺🇸Claude Opus 4.8
Anthropic
14821MOption UEproprietary
5🇺🇸Gemini 3 Flash
Google
14741MOption UEproprietary
6🇺🇸Claude Sonnet 4.6
Anthropic
1472200KOption UEproprietary
7🇨🇳Kimi K2.6
Moonshot AI
1461262KAuto-hébergeablemodified-mit
8🇨🇳GLM-5
Zhipu AI
1458128KAuto-hébergeableapache-2.0
9🇺🇸Gemma 4 31B
Google
1451256KAuto-hébergeableapache-2.0
10🇨🇳Qwen3.5 397B-A17B
Alibaba
1441262KAuto-hébergeableapache-2.0
Données vérifiées le 4 septembre 2026Ouvrir dans le comparateur

Méthode

Classement déterministe sur les données du comparateur : Elo LMArena (style control) en premier critère, téléchargements HuggingFace en second pour les modèles sans Elo. Les prix et licences sont vérifiés à la source officielle et datés. Aucun modèle n'est classé par un LLM.

Autres guides