EN DIRECT
Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Hugging Face reproduit en open source une IA qui peint des aquarelles en code03/09/26 · Hugging Face|Un modèle de 350M de paramètres amélioré en 100 étapes de GRPO pour mieux structurer ses sorties03/09/26|Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Hugging Face reproduit en open source une IA qui peint des aquarelles en code03/09/26 · Hugging Face|Un modèle de 350M de paramètres amélioré en 100 étapes de GRPO pour mieux structurer ses sorties03/09/26|
≤ 2 $

Meilleurs LLM par API à moins de 2 $ le million de tokens

Les modèles accessibles par API dont le prix de sortie ne dépasse pas 2 $ par million de tokens, classés par Elo. Le rapport qualité/prix réel pour un pipeline à fort volume — classification, extraction, résumé — où le prix par token compte plus que le dernier point de benchmark.

#ModèleElo ArenaSortie / M tokensHébergementLicence
1🇨🇳GLM-5
Zhipu AI
1458$2.00/MAuto-hébergeableapache-2.0
2🇨🇳Qwen3.7 Plus
Alibaba
1455$1.60/MAPIproprietary
3🇨🇳DeepSeek V3.2
DeepSeek
1425$0.42/MAuto-hébergeablemit
4🇨🇳DeepSeek V3
DeepSeek
1396$1.10/MAuto-hébergeablemit
5🇺🇸GPT-5 mini
OpenAI
1389$2.00/MOption UEproprietary
6🇨🇳Yi-Lightning
01.AI
1328$0.14/MAPIproprietary
7🇺🇸Llama 4 Scout
Meta
1321$1.20/MAuto-hébergeablellama-4-community
8🇨🇳DeepSeek Coder V3
DeepSeek
1280$0.28/MAuto-hébergeablemit
9🇫🇷Codestral
Mistral AI
1240$0.90/MAuto-hébergeablemistral-non-commercial
10🇫🇷Mistral Small 3
Mistral AI
1235$0.60/MAuto-hébergeableapache-2.0
Données vérifiées le 4 septembre 2026Ouvrir dans le comparateur

Méthode

Classement déterministe sur les données du comparateur : Elo LMArena (style control) en premier critère, téléchargements HuggingFace en second pour les modèles sans Elo. Les prix et licences sont vérifiés à la source officielle et datés. Aucun modèle n'est classé par un LLM.

Autres guides