EN DIRECT
Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out03/09/26 · Anthropic|OpenAI's GPT-6 Astra on ARC-AGI-303/09/26 · OpenAI|GPT-6 Astra03/09/26 · OpenAI|OpenAI begins rolling out GPT-6 Astra03/09/26 · OpenAI|ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize03/09/26 · Anthropic|Sparks Fly: NVIDIA Accelerates Local AI at IFA 202603/09/26 · NVIDIA|Introducing WeatherNext 3, our most advanced and accurate global weather AI model03/09/26 · Google|Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly03/09/26 · Anthropic|Claude outage – Resolved03/09/26 · Anthropic|Daybreak for Frontline Defenders: $1B to protect essential services03/09/26 · OpenAI|NeoMME: an efficient Multimodal-native and Multilingual Encoder03/09/26 · Hugging Face|‘NBA 2K27’ With NVIDIA DLSS 5 Leads 28 New Games Coming to GeForce NOW03/09/26 · NVIDIA|Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out03/09/26 · Anthropic|OpenAI's GPT-6 Astra on ARC-AGI-303/09/26 · OpenAI|GPT-6 Astra03/09/26 · OpenAI|OpenAI begins rolling out GPT-6 Astra03/09/26 · OpenAI|ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize03/09/26 · Anthropic|Sparks Fly: NVIDIA Accelerates Local AI at IFA 202603/09/26 · NVIDIA|Introducing WeatherNext 3, our most advanced and accurate global weather AI model03/09/26 · Google|Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly03/09/26 · Anthropic|Claude outage – Resolved03/09/26 · Anthropic|Daybreak for Frontline Defenders: $1B to protect essential services03/09/26 · OpenAI|NeoMME: an efficient Multimodal-native and Multilingual Encoder03/09/26 · Hugging Face|‘NBA 2K27’ With NVIDIA DLSS 5 Leads 28 New Games Coming to GeForce NOW03/09/26 · NVIDIA|
🇺🇸 États-Unis🧠 GénéralisteSortie juillet 2025

Grok 4

xAI
Verdict

Un modèle polyvalent, équilibré sur la plupart des usages.

Présentation

Grok 4 se distingue par son accès en direct au flux de X (Twitter) et ses filtres de sécurité plus légers que la concurrence. Apprécié pour la veille temps réel et les conversations moins corsetées. Sa qualité en français est correcte mais en retrait. À éviter pour les usages enterprise européens (RGPD limité).

Profil de compétences

FrançaisRaisonn.VitesseCréativitéSûreté
Arena Elo1360
Benchmarks vérifiés
GPQA72%
SWE-Bench60%
MATH87.5%
MMLU87%
HumanEval88.5%

Que signifient ces scores ?

GPQA72%très bon

Questions scientifiques de niveau doctorat (physique, chimie, biologie), sans accès à des outils.

SWE-Bench60%solide

Résolution de vrais tickets GitHub en conditions réelles (SWE-bench Verified).

MATH87.5%excellent

Problèmes mathématiques de niveau compétition.

MMLU87%excellent

Connaissances générales réparties sur des dizaines de matières académiques.

HumanEval88.5%excellent

Génération de code Python à partir de spécifications.

Forces

  • Excellent en code
  • Top mondial sur Arena

Limites

  • Vitesse moyenne
  • Pas de garantie RGPD native
  • Filtres de sûreté légers

À qui ça s'adresse

Pour vous si…
  • vous codez avec un agent ou en autonomie
À éviter si…
  • vous manipulez des données sensibles européennes
  • vous avez besoin de réponses très rapides
  • vous voulez des garde-fous stricts

Cas d'usage idéaux

  • Recherche temps réel sur X
  • Conversations sans filtres
  • Analyse réseaux sociaux
  • Humour
  • Veille

Accès & disponibilité

API payante au tokenAbonnement grand public (~30€/mois)

Caractéristiques clés

Contexte
256K
Prix entrée
$5.00 $/M
Prix sortie
$15.00 $/M
Vitesse
60 tok/s
Prix non auditéBenchmarks non audités

Estimez votre coût mensuel

Tarifs API au token
$256/ mois avec Grok 4

Pour le même usage

Estimation indicative sur les tarifs API standard (hors cache, batch et remises volume). Vérifiez toujours la grille officielle avant de vous engager.

Confidentialité

Non conforme RGPDHébergement : US
Données avancées · pour experts
Architecture, modalités, coût détaillé, benchmarks complets
Architecture
MoE
Taille
undisclosed
Date de coupe
mars 2025
Entrées
text, image
Sorties
text, code
Licence
commercial
Hébergement
US
Score d'hallucination
3/5
Coût estimé (API)
Échange type (~3k entrée / 1k sortie)
≈ $0.0300
1M entrée + 1M sortie
≈ $20.00
Tous les benchmarks
Arena Elo1360
MMLU87.0%
GPQA72.0%
HumanEval88.5%
SWE-Bench60.0%
MATH87.5%

Modèles similaires