EN DIRECT
Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out03/09/26 · Anthropic|OpenAI's GPT-6 Astra on ARC-AGI-303/09/26 · OpenAI|GPT-6 Astra03/09/26 · OpenAI|OpenAI begins rolling out GPT-6 Astra03/09/26 · OpenAI|ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize03/09/26 · Anthropic|Sparks Fly: NVIDIA Accelerates Local AI at IFA 202603/09/26 · NVIDIA|Introducing WeatherNext 3, our most advanced and accurate global weather AI model03/09/26 · Google|Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly03/09/26 · Anthropic|Claude outage – Resolved03/09/26 · Anthropic|Daybreak for Frontline Defenders: $1B to protect essential services03/09/26 · OpenAI|NeoMME: an efficient Multimodal-native and Multilingual Encoder03/09/26 · Hugging Face|‘NBA 2K27’ With NVIDIA DLSS 5 Leads 28 New Games Coming to GeForce NOW03/09/26 · NVIDIA|Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out03/09/26 · Anthropic|OpenAI's GPT-6 Astra on ARC-AGI-303/09/26 · OpenAI|GPT-6 Astra03/09/26 · OpenAI|OpenAI begins rolling out GPT-6 Astra03/09/26 · OpenAI|ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize03/09/26 · Anthropic|Sparks Fly: NVIDIA Accelerates Local AI at IFA 202603/09/26 · NVIDIA|Introducing WeatherNext 3, our most advanced and accurate global weather AI model03/09/26 · Google|Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly03/09/26 · Anthropic|Claude outage – Resolved03/09/26 · Anthropic|Daybreak for Frontline Defenders: $1B to protect essential services03/09/26 · OpenAI|NeoMME: an efficient Multimodal-native and Multilingual Encoder03/09/26 · Hugging Face|‘NBA 2K27’ With NVIDIA DLSS 5 Leads 28 New Games Coming to GeForce NOW03/09/26 · NVIDIA|
🇺🇸 États-Unis🧠 GénéralisteSortie août 2025

GPT-5

OpenAI
GratuitRGPD
Verdict

Un bon compromis performance / conformité pour une entreprise européenne.

Présentation

GPT-5 unifie les capacités de raisonnement de la série o avec la polyvalence de GPT-4o. Il gère nativement texte, image, audio et code. C'est le modèle le plus utilisé au monde grand public via ChatGPT. Sa qualité en français est très bonne mais légèrement en retrait par rapport à Claude.

Profil de compétences

FrançaisRaisonn.VitesseCréativitéSûreté
Arena Elo1434
Benchmarks vérifiés
GPQA73.2%
SWE-Bench68.5%
MATH91.4%
MMLU90.8%
HumanEval92%

Que signifient ces scores ?

GPQA73.2%très bon

Questions scientifiques de niveau doctorat (physique, chimie, biologie), sans accès à des outils.

SWE-Bench68.5%très bon

Résolution de vrais tickets GitHub en conditions réelles (SWE-bench Verified).

MATH91.4%élite mondiale

Problèmes mathématiques de niveau compétition.

MMLU90.8%élite mondiale

Connaissances générales réparties sur des dizaines de matières académiques.

HumanEval92%élite mondiale

Génération de code Python à partir de spécifications.

Forces

  • Raisonnement de premier plan
  • Excellent en code
  • Très bonne qualité en français
  • Top mondial sur Arena

À qui ça s'adresse

Pour vous si…
  • vous avez besoin de raisonnement ou d'analyse poussés
  • vous codez avec un agent ou en autonomie
  • vous travaillez en français
  • vous avez des contraintes RGPD
À éviter si…

    Cas d'usage idéaux

    • Assistant polyvalent
    • Multimodal (image+texte+voix)
    • Recherche
    • Code
    • Apps grand public

    Accès & disponibilité

    API payante au tokenTier gratuit disponibleAbonnement grand public (~20€/mois)

    Caractéristiques clés

    Contexte
    400K
    Prix entrée
    $1.25 $/M
    Prix sortie
    $10.00 $/M
    Vitesse
    90 tok/s
    Prix non auditéBenchmarks non audités

    Estimez votre coût mensuel

    Tarifs API au token
    $108/ mois avec GPT-5

    Pour le même usage

    Estimation indicative sur les tarifs API standard (hors cache, batch et remises volume). Vérifiez toujours la grille officielle avant de vous engager.

    Confidentialité

    Conforme RGPDHébergement : US/EUDonnées anonymisables
    Données avancées · pour experts
    Architecture, modalités, coût détaillé, benchmarks complets
    Architecture
    MoE
    Taille
    undisclosed
    Date de coupe
    févr. 2025
    Entrées
    text, image, audio, document
    Sorties
    text, code
    Licence
    commercial
    Hébergement
    US/EU
    Score d'hallucination
    4/5
    Coût estimé (API)
    Échange type (~3k entrée / 1k sortie)
    ≈ $0.0138
    1M entrée + 1M sortie
    ≈ $11.25
    Tous les benchmarks
    Arena Elo1434
    MMLU90.8%
    GPQA73.2%
    HumanEval92.0%
    SWE-Bench68.5%
    MATH91.4%

    Modèles similaires