EN DIRECT
Les entreprises américaines adoptent de plus en plus l'IA open source04/09/26|Une étude pointe des prix plus élevés dans le mode IA de Google Search04/09/26 · Google|Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Les entreprises américaines adoptent de plus en plus l'IA open source04/09/26|Une étude pointe des prix plus élevés dans le mode IA de Google Search04/09/26 · Google|Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|
🇫🇷 France🧠 GénéralisteSortie décembre 2025

Mistral Large 3

Mistral AI
Open-sourceGratuitSelf-hostRGPD
Verdict

Une option solide pour l'auto-hébergement et le contrôle total des données.

Présentation

Mistral Large 3 est LE modèle de référence pour les usages européens souverains : hébergement en France, conformité RGPD complète, équipe française. Sa qualité en français est excellente (au niveau de Claude). Performances solides sur le code et le raisonnement, légèrement en retrait des frontiers américains les plus chers, mais à un prix bien inférieur.

Profil de compétences

FrançaisRaisonn.VitesseCréativitéSûreté
Arena Elo1414
Benchmarks vérifiés
GPQA64%
SWE-Bench50%
MATH84%
MMLU84.5%
HumanEval88%

Que signifient ces scores ?

GPQA64%solide

Questions scientifiques de niveau doctorat (physique, chimie, biologie), sans accès à des outils.

SWE-Bench50%solide

Résolution de vrais tickets GitHub en conditions réelles (SWE-bench Verified).

MATH84%excellent

Problèmes mathématiques de niveau compétition.

MMLU84.5%excellent

Connaissances générales réparties sur des dizaines de matières académiques.

HumanEval88%excellent

Génération de code Python à partir de spécifications.

Forces

  • Excellent en code
  • Très bonne qualité en français
  • Top mondial sur Arena
  • Dispose d'un tier gratuit

À qui ça s'adresse

Pour vous si…
  • vous voulez maîtriser vos coûts ou auto-héberger
  • vous travaillez en français
  • vous avez des contraintes RGPD
À éviter si…

    Cas d'usage idéaux

    • Apps européennes RGPD-compliant
    • Multilingue européen
    • Apps françaises
    • Enterprise EU

    Accès & disponibilité

    API payante au tokenTier gratuit disponibleAuto-hébergeable (poids ouverts)Abonnement grand public (~15€/mois)

    Caractéristiques clés

    Contexte
    256K
    Prix entrée
    $2.00/M
    Prix sortie
    $6.00/M
    Vitesse
    90 tok/s
    Prix non auditéBenchmarks non audités

    Estimez votre coût mensuel

    Tarifs API au token
    $103/ mois avec Mistral Large 3

    Pour le même usage

    Estimation indicative sur les tarifs API standard (hors cache, batch et remises volume). Vérifiez toujours la grille officielle avant de vous engager.

    Confidentialité

    Conforme RGPDHébergement : EUDonnées anonymisables

    Faire tourner en local

    Serveur GPU dédié2k248
    QuantizationDisqueRAM / VRAMMatériel type
    Q4 · recommandé384.7 Go425 GoInfra GPU serveur (H100/A100…)
    Q8 · équilibré722.2 Go796 GoInfra GPU serveur (H100/A100…)
    FP16 · qualité max1350 Go1487 GoInfra GPU serveur (H100/A100…)

    Estimations pour un contexte modéré. Un long contexte augmente la RAM nécessaire (KV cache).

    Déployer

    Commandes prêtes à copier, générées depuis la fiche. Ajustez le contexte et le nombre de GPU à votre machine.

    Mémoire estimée · FP16 1487 Go · Q4 425 Go2 GPU

    Serveur OpenAI-compatible pour la production sur GPU NVIDIA.

    pip install vllm
    vllm serve mistralai/Mistral-Large-3-675B-Instruct-2512 \
      --max-model-len 32768 \
      --tensor-parallel-size 2 \
      --dtype auto
    mistralai/Mistral-Large-3-675B-Instruct-2512
    Données avancées · pour experts
    Architecture, modalités, coût détaillé, benchmarks complets
    Architecture
    Dense
    Taille
    ~200B
    Date de coupe
    févr. 2025
    Entrées
    text, image
    Sorties
    text, code
    Licence
    apache-2.0
    Hébergement
    EU
    Score d'hallucination
    4/5
    Coût estimé (API)
    Échange type (~3k entrée / 1k sortie)
    ≈ $0.0120
    1M entrée + 1M sortie
    ≈ $8.00
    Tous les benchmarks
    Arena Elo1414
    MMLU84.5%
    GPQA64.0%
    HumanEval88.0%
    SWE-Bench50.0%
    MATH84.0%

    Modèles similaires

    Articles qui en parlent