EN DIRECT
Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Hugging Face reproduit en open source une IA qui peint des aquarelles en code03/09/26 · Hugging Face|Un modèle de 350M de paramètres amélioré en 100 étapes de GRPO pour mieux structurer ses sorties03/09/26|Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Hcompany lance NeoMME, un encodeur multimodal natif compact pour la recherche documentaire03/09/26 · Hcompany|Playco réduit de 50 % ses corrections manuelles grâce à GPT-6 Astra03/09/26 · OpenAI|Legora analyse 41 documents financiers en quelques minutes avec GPT-6 Astra03/09/26 · OpenAI|Hugging Face reproduit en open source une IA qui peint des aquarelles en code03/09/26 · Hugging Face|Un modèle de 350M de paramètres amélioré en 100 étapes de GRPO pour mieux structurer ses sorties03/09/26|
🇫🇷 France edgeSortie octobre 2024

Ministral 8B

Mistral AI
Open-sourceSelf-hostRGPD
Verdict

Une option solide pour l'auto-hébergement et le contrôle total des données.

Profil de compétences

Arena Elo1237

Non communiqué

Forces

  • Open-source et auto-hébergeable

Limites

  • Tarification API non publiée

À qui ça s'adresse

Pour vous si…
  • vous voulez maîtriser vos coûts ou auto-héberger
  • vous avez des contraintes RGPD
À éviter si…

    Accès & disponibilité

    Auto-hébergeable (poids ouverts)

    Caractéristiques clés

    Contexte
    128K
    Prix entrée
    Prix sortie
    Vitesse
    Prix non auditéBenchmarks non audités

    Confidentialité

    Conforme RGPD

    Faire tourner en local

    Tourne sur un laptop235k586
    QuantizationDisqueRAM / VRAMMatériel type
    Q4 · recommandé4.6 Go7 GoPC 16 Go / Mac M1+ / GPU 8 Go
    Q8 · équilibré8.6 Go11 GoPC 32 Go / Mac 24 Go / RTX 4070 Ti+
    FP16 · qualité max16 Go20 GoMac 32 Go / RTX 3090-4090

    Estimations pour un contexte modéré. Un long contexte augmente la RAM nécessaire (KV cache).

    Données avancées · pour experts
    Architecture, modalités, coût détaillé, benchmarks complets
    Architecture
    Taille
    8.02B
    Date de coupe
    Entrées
    text
    Sorties
    text
    Licence
    mistral-research
    Hébergement
    Score d'hallucination
    Coût estimé (API)
    Échange type (~3k entrée / 1k sortie)
    Non communiqué
    1M entrée + 1M sortie
    Non communiqué
    Tous les benchmarks
    Arena Elo1237
    MMLU
    GPQA
    HumanEval
    SWE-Bench
    MATH

    Modèles similaires