EN DIRECT
Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out03/09/26 · Anthropic|OpenAI's GPT-6 Astra on ARC-AGI-303/09/26 · OpenAI|GPT-6 Astra03/09/26 · OpenAI|OpenAI begins rolling out GPT-6 Astra03/09/26 · OpenAI|ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize03/09/26 · Anthropic|Sparks Fly: NVIDIA Accelerates Local AI at IFA 202603/09/26 · NVIDIA|Introducing WeatherNext 3, our most advanced and accurate global weather AI model03/09/26 · Google|Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly03/09/26 · Anthropic|Claude outage – Resolved03/09/26 · Anthropic|Daybreak for Frontline Defenders: $1B to protect essential services03/09/26 · OpenAI|NeoMME: an efficient Multimodal-native and Multilingual Encoder03/09/26 · Hugging Face|‘NBA 2K27’ With NVIDIA DLSS 5 Leads 28 New Games Coming to GeForce NOW03/09/26 · NVIDIA|Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out03/09/26 · Anthropic|OpenAI's GPT-6 Astra on ARC-AGI-303/09/26 · OpenAI|GPT-6 Astra03/09/26 · OpenAI|OpenAI begins rolling out GPT-6 Astra03/09/26 · OpenAI|ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize03/09/26 · Anthropic|Sparks Fly: NVIDIA Accelerates Local AI at IFA 202603/09/26 · NVIDIA|Introducing WeatherNext 3, our most advanced and accurate global weather AI model03/09/26 · Google|Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly03/09/26 · Anthropic|Claude outage – Resolved03/09/26 · Anthropic|Daybreak for Frontline Defenders: $1B to protect essential services03/09/26 · OpenAI|NeoMME: an efficient Multimodal-native and Multilingual Encoder03/09/26 · Hugging Face|‘NBA 2K27’ With NVIDIA DLSS 5 Leads 28 New Games Coming to GeForce NOW03/09/26 · NVIDIA|
🇨🇳 Chine🔬 RaisonnementSortie mai 2025

DeepSeek R2

DeepSeek
Open-sourceGratuitSelf-host
Verdict

Une option solide pour l'auto-hébergement et le contrôle total des données.

Présentation

DeepSeek R2 applique la technique du chain-of-thought renforcé par RL (comme o3) sur le modèle V3. Résultat : des performances en raisonnement proches d'o3, mais open-source et 20x moins cher. C'est la révolution de 2025 pour l'IA scientifique. Lent comme o3 (réfléchit avant de répondre).

Profil de compétences

FrançaisRaisonn.VitesseCréativitéSûreté
Arena Elo1370
Benchmarks vérifiés
GPQA75.8%
SWE-Bench49.2%
MATH95.1%
MMLU89%
HumanEval92.5%

Que signifient ces scores ?

GPQA75.8%très bon

Questions scientifiques de niveau doctorat (physique, chimie, biologie), sans accès à des outils.

SWE-Bench49.2%correct

Résolution de vrais tickets GitHub en conditions réelles (SWE-bench Verified).

MATH95.1%élite mondiale

Problèmes mathématiques de niveau compétition.

MMLU89%excellent

Connaissances générales réparties sur des dizaines de matières académiques.

HumanEval92.5%élite mondiale

Génération de code Python à partir de spécifications.

Forces

  • Raisonnement de premier plan
  • Excellent en code
  • Top mondial sur Arena
  • Dispose d'un tier gratuit

Limites

  • Vitesse moyenne
  • Pas de garantie RGPD native

À qui ça s'adresse

Pour vous si…
  • vous avez besoin de raisonnement ou d'analyse poussés
  • vous voulez maîtriser vos coûts ou auto-héberger
À éviter si…
  • vous manipulez des données sensibles européennes
  • vous avez besoin de réponses très rapides

Cas d'usage idéaux

  • Maths avancées à bas coût
  • Recherche scientifique open-source
  • Démonstrations
  • Self-hosting raisonnement

Accès & disponibilité

API payante au tokenTier gratuit disponibleAuto-hébergeable (poids ouverts)

Caractéristiques clés

Contexte
128K
Prix entrée
$0.55 $/M
Prix sortie
$2.19 $/M
Vitesse
25 tok/s
Prix non auditéBenchmarks non audités

Estimez votre coût mensuel

Tarifs API au token
$32/ mois avec DeepSeek R2

Pour le même usage

Estimation indicative sur les tarifs API standard (hors cache, batch et remises volume). Vérifiez toujours la grille officielle avant de vous engager.

Confidentialité

Non conforme RGPDHébergement : CN/selfDonnées anonymisables
Données avancées · pour experts
Architecture, modalités, coût détaillé, benchmarks complets
Architecture
MoE + RL
Taille
685B (37B actifs MoE)
Date de coupe
déc. 2024
Entrées
text
Sorties
text, code
Licence
mit
Hébergement
CN/self
Score d'hallucination
4/5
Coût estimé (API)
Échange type (~3k entrée / 1k sortie)
≈ $0.0038
1M entrée + 1M sortie
≈ $2.74
Tous les benchmarks
Arena Elo1370
MMLU89.0%
GPQA75.8%
HumanEval92.5%
SWE-Bench49.2%
MATH95.1%

Modèles similaires