EN DIRECT
Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out03/09/26 · Anthropic|OpenAI's GPT-6 Astra on ARC-AGI-303/09/26 · OpenAI|GPT-6 Astra03/09/26 · OpenAI|OpenAI begins rolling out GPT-6 Astra03/09/26 · OpenAI|ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize03/09/26 · Anthropic|Sparks Fly: NVIDIA Accelerates Local AI at IFA 202603/09/26 · NVIDIA|Introducing WeatherNext 3, our most advanced and accurate global weather AI model03/09/26 · Google|Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly03/09/26 · Anthropic|Claude outage – Resolved03/09/26 · Anthropic|Daybreak for Frontline Defenders: $1B to protect essential services03/09/26 · OpenAI|NeoMME: an efficient Multimodal-native and Multilingual Encoder03/09/26 · Hugging Face|‘NBA 2K27’ With NVIDIA DLSS 5 Leads 28 New Games Coming to GeForce NOW03/09/26 · NVIDIA|Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out03/09/26 · Anthropic|OpenAI's GPT-6 Astra on ARC-AGI-303/09/26 · OpenAI|GPT-6 Astra03/09/26 · OpenAI|OpenAI begins rolling out GPT-6 Astra03/09/26 · OpenAI|ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize03/09/26 · Anthropic|Sparks Fly: NVIDIA Accelerates Local AI at IFA 202603/09/26 · NVIDIA|Introducing WeatherNext 3, our most advanced and accurate global weather AI model03/09/26 · Google|Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly03/09/26 · Anthropic|Claude outage – Resolved03/09/26 · Anthropic|Daybreak for Frontline Defenders: $1B to protect essential services03/09/26 · OpenAI|NeoMME: an efficient Multimodal-native and Multilingual Encoder03/09/26 · Hugging Face|‘NBA 2K27’ With NVIDIA DLSS 5 Leads 28 New Games Coming to GeForce NOW03/09/26 · NVIDIA|
🇦🇪 Émirats arabes unis🧠 GénéralisteSortie septembre 2023

Falcon 180B

TII
Open-sourceGratuitSelf-host
Verdict

Une option solide pour l'auto-hébergement et le contrôle total des données.

Présentation

Falcon 180B est développé par le Technology Innovation Institute d'Abou Dhabi. Très utilisé dans la région MENA et pour les apps arabophones. Plus ancien que les nouveaux modèles, performances en retrait, mais reste un des piliers open-source historiques.

Profil de compétences

FrançaisRaisonn.VitesseCréativitéSûreté
Arena Elo1147
Benchmarks vérifiés
MMLU70.5%
HumanEval35%

Que signifient ces scores ?

MMLU70.5%très bon

Connaissances générales réparties sur des dizaines de matières académiques.

HumanEval35%correct

Génération de code Python à partir de spécifications.

Forces

  • Dispose d'un tier gratuit
  • Open-source et auto-hébergeable

Limites

  • Vitesse moyenne
  • Pas de garantie RGPD native
  • Filtres de sûreté légers

À qui ça s'adresse

Pour vous si…
  • vous voulez maîtriser vos coûts ou auto-héberger
À éviter si…
  • vous manipulez des données sensibles européennes
  • vous avez besoin de réponses très rapides
  • vous voulez des garde-fous stricts

Cas d'usage idéaux

  • Apps arabophones
  • Souveraineté MENA
  • Recherche académique

Accès & disponibilité

Tier gratuit disponibleAuto-hébergeable (poids ouverts)

Caractéristiques clés

Contexte
4K
Prix entrée
Prix sortie
Vitesse
30 tok/s
Prix non auditéBenchmarks non audités

Confidentialité

Non conforme RGPDHébergement : AE/selfDonnées anonymisables
Données avancées · pour experts
Architecture, modalités, coût détaillé, benchmarks complets
Architecture
Dense
Taille
180B
Date de coupe
mars 2023
Entrées
text
Sorties
text, code
Licence
apache-2
Hébergement
AE/self
Score d'hallucination
2/5
Coût estimé (API)
Échange type (~3k entrée / 1k sortie)
Non communiqué
1M entrée + 1M sortie
Non communiqué
Tous les benchmarks
Arena Elo1147
MMLU70.5%
GPQA
HumanEval35.0%
SWE-Bench
MATH

Modèles similaires