LIVE
Study measures how coding agents pick third-party tools03/09/26|OpenAI's GPT-6 Astra sets new state-of-the-art on ARC-AGI-303/09/26 · OpenAI|ESPO: A Prompt Optimization Method That Beats GEPA With Shorter, More Stable Prompts03/09/26|"Last Translation Benchmark": a large-scale collaborative effort for a definitive MT benchmark03/09/26|NVIDIA pushes local AI at IFA 2026 with RTX Spark PCs and a personal inference router03/09/26 · NVIDIA|Google DeepMind unveils WeatherNext 3, its most accurate weather AI model yet03/09/26 · Google DeepMind|OpenAI Launches $1B Daybreak Program for Frontline Cybersecurity Defenders03/09/26 · OpenAI|Hcompany releases NeoMME, a compact multimodal-native encoder for retrieval03/09/26 · Hcompany|Playco cuts manual fixes by 50% using GPT-6 Astra for prototyping03/09/26 · OpenAI|Legora reviews 41 financial documents in minutes with GPT-6 Astra03/09/26 · OpenAI|Hugging Face open-sources a project training a coding model to paint watercolours03/09/26 · Hugging Face|A 350M-Parameter Model Improved in 100 GRPO Steps for Better Structured Outputs03/09/26|Study measures how coding agents pick third-party tools03/09/26|OpenAI's GPT-6 Astra sets new state-of-the-art on ARC-AGI-303/09/26 · OpenAI|ESPO: A Prompt Optimization Method That Beats GEPA With Shorter, More Stable Prompts03/09/26|"Last Translation Benchmark": a large-scale collaborative effort for a definitive MT benchmark03/09/26|NVIDIA pushes local AI at IFA 2026 with RTX Spark PCs and a personal inference router03/09/26 · NVIDIA|Google DeepMind unveils WeatherNext 3, its most accurate weather AI model yet03/09/26 · Google DeepMind|OpenAI Launches $1B Daybreak Program for Frontline Cybersecurity Defenders03/09/26 · OpenAI|Hcompany releases NeoMME, a compact multimodal-native encoder for retrieval03/09/26 · Hcompany|Playco cuts manual fixes by 50% using GPT-6 Astra for prototyping03/09/26 · OpenAI|Legora reviews 41 financial documents in minutes with GPT-6 Astra03/09/26 · OpenAI|Hugging Face open-sources a project training a coding model to paint watercolours03/09/26 · Hugging Face|A 350M-Parameter Model Improved in 100 GRPO Steps for Better Structured Outputs03/09/26|
128k+

Best LLM for enterprise RAG

Models that tick the three boxes of an internal RAG: long context (128k tokens and up), controllable hosting (self-hosted or EU option) and enough capability to synthesise without inventing. Ranked by Elo.

#ModelArena EloContextHostingLicence
1🇺🇸Claude Opus 4.7
Anthropic
1502500KEU optionproprietary
2🇺🇸Gemini 3.7 Flash
Google
14911MEU optionproprietary
3🇺🇸Gemini 3 Pro
Google
14862MEU optionproprietary
4🇺🇸Claude Opus 4.8
Anthropic
14821MEU optionproprietary
5🇺🇸Gemini 3 Flash
Google
14741MEU optionproprietary
6🇺🇸Claude Sonnet 4.6
Anthropic
1472200KEU optionproprietary
7🇨🇳Kimi K2.6
Moonshot AI
1461262KSelf-hostablemodified-mit
8🇨🇳GLM-5
Zhipu AI
1458128KSelf-hostableapache-2.0
9🇺🇸Gemma 4 31B
Google
1451256KSelf-hostableapache-2.0
10🇨🇳Qwen3.5 397B-A17B
Alibaba
1441262KSelf-hostableapache-2.0
Data verified on 4 September 2026Open in the comparator

Method

Deterministic ranking on comparator data: LMArena Elo (style control) first, HuggingFace downloads second for models without an Elo. Prices and licences are verified at the official source and dated. No model is ranked by an LLM.

Other guides