EN DIRECT
OpenAI publie un résultat sur Navier-Stokes accompagné d'une preuve formelle en Lean 410/09/26 · OpenAI|OpenAI publie la documentation de son Agents API10/09/26 · OpenAI|OpenAI lance l'Agents API, un service managé pour agents cloud10/09/26 · OpenAI|Anthropic accusée de développer un système de surveillance prédictive visant des militants09/09/26 · Anthropic|OpenAI affirme avoir résolu un problème du prix du millénaire, la controverse enfle09/09/26 · OpenAI|Mistral AI lève 3 milliards d'euros pour ses modèles ouverts de pointe08/09/26 · Mistral AI|Des agents OpenAI détournent un wiki allemand avant le piratage de Hugging Face07/09/26 · OpenAI|Un compilateur GPU accélère jusqu'à 80 fois le calcul de regret contrefactuel10/09/26|Anthropic publie son rapport de septembre 2026 sur les usages malveillants de l'IA10/09/26 · Anthropic|Skild AI utilise la plateforme Physical AI de NVIDIA pour apprendre aux robots de nouvelles tâches à partir d'une seule vidéo10/09/26 · Skild AI|NVIDIA détaille son rôle de fournisseur technologique pour les leaders du robotaxi10/09/26 · NVIDIA|Un chercheur utilise Codex et ChatGPT pour traquer de nouvelles molécules antimicrobiennes10/09/26 · OpenAI|OpenAI publie un résultat sur Navier-Stokes accompagné d'une preuve formelle en Lean 410/09/26 · OpenAI|OpenAI publie la documentation de son Agents API10/09/26 · OpenAI|OpenAI lance l'Agents API, un service managé pour agents cloud10/09/26 · OpenAI|Anthropic accusée de développer un système de surveillance prédictive visant des militants09/09/26 · Anthropic|OpenAI affirme avoir résolu un problème du prix du millénaire, la controverse enfle09/09/26 · OpenAI|Mistral AI lève 3 milliards d'euros pour ses modèles ouverts de pointe08/09/26 · Mistral AI|Des agents OpenAI détournent un wiki allemand avant le piratage de Hugging Face07/09/26 · OpenAI|Un compilateur GPU accélère jusqu'à 80 fois le calcul de regret contrefactuel10/09/26|Anthropic publie son rapport de septembre 2026 sur les usages malveillants de l'IA10/09/26 · Anthropic|Skild AI utilise la plateforme Physical AI de NVIDIA pour apprendre aux robots de nouvelles tâches à partir d'une seule vidéo10/09/26 · Skild AI|NVIDIA détaille son rôle de fournisseur technologique pour les leaders du robotaxi10/09/26 · NVIDIA|Un chercheur utilise Codex et ChatGPT pour traquer de nouvelles molécules antimicrobiennes10/09/26 · OpenAI|
ReleaseCognition

Cognition présente SWE-2, un modèle destiné à l'ingénierie logicielle autonome

Cognition, connue pour son agent de programmation Devin, lance SWE-2, un modèle qu'elle positionne face à des concurrents comme Fable 5.1 et GPT-Astra.

10 septembre 20263 min de lecturePublié parHacker News

Cognition, la startup à l'origine de l'agent de programmation autonome Devin, a annoncé le lancement de SWE-2, sa nouvelle génération de modèle orientée vers les tâches d'ingénierie logicielle. L'entreprise présente ce modèle comme capable de rivaliser avec deux concurrents cités dans son annonce, Fable 5.1 et GPT-Astra, sans toutefois détailler publiquement, à ce stade, les benchmarks précis ou les architectures utilisées pour appuyer cette comparaison.

Depuis ses débuts, Cognition a construit sa réputation autour de l'idée d'un ingénieur logiciel piloté par IA, capable de comprendre un code existant, de planifier des modifications et de les exécuter de façon largement autonome. SWE-2 s'inscrit dans cette continuité, en visant apparemment à améliorer les capacités de raisonnement sur du code complexe, la gestion de tâches longues et la fiabilité des exécutions automatisées, des points qui restent les principaux défis pour ce type de systèmes.

Le marché des modèles spécialisés dans le développement logiciel s'est nettement densifié ces derniers mois, avec plusieurs acteurs cherchant à se positionner sur ce segment jugé stratégique pour l'adoption professionnelle de l'IA générative. La mention de concurrents comme Fable 5.1 et GPT-Astra dans la communication de Cognition illustre cette dynamique de comparaison permanente entre laboratoires, même si l'absence d'informations techniques détaillées rend difficile, pour l'instant, une évaluation indépendante des performances réelles de SWE-2.

En l'absence de données chiffrées ou de publication technique associée à ce lancement, il convient de rester prudent quant à la portée exacte de cette annonce. Elle confirme néanmoins que Cognition continue d'investir dans l'amélioration de ses modèles propriétaires, dans un contexte où la compétition autour des agents de codage s'intensifie rapidement.

Tags
codingai-agentssoftware-engineeringllmbenchmark

À lire aussi