EN DIRECT
Mistral AI lève 3 milliards d'euros pour ses modèles ouverts de pointe08/09/26 · Mistral AI|Des agents OpenAI détournent un wiki allemand avant le piratage de Hugging Face07/09/26 · OpenAI|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Meta lance Muse Spark 1.3, un modèle taillé pour le codage agentique02/09/26 · Meta|Nemotron post-entraîné bat le meilleur humain aux Olympiades internationales d'informatique02/09/26 · NVIDIA|Google DeepMind lance Fairwind, un programme de cyberdéfense proactive pour gouvernements et entreprises02/09/26 · Google DeepMind|Une étude suggère que les réseaux de neurones encodent des structures symboliques cachées02/09/26|LibreOffice bat des records de téléchargement en promettant l'absence d'IA08/09/26 · LibreOffice|Danijar Hafner lance une startup discrète pour des agents capables d'anticiper l'imprévu08/09/26|OpenAI lance un programme de subventions de 5 millions de dollars sur l'IA et le développement des adolescents08/09/26 · OpenAI|TradingAgents : un framework open source simule une équipe de trading avec des LLM08/09/26|Mistral AI lève 3 milliards d'euros pour ses modèles ouverts de pointe08/09/26 · Mistral AI|Des agents OpenAI détournent un wiki allemand avant le piratage de Hugging Face07/09/26 · OpenAI|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Meta lance Muse Spark 1.3, un modèle taillé pour le codage agentique02/09/26 · Meta|Nemotron post-entraîné bat le meilleur humain aux Olympiades internationales d'informatique02/09/26 · NVIDIA|Google DeepMind lance Fairwind, un programme de cyberdéfense proactive pour gouvernements et entreprises02/09/26 · Google DeepMind|Une étude suggère que les réseaux de neurones encodent des structures symboliques cachées02/09/26|LibreOffice bat des records de téléchargement en promettant l'absence d'IA08/09/26 · LibreOffice|Danijar Hafner lance une startup discrète pour des agents capables d'anticiper l'imprévu08/09/26|OpenAI lance un programme de subventions de 5 millions de dollars sur l'IA et le développement des adolescents08/09/26 · OpenAI|TradingAgents : un framework open source simule une équipe de trading avec des LLM08/09/26|
Recherche

Une étude suggère que les réseaux de neurones encodent des structures symboliques cachées

Des chercheurs montrent que les représentations vectorielles de plusieurs réseaux de neurones, dont des LLM, peuvent être remplacées par des équations symboliques sans altérer leur comportement.

2 septembre 20264 min de lecturePublié parHacker News

Un article publié par R. Thomas McCoy, Paul Soulos, Tal Linzen et Paul Smolensky s'attaque à une question ancienne en sciences cognitives : comment des réseaux de neurones, qui manipulent des vecteurs continus, parviennent-ils à exceller dans des tâches traditionnellement associées au raisonnement symbolique, comme la logique ou le calcul ? Les auteurs proposent une hypothèse simple mais audacieuse : les réseaux construiraient, sans y être explicitement contraints, des représentations internes qui approximent fidèlement des structures symboliques.

Pour tester cette idée, l'équipe a développé une méthode permettant de remplacer entièrement le processus de génération des représentations d'un réseau par une équation fermée qui instancie une structure symbolique. Fait notable, cette substitution laisse le comportement du modèle largement inchangé. Le résultat tient aussi bien pour de petits réseaux entraînés à manipuler des listes que pour des grands modèles de langage testés sur quatre domaines emblématiques de la tradition symbolique : l'arithmétique, la logique, le code informatique et le langage naturel.

Au-delà de la simple approximation, les chercheurs montrent que cette lecture symbolique permet d'intervenir de façon ciblée sur le comportement d'un LLM, en modifiant précisément les structures identifiées dans ses représentations internes. Ces interventions produisent des changements de comportement cohérents avec l'hypothèse selon laquelle le modèle s'appuie effectivement sur ces structures pour opérer, et non simplement sur des corrélations statistiques opaques.

Ce travail s'inscrit dans un effort plus large de recherche en interprétabilité visant à ouvrir la boîte noire des réseaux de neurones. S'il ne prouve pas que les LLM "pensent" symboliquement au sens strict, il fournit un outil méthodologique concret pour relier les traditions symboliques de l'intelligence artificielle, longtemps opposées au connexionnisme, aux systèmes vectoriels qui dominent aujourd'hui le domaine. Les implications pourraient toucher aussi bien la conception de modèles plus contrôlables que la compréhension théorique de ce que ces systèmes apprennent réellement.

Tags
interpretabilitysymbolic-aillmrepresentation-learningcognitive-scienceneuro-symbolic

À lire aussi