OpenAI annonce l'arrivée de Paul Christiano au conseil d'administration de sa fondation, ainsi qu'à son comité sécurité et sûreté. Cette nomination place une figure reconnue de la recherche en alignement au sein des instances de gouvernance qui supervisent les décisions les plus sensibles de l'entreprise en matière de déploiement de modèles.
Paul Christiano n'est pas un nouveau venu dans l'écosystème OpenAI. Il y a dirigé l'équipe d'alignement entre 2017 et 2021, contribuant notamment aux travaux fondateurs sur l'apprentissage par renforcement à partir de retours humains (RLHF), une technique devenue centrale dans l'entraînement des grands modèles de langage. Il a ensuite fondé l'Alignment Research Center (ARC), un organisme indépendant consacré à l'évaluation des risques posés par les systèmes d'IA avancés. Plus récemment, il a occupé un poste de responsable de la recherche en sûreté au sein de l'institut américain de sécurité de l'IA, rattaché au NIST, sous l'administration Biden.
Cette nomination intervient dans un contexte où la structure de gouvernance d'OpenAI reste scrutée de près, la fondation ayant conservé un rôle de supervision sur l'entité commerciale de l'entreprise à l'issue de sa restructuration. Le comité sécurité et sûreté, auquel Christiano se joint, a pris une importance croissante depuis les épisodes de tension internes de 2023 autour de la gouvernance et du rythme de déploiement des modèles.
La venue de Christiano peut se lire comme un signal adressé aux observateurs préoccupés par la vitesse de développement de l'IA générative. Sa réputation dans la communauté de la sécurité de l'IA, où il est perçu comme une voix rigoureuse mais indépendante, pourrait renforcer la crédibilité des processus internes d'évaluation des risques d'OpenAI, sans pour autant dissiper entièrement les interrogations sur l'équilibre entre gouvernance non lucrative et pressions commerciales.