EN DIRECT
Des documents judiciaires révèlent des propos internes accablants sur le scraping de contenu par l'IA19/09/26|L'armée américaine évite de justesse un incident après un rapport de renseignement halluciné par une IA18/09/26|Une étude révèle que les biais de genre des GPT ne disparaissent pas, ils se transforment17/09/26 · OpenAI|Des modifications d'architecture permettraient de casser les lois d'échelle classiques16/09/26|OpenAI publie un cadre pour signaler les cas de désalignement de ses modèles16/09/26 · OpenAI|NVIDIA dévoile les premiers résultats MLPerf de sa plateforme Vera Rubin NVL7216/09/26 · NVIDIA|OpenAI élargit la publicité dans ChatGPT avec des « Sponsored Agents »16/09/26 · OpenAI|OpenAI se lance dans la publicité avec des « Sponsored Agents »16/09/26 · OpenAI|Google DeepMind lance Gemini 3.8 Live et sa variante à raisonnement étendu15/09/26 · Google DeepMind|L'investissement massif dans les infrastructures IA fait-il courir un risque de bulle ?15/09/26|Une faille dans la surveillance du raisonnement des modèles de langage14/09/26|Stellar Colosseum : un système multi-agents pour la recherche mathématique de long terme14/09/26|Des documents judiciaires révèlent des propos internes accablants sur le scraping de contenu par l'IA19/09/26|L'armée américaine évite de justesse un incident après un rapport de renseignement halluciné par une IA18/09/26|Une étude révèle que les biais de genre des GPT ne disparaissent pas, ils se transforment17/09/26 · OpenAI|Des modifications d'architecture permettraient de casser les lois d'échelle classiques16/09/26|OpenAI publie un cadre pour signaler les cas de désalignement de ses modèles16/09/26 · OpenAI|NVIDIA dévoile les premiers résultats MLPerf de sa plateforme Vera Rubin NVL7216/09/26 · NVIDIA|OpenAI élargit la publicité dans ChatGPT avec des « Sponsored Agents »16/09/26 · OpenAI|OpenAI se lance dans la publicité avec des « Sponsored Agents »16/09/26 · OpenAI|Google DeepMind lance Gemini 3.8 Live et sa variante à raisonnement étendu15/09/26 · Google DeepMind|L'investissement massif dans les infrastructures IA fait-il courir un risque de bulle ?15/09/26|Une faille dans la surveillance du raisonnement des modèles de langage14/09/26|Stellar Colosseum : un système multi-agents pour la recherche mathématique de long terme14/09/26|
Régulation

Des documents judiciaires révèlent des propos internes accablants sur le scraping de contenu par l'IA

Des mémoires déposés dans le procès du New York Times contre Microsoft et OpenAI citent un cadre de Microsoft qualifiant le scraping de données d'IA de plus grand vol de travail de l'histoire, tandis qu'un responsable d'OpenAI aurait décrit ChatGPT comme une menace existentielle pour les éditeurs.

19 septembre 20263 min de lecturePublié parHacker News

Des extraits de communications internes, rendus publics dans le cadre du procès intenté par le New York Times contre Microsoft et OpenAI, apportent un nouvel éclairage sur la manière dont les deux entreprises percevaient en interne les risques liés à l'entraînement de leurs modèles sur du contenu protégé. Selon des mémoires juridiques cités par Tom's Hardware, un directeur de Microsoft aurait qualifié le pillage de données destiné à l'entraînement des IA de plus grand vol de travail de l'histoire humaine, une formulation frappante venant d'un cadre de l'entreprise elle-même poursuivie.

Du côté d'OpenAI, un responsable aurait de son côté reconnu que ChatGPT représentait une menace existentielle pour les éditeurs de presse, une admission qui pourrait peser lourd dans l'appréciation du préjudice allégué par le New York Times. Le journal accuse les deux sociétés d'avoir utilisé des millions de ses articles sans autorisation ni compensation pour entraîner des modèles de langage, et de permettre à ces derniers de reproduire ou de résumer son contenu de façon à concurrencer directement son activité éditoriale.

Ces révélations interviennent alors que plusieurs procédures similaires sont en cours aux États-Unis, opposant éditeurs, auteurs et artistes aux principaux développeurs de modèles d'IA générative. La question centrale reste de déterminer si l'entraînement sur des contenus protégés par le droit d'auteur relève du usage loyal (fair use) ou constitue une contrefaçon caractérisée, un point que les tribunaux américains n'ont pas encore tranché de manière uniforme.

Si ces citations internes sont confirmées et jugées recevables, elles pourraient renforcer la position du New York Times en démontrant que les dirigeants des entreprises visées avaient conscience des risques et des préjudices potentiels avant même le déploiement de leurs produits. L'affaire, suivie de près par l'ensemble de l'industrie des médias, pourrait ainsi devenir un précédent déterminant pour l'ensemble du secteur de l'IA générative.

Tags
copyrightlawsuitopenaimicrosoftjournalismtraining-data

À lire aussi