OpenAI et Microsoft alertent sur un « vol » destructeur pour le web
D'après The Verge (18 septembre 2026 à 23h07)
Résumé
Des documents internes révèlent qu’OpenAI et Microsoft ont qualifié l’entraînement de leurs modèles sur des contenus web de « plus grand vol de travail de l’histoire » et d’« engrenage fatal » pour le web.
Les faits
Des documents judiciaires récemment déclassifiés dans la procédure engagée par le New York Times contre OpenAI et Microsoft mettent en lumière des avertissements très sévères formulés par les deux entreprises elles‑mêmes. Les documents internes évoquent explicitement le déclenchement d’un « doom loop » susceptible de « endommager le web ». Dans ces mêmes éléments, la manière dont OpenAI et Microsoft récupèrent des contenus en ligne pour entraîner leurs modèles d’intelligence artificielle est décrite comme « le plus grand vol de travail de l’histoire de l’humanité ». Cette formule souligne la perception, au sein des entreprises, d’un transfert massif de valeur issue du travail rédactionnel vers les systèmes d’IA. Les documents évoquent également une critique frontale du cadre juridique actuel, en estimant que cette stratégie de collecte de contenus « tourne complètement en dérision l’idée de l’usage loyal ». Cette mention laisse entendre que les pratiques d’entraînement pourraient entrer en tension forte avec les notions classiques de droit d’auteur et d’exception de copie. L’ensemble de ces formulations figure dans la documentation interne citée par la procédure intentée par le New York Times. Elles ne relèvent pas de critiques extérieures mais bien de diagnostics établis au sein d’OpenAI et de Microsoft, qui décrivent les risques d’un modèle économique où les contenus qui alimentent les modèles sont fragilisés par les produits mêmes qu’ils servent à créer.
Pourquoi c’est important
Le fait qu’OpenAI et Microsoft aient, en interne, qualifié l’entraînement de leurs modèles sur des contenus web de « plus grand vol de travail de l’histoire de l’humanité » et d’« engrenage fatal » pour le web donne une portée nouvelle au débat sur l’IA générative. Ces formulations révèlent que les risques pour l’écosystème de l’information étaient identifiés au cœur même des organisations qui développent les modèles, et pas seulement par les éditeurs ou les régulateurs. Ces avertissements internes nourrissent la controverse autour de l’usage des contenus journalistiques et créatifs pour bâtir des systèmes d’IA. En décrivant un « doom loop » qui endommagerait le web et « tournerait en dérision » l’idée d’usage loyal, les documents confortent les arguments des plaignants et pourraient peser dans les discussions sur la rémunération des éditeurs, la régulation des modèles et la redéfinition des règles de propriété intellectuelle à l’ère de l’IA générative.
Questions fréquentes
Que révèlent les documents internes sur OpenAI et Microsoft ?
Ils évoquent un « doom loop » qui endommagerait le web et qualifient l’entraînement des modèles comme « le plus grand vol de travail de l’histoire de l’humanité ».
Quel est le contexte de ces documents ?
Ils ont été récemment déclassifiés dans le cadre de la procédure engagée par le New York Times contre OpenAI et Microsoft.
Que signifie le « doom loop » mentionné par les entreprises ?
Il désigne un engrenage où la stratégie d’IA provoque des dommages au web, tout en dépendant des contenus issus de ce même web.
Comment les pratiques de scraping sont‑elles qualifiées ?
Elles sont décrites comme « le plus grand vol de travail de l’histoire de l’humanité », mettant en avant l’ampleur du transfert de valeur.
Quel est le lien avec la notion d’usage loyal ?
Les documents affirment que ces pratiques font « une complète dérision » de l’idée d’usage loyal, soulignant une tension avec le droit d’auteur.
Source
The VergeAuteur
Rédaction IA-MediasRédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.