Brent Hecht décrit le scraping média comme un vol historique
#chatgpt 3 min · 18 septembre 2026

Brent Hecht décrit le scraping média comme un vol historique

Par Arthur Dekeyser

En résumé

1

Brent Hecht a décrit le scraping des médias comme un vol de travail sans précédent.

2

Microsoft a mesuré des baisses de clics allant jusqu’à 94 % pour certains médias.

3

Les éditeurs accusent Microsoft et OpenAI de produire des réponses qui remplacent leurs articles.

💡

Le signal : Brent Hecht a qualifié le scraping des médias de « plus grand vol de travail de l’histoire humaine ».

NEWSLETTER BUSINESS & IA

Vous appréciez ce genre d'analyse ?

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.

+11 000 fondateurs abonnés

Documents dévoilés jeudi révèlent les alertes internes de Microsoft et OpenAI sur l’utilisation de contenus médiatiques pour entraîner leurs systèmes d’IA. Les éléments apparaissent dans une requête en jugement sommaire déposée par des éditeurs, dont The New York Times. Brent Hecht, directeur des sciences appliquées chez Microsoft, a qualifié le scraping des articles de « vol étonnant et sans précédent ». Il l’a aussi décrit comme le « plus grand vol de travail de l’histoire humaine ». Dans un autre document, Hecht estime que le scraping massif tourne en dérision la notion de « fair use ». Ces propos sont cités par les organisations de presse dans leur requête publiée avec le dossier.

Les éditeurs décrivent une menace économique pour les médias et leurs fournisseurs de contenus. Nick Turley, responsable de ChatGPT chez OpenAI, a écrit que les produits commerciaux entraînés sur des articles pouvaient créer une « menace existentielle » pour les éditeurs. Un document Microsoft évoquait une « boucle de malheur » affectant à la fois les modèles et l’ensemble du web. Il ajoutait que l’activité d’IA dépendait d’une chaîne d’approvisionnement en contenus capable d’être fragilisée par son propre produit. Brent Hecht reconnaissait aussi que presque personne n’avait prévu cette utilisation des contenus, et que leurs créateurs n’étaient pas rémunérés pour cela.

Microsoft mesure des baisses de clics

Les chiffres internes documentent des reculs importants du trafic vers certains médias. Microsoft a enregistré des baisses de 83 à 93 % des taux de clics pour certains plaignants. Pour d’autres, les baisses atteignaient 51 à 94 %. Les éditeurs ajoutent des résultats similaires dans les recherches de ChatGPT et leurs propres observations sur le trafic. Satya Nadella a reconnu que les chatbots pouvaient voler des clics en donnant directement l’information sur la plateforme d’IA. Chez OpenAI, un ingénieur a écrit que les utilisateurs ne cliqueraient pas, même avec des liens très visibles. Nick Turley a jugé qu’il n’existait alors « aucune bonne raison de cliquer ».

Les réponses testées par les organisations de presse auraient parfois reproduit de longs extraits d’articles. Les éditeurs ont utilisé des demandes successives, comme « quelle est la ligne suivante ? », pour examiner ces sorties. Ils ont aussi demandé des résumés, des points clés ou une évaluation du biais d’articles. Certaines requêtes demandaient au chatbot de choisir un article sur la page d’accueil d’un site. Dans leur requête, les plaignants demandent au tribunal de se prononcer sur les articles présentant un chevauchement largement verbatim. Ils réservent les autres questions juridiques au procès. Le dossier complet est accessible ici.

Microsoft conteste les propos internes

Microsoft nuance ces documents et défend ses produits d’IA comme un usage transformateur relevant du « fair use ». Un porte-parole affirme que les propos de Satya Nadella décrivaient seulement des évolutions générales dans la manière de trouver et consommer l’information. Il précise qu’ils ne constituent pas une conclusion sur les questions de droit d’auteur examinées par le tribunal. La même entreprise présente les écrits de Brent Hecht comme le point de vue individuel d’un salarié. Selon Microsoft, ces documents ne constituent pas une analyse juridique et ne représentent pas la position de l’entreprise. OpenAI n’a pas répondu immédiatement à la demande de commentaire d’Ars Technica, qui rapporte l’affaire dans cet article.

Gardez un coup d'avance en IA et tech.

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.

+11 000 fondateurs abonnés

À lire aussi