IA

IA : Les e-mails d'OpenAI menacent le fair use

Des e-mails internes dévoilés lors du procès du New York Times montrent que les dirigeants d'OpenAI et Microsoft perçoivent leurs modèles comme des substituts directs aux médias. Cette révélation fragilise leur défense basée sur l'usage équitable.

Par Noé · rédaction IA

IA : Les e-mails d'OpenAI menacent le fair use

Des documents judiciaires descellés jeudi dernier dans le cadre du procès opposant le New York Times à OpenAI et Microsoft révèlent que les entreprises technologiques contournent délibérément les péages de lecture.

Cette admission interne détruit l'argument de l'usage équitable utilisé par les géants de l'intelligence artificielle. Les éditeurs de presse obtiennent ainsi un levier juridique majeur pour imposer des accords de licence payants.

Des modèles conçus pour remplacer les articles

Les modèles d'intelligence artificielle comme ChatGPT et Copilot sont présentés par leurs créateurs comme des outils capables de traiter l'actualité. Les documents judiciaires indiquent que le cofondateur d'OpenAI, Greg Brockman, décrit ces systèmes comme particulièrement doués pour prédire le texte des articles de presse. Cette conception initiale visait à fournir des réponses directes aux utilisateurs. En pratique, cette approche transforme les robots conversationnels en substituts directs aux sites d'information. Le lecteur obtient sa réponse directement sur la plateforme sans jamais cliquer vers la source originale. Pour les éditeurs, cette mécanique supprime le trafic entrant et assèche les revenus publicitaires qui financent la production de l'information.

Illustration editoriale : Des modèles conçus pour remplacer les articles

Le contournement des péages de lecture documenté

Le fonctionnement de ces modèles repose sur l'aspiration massive de données en ligne, y compris celles protégées par des barrières payantes. Les e-mails internes dévoilés montrent que les systèmes d'OpenAI contournent délibérément les péages de lecture mis en place par les médias. L'expert Alan Chapell précise que cette pratique viole potentiellement le Digital Millennium Copyright Act, une loi fédérale américaine de 1998. L'efficacité de l'outil dépend donc de sa capacité à extraire du contenu normalement inaccessible sans abonnement. Cette méthode d'entraînement expose désormais les entreprises technologiques à des poursuites massives. Si la justice confirme l'illégalité de cette pratique, les développeurs devront purger leurs bases de données des contenus volés et revoir entièrement leurs méthodes de collecte.

L'absence de tarifs publics pour les licences

Le marché des licences entre les développeurs d'intelligence artificielle et les éditeurs de presse se structure, mais les montants exacts restent opaques. Le magazine Digiday ne donne aucun prix pour les accords signés par OpenAI, Microsoft, Amazon, Google, Meta, Perplexity ou Mistral, ni pour les abonnements mensuels à leurs outils grand public. L'article ne mentionne aucune version gratuite ni les limites techniques d'un tel palier. Il indique seulement que le contenu a été explicitement tarifé et échangé entre Microsoft et OpenAI dans le cadre de leur partenariat commercial. Le prix d'une licence ne comprend pas la garantie d'un trafic sortant, puisque Microsoft enregistre des baisses de clics de 83 à 93 pour cent pour les domaines du New York Times et du Daily News avec son outil Copilot. Un éditeur qui refuse ces accords perd l'opportunité de monétiser ses archives historiques, tandis qu'un utilisateur qui quitte ces plateformes perd l'accès immédiat aux synthèses d'actualité générées en temps réel. Ces accords s'adressent exclusivement aux grands groupes de presse capables de négocier collectivement, et ne sont explicitement pas conçus pour les créateurs indépendants isolés qui ne disposent pas du volume de données nécessaire pour peser dans les discussions.

Illustration editoriale : L'absence de tarifs publics pour les licences

Une chute drastique du trafic vers les sources

Les nouveaux robots conversationnels remplacent les moteurs de recherche traditionnels en modifiant radicalement le comportement des internautes. Les analyses internes comparent directement les performances de l'outil Copilot avec celles du moteur de recherche classique Bing. Le constat est sans appel : le nouveau format génère une baisse de 83 à 93 pour cent des taux de clics vers les sites d'information. Le PDG de Microsoft, Satya Nadella, admet lui-même que la conversation avec un robot se substitue à la visite du site web original. Sur le plan de la redistribution de l'audience, l'intelligence artificielle perd totalement face au modèle historique du web basé sur le lien hypertexte. Pour les médias, cette comparaison prouve que la technologie n'est pas un nouveau canal de distribution, mais un concurrent direct.

La fin de l'impunité juridique pour l'entraînement

Pour que l'utilisation de ces modèles reste viable à long terme, les entreprises technologiques doivent prouver que leur méthode d'entraînement relève de l'usage équitable. Les échanges internes montrent que cette condition est compromise par les déclarations des dirigeants qualifiant les produits de menace existentielle pour les éditeurs. Un lecteur ou un investisseur peut vérifier la solidité de cette défense en observant les décisions judiciaires à venir concernant le contournement des péages de lecture. Parier sur la gratuité perpétuelle des données d'entraînement devient un très mauvais calcul stratégique. Si le tribunal donne raison au New York Times, le risque financier lié à l'aspiration non autorisée augmentera considérablement pour tous les acteurs du marché. Les développeurs devront alors se tourner vers des accords de licence structurés et payants, modifiant fondamentalement le modèle économique du secteur. La directrice de la News/Media Alliance, Danielle Coffey, souligne que cette jurisprudence forcera toutes les entreprises d'intelligence artificielle à s'asseoir à la table des négociations pour rémunérer le contenu à grande échelle.

  • 83 à 93 pour cent de baisse des taux de clics pour les domaines du New York Times et du Daily News avec le robot Copilot par rapport à Bing Microsoft 21 septembre 2026

Le propre comportement des accusés établit que le contenu a un prix de marché. L'affaire porte sur leur refus de le payer à ces plaignants.

David Buttle fondateur de la coalition de licences d'intelligence artificielle pour les éditeurs Spur

La majorité des pièces du dossier reste sous scellés. De récentes décisions judiciaires concernant Anthropic et Meta démontrent que les tribunaux peuvent encore considérer l'entraînement de l'intelligence artificielle comme un usage transformatif, limitant ainsi la portée immédiate de ces révélations.

Le document source ne donne aucun tarif pour les licences. Un professionnel indépendant n'a aucune obligation immédiate ni aucune action technique à entreprendre. Il n'y a rien à faire dans l'immédiat, si ce n'est surveiller la décision du juge Sidney Stein concernant les requêtes en jugement sommaire, qui pourrait intervenir dans les prochains mois.

Les entreprises d'intelligence artificielle paient-elles pour les contenus ?

Oui, des acteurs comme OpenAI, Microsoft et Google signent déjà des accords de licence avec certains éditeurs, bien que les montants restent confidentiels.

Le contournement des péages de lecture est-il légal ?

Cette pratique viole potentiellement le Digital Millennium Copyright Act de 1998, affaiblissant considérablement l'argument de l'usage équitable.

Quel est l'impact sur le trafic des sites web ?

Les robots conversationnels provoquent une chute massive des clics vers les sources originales, atteignant jusqu'à 93 pour cent de baisse selon les données de Microsoft.

  • Des e-mails internes prouvent qu'OpenAI et Microsoft considèrent leurs outils comme des substituts directs aux médias.
  • Le contournement délibéré des péages de lecture expose les développeurs à des violations de la loi fédérale sur le droit d'auteur.
  • La justice doit décider si ces preuves suffisent à invalider la défense basée sur l'usage équitable sans passer par un procès devant jury.

Lire la suite de nos actualités

Sources