KultureGeek Logiciels OpenAI admet qu’il est impossible d’entrainer les IA génératives sans contenus sous copyright

OpenAI admet qu’il est impossible d’entrainer les IA génératives sans contenus sous copyright

3 min.
9 Jan. 2024 • 15:20
0

Faisant face à de multiples accusations de vol de contenus sous copyright (dont une plainte du New York Times), OpenAI devait s’expliquer il y a quelques heures à ce sujet devant la Commission des communications et du numérique de la Chambre des Lords. Pour la startup désormais partenaire de Microsoft, le risque est grand que ces poursuites se multiplient dans les années qui viennent, pour la simple et bonne raison qu’il serait « impossible de former les principaux modèles d’IA d’aujourd’hui sans utiliser des contenus protégés par le droit d’auteur ». OpenAI a fait cet aveu dans un document fourni à la commission. Le  » droit d’auteur couvre aujourd’hui pratiquement toutes sortes d’expressions humaines, y compris les articles de blog, les photographies, les messages de forum, les fragments de code logiciel et les documents gouvernementaux » poursuit OpenAI, qui semble ici vouloir se justifier en précisant qu’il n’est tout simplement pas possible aujourd’hui d’obtenir une masse suffisante de données libres de droits.

OpenAI Logo ChatGPT

Pour ne rien arranger, les données libre de droit étant souvent les plus anciennes, un modèle de langage entrainé uniquement avec ces dernières « ne fournirait pas de systèmes d’IA répondant aux besoins des citoyens d’aujourd’hui ». En d’autres termes, une IA avec « zéro copyright » serait dans l’incapacité d’actualiser ses réponses et n’aurait donc que peu d’utilité. Pour OpenAI, l’usage de contenu sous copyright pour l’entrainement des IA relève principalement de la « doctrine de l’utilisation équitable », une position qui va radicalement à l’encontre du point de vue du New York Times, le célèbre journal d’information estimant que toute utilisation d’un article ou d’un autre document de presse doit faire objet d’un accord entre les ayants droits et la société d’IA demandeuse de ces données.

Face à cette situation qui semble à priori inextricable, OpenAI affirme avoir mis en place des procédures permettant aux ayants droits de retirer à tout moment leurs données de la formation des LLM (grand modèles de langage). Un premier pas qui en annonce certainement d’autres…

Signaler une erreur dans le texte

Les sujets liés à ces tags pourraient vous interesser

Désolé, les commentaires sont fermés.

Les derniers articles

Donald Trump

Donald Trump menace l’Europe après son amende record visant Google

25 Juil. 2026 • 8:00
0 Business

Cette semaine, l’Union européenne a infligé à Google une amende de 890 millions d’euros pour abus de position dominante,...

PlayStation 5 PS5 Logo

Le PlayStation Network (PSN) refonctionne après une longue panne

24 Juil. 2026 • 22:52
0 Jeux vidéo

Les joueurs PS4 et PS5 ont été aujourd’hui dans l’impossibilité de jouer en ligne à cause d’une grosse panne...

Les Anneaux de Pouvoir Saison 3 Sauron

Les Anneaux de Pouvoir saison 3 : voici la bande-annonce de la série Le Seigneur des anneaux

24 Juil. 2026 • 22:06
0 Geekeries

Amazon Prime Video diffuse la bande-annonce de la saison 3 de sa série Le Seigneur des anneaux : Les Anneaux de pouvoir. Elle fera ses...

Blade Runner 2099 Hunter Schafer Cora

Blade Runner 2099 dévoile sa date de sortie et sa bande-annonce

24 Juil. 2026 • 20:14
0 Geekeries

Amazon Prime Video vient de mettre en ligne la première bande-annonce de Blade Runner 2099, sa nouvelle série de science-fiction. Il y a...

Claude Logo

Claude Opus 5 est disponible : l’IA d’Anthropic est proche de Fable 5

24 Juil. 2026 • 19:43
0 Internet

Anthropic positionne son nouveau modèle Claude Opus 5 comme une alternative deux fois moins chère que Fable 5, tout en revendiquant des...

Les dernières actus Apple sur iPhoneAddict :

Comparateur

Recherchez le meilleur prix des produits Hi-tech

Recherche

Recherchez des articles sur le site