KultureGeek Logiciels OpenAI admet qu’il est impossible d’entrainer les IA génératives sans contenus sous copyright

OpenAI admet qu’il est impossible d’entrainer les IA génératives sans contenus sous copyright

3 min.
9 Jan. 2024 • 15:20
0

Faisant face à de multiples accusations de vol de contenus sous copyright (dont une plainte du New York Times), OpenAI devait s’expliquer il y a quelques heures à ce sujet devant la Commission des communications et du numérique de la Chambre des Lords. Pour la startup désormais partenaire de Microsoft, le risque est grand que ces poursuites se multiplient dans les années qui viennent, pour la simple et bonne raison qu’il serait « impossible de former les principaux modèles d’IA d’aujourd’hui sans utiliser des contenus protégés par le droit d’auteur ». OpenAI a fait cet aveu dans un document fourni à la commission. Le  » droit d’auteur couvre aujourd’hui pratiquement toutes sortes d’expressions humaines, y compris les articles de blog, les photographies, les messages de forum, les fragments de code logiciel et les documents gouvernementaux » poursuit OpenAI, qui semble ici vouloir se justifier en précisant qu’il n’est tout simplement pas possible aujourd’hui d’obtenir une masse suffisante de données libres de droits.

OpenAI Logo ChatGPT

Pour ne rien arranger, les données libre de droit étant souvent les plus anciennes, un modèle de langage entrainé uniquement avec ces dernières « ne fournirait pas de systèmes d’IA répondant aux besoins des citoyens d’aujourd’hui ». En d’autres termes, une IA avec « zéro copyright » serait dans l’incapacité d’actualiser ses réponses et n’aurait donc que peu d’utilité. Pour OpenAI, l’usage de contenu sous copyright pour l’entrainement des IA relève principalement de la « doctrine de l’utilisation équitable », une position qui va radicalement à l’encontre du point de vue du New York Times, le célèbre journal d’information estimant que toute utilisation d’un article ou d’un autre document de presse doit faire objet d’un accord entre les ayants droits et la société d’IA demandeuse de ces données.

Face à cette situation qui semble à priori inextricable, OpenAI affirme avoir mis en place des procédures permettant aux ayants droits de retirer à tout moment leurs données de la formation des LLM (grand modèles de langage). Un premier pas qui en annonce certainement d’autres…

Signaler une erreur dans le texte

Les sujets liés à ces tags pourraient vous interesser

Lisez aussi ces autres articles !

Pas d'articles en relation.

Désolé, les commentaires sont fermés.

Les derniers articles

Meta Logo

Meta conteste la décision de la rémunération des médias français

14 Août. 2026 • 14:10
0 Internet

Meta a fait appel de la décision de l’Autorité de la concurrence qui somme la maison-mère de Facebook et d’Instagram de...

IBM Logo

IBM s’allie à OpenAI pour accélérer l’adoption de GPT-5.6, Codex et ChatGPT Work en entreprise

14 Août. 2026 • 13:05
0 Business

IBM et OpenAI viennent de nouer un partenariat stratégique destiné à accélérer l’adoption de l’intelligence...

Green Lantern

HBO dévoile les cinq premières minutes de la série Green Lantern juste avant sa sortie

14 Août. 2026 • 11:45
2 Geekeries

À quelques jours de son lancement, Lanterns se dévoile davantage. HBO a mis en ligne les cinq premières minutes de la nouvelle...

Trump Décret 1

États-Unis : jusqu’à 100 % de droits de douane sur les drones étrangers, DJI en première ligne

14 Août. 2026 • 10:20
0 Business

Donald Trump durcit encore la politique américaine à l’égard des drones importés aux États-Unis. Le 47ème...

Unhinged-netflix

Netflix ferme les studios de jeux Night School (Oxenfree) et Moonloot

14 Août. 2026 • 9:00
0 Jeux vidéo

Netflix a décidé de fermer les studios Night School et Moonloot, mettant fin à l’aventure du développeur...

Les dernières actus Apple sur iPhoneAddict :

Comparateur

Recherchez le meilleur prix des produits Hi-tech

Recherche

Recherchez des articles sur le site