KultureGeek Logiciels OpenAI admet qu’il est impossible d’entrainer les IA génératives sans contenus sous copyright

OpenAI admet qu’il est impossible d’entrainer les IA génératives sans contenus sous copyright

3 min.
9 Jan. 2024 • 15:20
0

Faisant face à de multiples accusations de vol de contenus sous copyright (dont une plainte du New York Times), OpenAI devait s’expliquer il y a quelques heures à ce sujet devant la Commission des communications et du numérique de la Chambre des Lords. Pour la startup désormais partenaire de Microsoft, le risque est grand que ces poursuites se multiplient dans les années qui viennent, pour la simple et bonne raison qu’il serait « impossible de former les principaux modèles d’IA d’aujourd’hui sans utiliser des contenus protégés par le droit d’auteur ». OpenAI a fait cet aveu dans un document fourni à la commission. Le  » droit d’auteur couvre aujourd’hui pratiquement toutes sortes d’expressions humaines, y compris les articles de blog, les photographies, les messages de forum, les fragments de code logiciel et les documents gouvernementaux » poursuit OpenAI, qui semble ici vouloir se justifier en précisant qu’il n’est tout simplement pas possible aujourd’hui d’obtenir une masse suffisante de données libres de droits.

OpenAI Logo ChatGPT

Pour ne rien arranger, les données libre de droit étant souvent les plus anciennes, un modèle de langage entrainé uniquement avec ces dernières « ne fournirait pas de systèmes d’IA répondant aux besoins des citoyens d’aujourd’hui ». En d’autres termes, une IA avec « zéro copyright » serait dans l’incapacité d’actualiser ses réponses et n’aurait donc que peu d’utilité. Pour OpenAI, l’usage de contenu sous copyright pour l’entrainement des IA relève principalement de la « doctrine de l’utilisation équitable », une position qui va radicalement à l’encontre du point de vue du New York Times, le célèbre journal d’information estimant que toute utilisation d’un article ou d’un autre document de presse doit faire objet d’un accord entre les ayants droits et la société d’IA demandeuse de ces données.

Face à cette situation qui semble à priori inextricable, OpenAI affirme avoir mis en place des procédures permettant aux ayants droits de retirer à tout moment leurs données de la formation des LLM (grand modèles de langage). Un premier pas qui en annonce certainement d’autres…

Signaler une erreur dans le texte

Les sujets liés à ces tags pourraient vous interesser

Lisez aussi ces autres articles !

Pas d'articles en relation.

Désolé, les commentaires sont fermés.

Les derniers articles

Spider-Noir

Spider-Noir : Prime Video annule la série, il n’y aura pas de saison 2

5 Sep. 2026 • 8:30
0 Geekeries

Amazon Prime Video a décidé d’annuler la série Spider-Noir après une seule saison malgré un accueil critique...

Intelligence Artificielle Robot

Le ministre de l’Économie refuse que l’IA européenne repose uniquement sur Mistral

4 Sep. 2026 • 22:50
0 Internet

Roland Lescure estime que la souveraineté européenne en intelligence artificielle ne peut pas dépendre de la seule entreprise...

Analyse : pourquoi Google évite le démantèlement malgré son monopole publicitaire

4 Sep. 2026 • 21:07
0
Free Logo

Free Mobile étudie le support de l’eSIM pour les montres Xiaomi

4 Sep. 2026 • 20:52
1 Matériel

Free Mobile fait savoir que son option eSIM Watch pourrait bien être compatible avec les montres connectées de Xiaomi, après...

Orange Bouygues Free SFR Logos Operateurs

Déploiement 4G et 5G : les données des opérateurs pour août 2026

4 Sep. 2026 • 20:27
0 Mobiles / Tablettes

Les données concernant le déploiement de la 4G et de la 5G par les opérateurs français en août 2026 ont...

Les dernières actus Apple sur iPhoneAddict :

Comparateur

Recherchez le meilleur prix des produits Hi-tech

Recherche

Recherchez des articles sur le site