KultureGeek Logiciels OpenAI admet qu’il est impossible d’entrainer les IA génératives sans contenus sous copyright

OpenAI admet qu’il est impossible d’entrainer les IA génératives sans contenus sous copyright

3 min.
9 Jan. 2024 • 15:20
0

Faisant face à de multiples accusations de vol de contenus sous copyright (dont une plainte du New York Times), OpenAI devait s’expliquer il y a quelques heures à ce sujet devant la Commission des communications et du numérique de la Chambre des Lords. Pour la startup désormais partenaire de Microsoft, le risque est grand que ces poursuites se multiplient dans les années qui viennent, pour la simple et bonne raison qu’il serait « impossible de former les principaux modèles d’IA d’aujourd’hui sans utiliser des contenus protégés par le droit d’auteur ». OpenAI a fait cet aveu dans un document fourni à la commission. Le  » droit d’auteur couvre aujourd’hui pratiquement toutes sortes d’expressions humaines, y compris les articles de blog, les photographies, les messages de forum, les fragments de code logiciel et les documents gouvernementaux » poursuit OpenAI, qui semble ici vouloir se justifier en précisant qu’il n’est tout simplement pas possible aujourd’hui d’obtenir une masse suffisante de données libres de droits.

OpenAI Logo ChatGPT

Pour ne rien arranger, les données libre de droit étant souvent les plus anciennes, un modèle de langage entrainé uniquement avec ces dernières « ne fournirait pas de systèmes d’IA répondant aux besoins des citoyens d’aujourd’hui ». En d’autres termes, une IA avec « zéro copyright » serait dans l’incapacité d’actualiser ses réponses et n’aurait donc que peu d’utilité. Pour OpenAI, l’usage de contenu sous copyright pour l’entrainement des IA relève principalement de la « doctrine de l’utilisation équitable », une position qui va radicalement à l’encontre du point de vue du New York Times, le célèbre journal d’information estimant que toute utilisation d’un article ou d’un autre document de presse doit faire objet d’un accord entre les ayants droits et la société d’IA demandeuse de ces données.

Face à cette situation qui semble à priori inextricable, OpenAI affirme avoir mis en place des procédures permettant aux ayants droits de retirer à tout moment leurs données de la formation des LLM (grand modèles de langage). Un premier pas qui en annonce certainement d’autres…

Signaler une erreur dans le texte

Les sujets liés à ces tags pourraient vous interesser

Désolé, les commentaires sont fermés.

Les derniers articles

mistral-ai

IA en Europe : Microsoft signe un accord avec Mistral de plusieurs milliards de dollars

21 Juil. 2026 • 22:43
1 Internet

Microsoft utilisera une partie de l’infrastructure GPU européenne de Mistral pour son propre développement d’intelligence...

Reseaux Sociaux TikTok YouTube X Twitter Instagram Facebook

La France adopte définitivement l’interdiction des réseaux sociaux aux moins de 15 ans

21 Juil. 2026 • 20:31
8 Internet

Le Parlement a définitivement adopté l’interdiction des réseaux sociaux aux moins de 15 ans en France, avec une entrée...

Google Gemini Logo

Google lance ses IA Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber

21 Juil. 2026 • 20:12
0 Internet

Google lance trois nouveaux modèles d’intelligence artificielle : Gemini 3,6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber, tous...

Spider-Man Brand New Day

Spider-Man : Brand New Day dévoile sa bande-annonce finale

21 Juil. 2026 • 18:41
0 Geekeries

Sony Pictures propose aujourd’hui la troisième et ultime bande-annonce pour Spider-Man : Brand New Day. Le film en collaboration avec Marvel...

No to Digital ID 1

Royaume-Uni : face à la fronde, le gouvernement abandonne son projet de carte d’identité numérique

21 Juil. 2026 • 18:31
0 Internet

Le Royaume-Uni renonce à son programme national d’identité numérique. À peine installé à Downing Street,...

Les dernières actus Apple sur iPhoneAddict :

Comparateur

Recherchez le meilleur prix des produits Hi-tech

Recherche

Recherchez des articles sur le site