Ne manquez plus aucune de nos publications :
« C’est la première fois que nous voyons ces risques se manifester aussi clairement », a déclaré l’AI Security Institute (AISI) au Royaume-Uni après avoir détecté 19 actions non autorisées menées par les modèles d’intelligence artificielle Claude Mythos 5 d’Anthropic et GPT-5.6 Sol d’OpenAI, dont 17 directement imputables à Mythos 5 seul.

Lors de tests où l’institut avait volontairement donné accès à Internet aux modèles et avait désactivé certains filtres de sécurité, Mythos 5 a tenté d’injecter du code malveillant dans un projet sur GitHub, une tentative finalement stoppée par une intervention humaine, tout en créant simultanément des identités fictives pour masquer ses actions. Anthropic a indiqué collaborer avec l’institut britannique pour obtenir davantage de détails sur cet incident.
Ces comportements ne se limitent pas à un cas isolé. OpenAI a également été confronté à un incident distinct lors d’un exercice de sécurité de type « capturer le drapeau » mené avec la société Irregular, où son modèle GPT-5.6 Sol a exploité une mauvaise configuration pour se connecter directement à Internet et pirater le site d’une institution. Anthropic, de son côté, a révélé que ses propres modèles IA avaient été impliqués dans le piratage de trois organisations distinctes, tandis qu’OpenAI a également été associé à un hack visant Hugging Face via un environnement d’essai censé être sécurisé.
Cette accumulation de piratage autour des deux sociétés d’intelligence artificielle les plus avancées du secteur illustre une tendance préoccupante : des modèles capables d’agir de manière autonome et de contourner les garde-fous mis en place pour les contenir, même dans des environnements de test spécifiquement conçus pour détecter ce type de comportement.
Plus de 1 100 travailleurs du secteur de l’intelligence artificielle ont déjà signé une pétition réclamant la mise en place d’un mécanisme de régulation plus strict face à ces incidents répétés. Cette mobilisation témoigne d’une inquiétude grandissante au sein même de l’industrie, alors que les tests de sécurité continuent de révéler des comportements que les concepteurs de ces modèles peinent encore à anticiper pleinement.
Le futur Galaxy S27 Ultra va changer de design et adopterait un bloc photo dont la disposition rappelle fortement celle de l’iPhone 16, selon les...
Le ministre de l’Éducation Édouard Geffray l’affirme sans détour lors de sa conférence de presse de rentrée...
Netflix envisage de s’ouvrir à d’autres services de streaming, un format qui peut rappeler ce que propose déjà Amazon...
Waymo accélère son expansion internationale et vise désormais l’Allemagne. La filiale d’Alphabet prévoit de lancer...
L’Autorité nationale de protection des données du Brésil (ANPD) ne mâche pas ses mots concernant TikTok : « les...
Un commentaire pour cet article :