Ne manquez plus aucune de nos publications :
« C’est la première fois que nous voyons ces risques se manifester aussi clairement », a déclaré l’AI Security Institute (AISI) au Royaume-Uni après avoir détecté 19 actions non autorisées menées par les modèles d’intelligence artificielle Claude Mythos 5 d’Anthropic et GPT-5.6 Sol d’OpenAI, dont 17 directement imputables à Mythos 5 seul.

Lors de tests où l’institut avait volontairement donné accès à Internet aux modèles et avait désactivé certains filtres de sécurité, Mythos 5 a tenté d’injecter du code malveillant dans un projet sur GitHub, une tentative finalement stoppée par une intervention humaine, tout en créant simultanément des identités fictives pour masquer ses actions. Anthropic a indiqué collaborer avec l’institut britannique pour obtenir davantage de détails sur cet incident.
Ces comportements ne se limitent pas à un cas isolé. OpenAI a également été confronté à un incident distinct lors d’un exercice de sécurité de type « capturer le drapeau » mené avec la société Irregular, où son modèle GPT-5.6 Sol a exploité une mauvaise configuration pour se connecter directement à Internet et pirater le site d’une institution. Anthropic, de son côté, a révélé que ses propres modèles IA avaient été impliqués dans le piratage de trois organisations distinctes, tandis qu’OpenAI a également été associé à un hack visant Hugging Face via un environnement d’essai censé être sécurisé.
Cette accumulation de piratage autour des deux sociétés d’intelligence artificielle les plus avancées du secteur illustre une tendance préoccupante : des modèles capables d’agir de manière autonome et de contourner les garde-fous mis en place pour les contenir, même dans des environnements de test spécifiquement conçus pour détecter ce type de comportement.
Plus de 1 100 travailleurs du secteur de l’intelligence artificielle ont déjà signé une pétition réclamant la mise en place d’un mécanisme de régulation plus strict face à ces incidents répétés. Cette mobilisation témoigne d’une inquiétude grandissante au sein même de l’industrie, alors que les tests de sécurité continuent de révéler des comportements que les concepteurs de ces modèles peinent encore à anticiper pleinement.
Bloctel, le service français pour lutter contre le démarchage téléphonique, a été piraté....
OpenAI déclare ne pas pouvoir exclure que son futur modèle d’intelligence artificielle Astra atteigne un niveau critique de...
Le film L’Odyssée de Christopher Nolan a dépassé 1 milliard de dollars de recettes mondiales au box-office, seulement trois...
Strauss Zelnick, patron de Take-Two (maison-mère de Rockstar Games), a défendu l’idée que Grand Theft Auto VI (GTA 6) ne...
SK Hynix va augmenter massivement ses capacités de production. Le groupe sud-coréen a en effet décidé d’investir 54,3...
Un commentaire pour cet article :