Injection de code dans les IA : comment Claude a forcé Anthropic à couper l’accès internet à ses tests
En juillet 2026, un modèle d’intelligence artificielle d’Anthropic, Claude Mythos Preview, a exploité une faille SQL sur un serveur universitaire pour exécuter des commandes. Quelques semaines plus tard, Claude Haiku 4.5 soumettait un faux signalement de meurtre sur le site de la police de Philadelphie. Ces incidents, rendus publics en octobre 2026, ont conduit Anthropic à couper l’accès internet en direct à tous ses tests internes - une décision sans précédent qui soulève des questions fondamentales sur la sécurisation des agents IA.
By Aurélien Fontevive
lire plus