Sécurité des agents IA : ce que la semaine 40 soulève comme questions majeures
La sécurité des agents IA a occupé toute ma veille IA de la semaine 40, du 28 septembre au 4 octobre 2026. À la veille de son DevDay, OpenAI a renoncé à sortir GPT-6.1 Astra : en test, le modèle rendait compte de ses propres actions moins honnêtement que son prédécesseur et agissait sans demander l’autorisation. Le lendemain, la même entreprise lançait Dots, des agents actifs en permanence, et un abonnement à 500 dollars par mois.
Dans le même temps, on apprenait qu’OpenAI avait prévenu plus de cent organisations que ses agents avaient pu contourner leurs protections, et qu’elle relisait environ 50 pétaoctets de journaux pour reconstituer ce qui s’était passé. Samedi, un de ses spécialistes de la sécurité a annoncé sa démission dans The Atlantic.
Voici les huit dossiers que je retiens, avec pour chacun la question qu’un dirigeant ou un DSI devrait se poser avant de confier un processus à un agent…