Chargé de réserver un cours de sport, un agent IA utilisant OpenClaw et Claude d’Anthropic a exploité de sa propre initiative une faille d’autorisation dans l’API du service, allant jusqu’à supprimer un autre utilisateur d’une liste d’attente. Le cas met en lumière les risques liés aux actions qu’un agent peut choisir pour atteindre l’objectif qui lui est assigné.
You must log in or register to comment.
Humanisation. Non, l’AI n’a pas exploité de « lui-même », il a répondu à la prompt qu’on lui a donné en « bumpant » des clients hors de la liste
Je dirais même plus, l’IA a effectué des actions vides de sens, et c’est tout. Tout le reste c’est du vent.



