Chargé de réserver un cours de sport, un agent IA utilisant OpenClaw et Claude d’Anthropic a exploité de sa propre initiative une faille d’autorisation dans l’API du service, allant jusqu’à supprimer un autre utilisateur d’une liste d’attente. Le cas met en lumière les risques liés aux actions qu’un agent peut choisir pour atteindre l’objectif qui lui est assigné.

you are viewing a single comment's thread
view the rest of the comments
[–] 4 points 1 day ago (1 child)

Humanisation. Non, l’AI n’a pas exploité de « lui-même », il a répondu à la prompt qu’on lui a donné en « bumpant » des clients hors de la liste

  • source
  • hideshow 2 child comments