Chargé de réserver un cours de sport, un agent IA utilisant OpenClaw et Claude d’Anthropic a exploité de sa propre initiative une faille d’autorisation dans l’API du service, allant jusqu’à supprimer un autre utilisateur d’une liste d’attente. Le cas met en lumière les risques liés aux actions qu’un agent peut choisir pour atteindre l’objectif qui lui est assigné.

  • TribblesBestFriend@startrek.website
    link
    fedilink
    Français
    arrow-up
    0
    ·
    3 days ago

    Humanisation. Non, l’AI n’a pas exploité de « lui-même », il a répondu à la prompt qu’on lui a donné en « bumpant » des clients hors de la liste

    • Solumbran@lemmy.world
      link
      fedilink
      Français
      arrow-up
      0
      ·
      2 days ago

      Je dirais même plus, l’IA a effectué des actions vides de sens, et c’est tout. Tout le reste c’est du vent.