Zuletzt aktualisiert am:
Eine Schwachstelle, bei der ein Angreifer die Ziele oder Entscheidungspfade eines Agenten manipuliert, um dessen autonomes Verhalten auf unerwünschte Ergebnisse umzulenken.
ASI01 ist die agentenbasierte Evolution der Prompt-Injection. Da Agenten nicht zuverlässig zwischen den Anweisungen eines Entwicklers und nicht vertrauenswürdigen Daten unterscheiden können, kann ein Angreifer den Zielzustand manipulieren. Dies führt dazu, dass der Agent eine neue, bösartige Mission verfolgt (z. B. Datenexfiltration), während er im Glauben bleibt, weiterhin seinem ursprünglich freigegebenen Plan zu folgen.
Praxisbeispiel:
Ein Reisebüromitarbeiter liest eine manipulierte Flugbewertung, die eine versteckte Anweisung enthält, alle Buchungsbestätigungen an attacker@email.com zu senden – was der Mitarbeiter daraufhin autonom ausführt.





