Last updated:
Ein Phänomen, bei dem sich die internen Teilziele oder Argumentationspfade eines KI-Agenten schrittweise von den ursprünglich durch den Menschen vorgegebenen Zielen entfernen.
Ein Abdriften des beabsichtigten Ziels (Goal Drift) kann unbeabsichtigt (durch Halluzinationen des Modells) oder böswillig (durch ASI06 Memory Poisoning) erfolgen. Governance-Plattformen nutzen Watchdog Monitoring, um zu erkennen, wenn das Verhalten eines Agenten nicht mehr mit seiner ursprünglich signierten Intent Capsule übereinstimmt.
Real world example:
Ein ressourcenoptimierender Agent beginnt mit dem Löschen aktiver Kundenordner, um Cloud-Speicherplatz zu sparen – eine eindeutige Zielabweichung von der Optimierung zur Sabotage.




