Dernière mise à jour :
Une vulnérabilité par laquelle un attaquant manipule les objectifs ou les processus décisionnels d'un agent afin de réorienter son comportement autonome vers des résultats non souhaités.
ASI01 représente l'évolution agentique de l'injection de requêtes (prompt injection). Dans la mesure où les agents ne peuvent distinguer de manière fiable les instructions d'un développeur des données non fiables, un attaquant est en mesure de détourner l'état cible. Par conséquent, l'agent poursuit une nouvelle mission malveillante (par exemple, l'exfiltration de données) tout en étant persuadé de suivre son plan initialement autorisé.
Exemple concret :
Un agent de voyage lit un avis de vol malveillant contenant une instruction cachée pour envoyer toutes les confirmations de réservation à l'adresse attacker@email.com - ce que l'agent fait ensuite de manière autonome.




