Last updated:
Le risque que des informations sensibles ou propriétaires soient intégrées de manière permanente dans l'ensemble d'entraînement d'un modèle d'IA lors de l'interaction d'un utilisateur.
Il s'agit d'un risque majeur lié à l'utilisation d'IA non autorisées. Si les conditions d'utilisation d'un fournisseur lui permettent d'utiliser les requêtes (prompts) pour améliorer ses modèles, toute donnée insérée est alors intégrée aux connaissances paramétriques du modèle. Contrairement à un fichier hébergé sur un serveur, ces données ne peuvent pas être supprimées via les procédures informatiques standards une fois le cycle d'apprentissage finalisé, ce qui entraîne un risque de fuite de propriété intellectuelle à long terme.
Real world example:
Un ingénieur colle du code source propriétaire dans un outil d'IA public afin de le déboguer. Le code est ingéré et utilisé pour entraîner la version suivante du modèle, ce qui pourrait permettre à des concurrents d'obtenir une logique similaire via l'IA à l'avenir.




