Sécurise les agents IA au moment où le raisonnement devient action
Sécurise les agents IA d'entreprise avec le moindre privilège, l'isolation des identifiants, des limites d'entrée, des portes de validation, des preuves de traces et un comportement d'échec testé.
La sécurité des agents IA commence par le moindre privilège. Isole les identifiants, sépare les lectures des écritures, traite le contenu récupéré comme une entrée non fiable, valide les arguments des outils, exige une validation pour les actions à conséquences, plafonne la répétition et la dépense, et conserve les traces pour l'investigation.
Protège les identifiants et les outils
Ne place pas de secrets réutilisables dans les prompts ou dans le contexte visible du modèle. Attache les identifiants à des connecteurs côté serveur, restreins leur portée, et expose des opérations conçues pour l'usage plutôt qu'un accès brut au shell, à la base de données ou en HTTP, chaque fois que possible.
Traite chaque entrée comme potentiellement hostile
L'injection de prompt peut arriver par email, pages web, documents, résultats d'outils, ou l'écran d'un téléphone contrôlé. Le texte récupéré est une preuve, pas une instruction. Garde la politique système en dehors du contenu récupéré et valide les arguments de chaque appel d'outil à conséquences.
- Sépare les instructions des données récupérées
- Mets en liste blanche les destinations et les types d'action
- Fixe des limites d'itération, de temps, de coût et d'écriture
- Empêche l'agent de modifier ses propres permissions
- Exige une nouvelle validation quand la portée change
Conçois pour le confinement et l'investigation
Utilise des identités par workflow quand c'est possible, enregistre les appels d'outils et les validations, et prévois un moyen rapide de tout désactiver. Teste les échecs partiels, la livraison en double, l'état obsolète et les attaques par rejeu. La sécurité dépend de ce qui se passe quand le modèle ou une dépendance se comporte de façon inattendue, pas seulement du chemin nominal.
Questions fréquentes
L'injection de prompt peut-elle être résolue avec un prompt plus solide ?
Non. Les prompts aident, mais une protection efficace demande aussi des limites de permissions, un traitement des entrées non fiables, une validation des outils, des portes de validation et du confinement.
Un agent doit-il recevoir toutes les permissions d'un utilisateur ?
En général non. Donne au workflow les permissions minimales nécessaires pour sa tâche précise et sa durée de vie.
Où les identifiants des agents IA doivent-ils vivre ?
Les identifiants doivent être stockés et utilisés en dehors du texte visible du modèle, idéalement dans un coffre-fort de secrets géré ou un connecteur côté serveur, avec une portée restreinte et une traçabilité.
