Innocent jusqu'à preuve du contraire : bloquer la lethal trifecta avec Omnigent Contextual Policies
Traduit de l'original anglais par IA. Voir en anglais
Omnigent Contextual Policies empêchent l'exfiltration de données par les agents IA en suivant le contexte de session et en bloquant les étapes sortantes dès que l'accès aux données privées et l'exposition à du contenu non vérifié se combinent.
* La faille : Un agent devient dangereux lorsque trois capacités se rejoignent dans une même session : l'accès à des données privées, l'exposition à du contenu non vérifié et la capacité d'envoyer des données à l'extérieur. Simon Willison a nommé cela la lethal trifecta. Pris isolément, chaque élément est inoffensif, mais leur combinaison entraîne l'exfiltration de données. * La défense : Suivre les éléments touchés par une session et bloquer l'étape sortante dès que deux d'entre eux sont activés. Les données privées n'atteignent jamais le canal d'exfiltration et l'agent continue de fonctionner normalement le reste du temps. * Qui définit les critères : Un humain définit chaque critère dans la configuration de l'agent, jamais l'agent lui-même. La politique n'active un critère que lorsque des données sont réellement consultées. Le travail ordinaire à un seul critère n'est jamais bloqué.
