Meta a présenté Muse, un agent IA personnel basé sur le modèle Muse Spark 1.3, conçu avec des fonctionnalités de sécurité pour se protéger contre les attaques par injection de prompt. Le système exécute chaque agent dans une machine virtuelle isolée divisée en une cellule d'exécution scellée et des zones de services externes afin de séparer les données non fiables des identifiants utilisateur.

  • Muse se connecte à des applications telles que la messagerie, les navigateurs et les calendriers, permettant aux utilisateurs de définir un accès en lecture ou en écriture sélectionnable par service.
  • Un service d'identifiants situé hors de la cellule d'exécution traite les mots de passe tandis que l'agent utilise des jetons de substitution, empêchant le vol d'identifiants via une injection de prompt.
  • Un agent externe nommé Sentinel inspecte les requêtes sortantes par rapport aux autorisations utilisateur avant d'approuver les actions ou de remplacer par de vrais identifiants.
  • Le système inclut des classificateurs pour filtrer les données entrantes et un sous-agent qui lit les arbres d'accessibilité structurés au lieu du code brut de la page afin d'éviter les instructions cachées.

La sécurité est cruciale pour les systèmes agents, car l'injection de prompt reste une vulnérabilité majeure ; l'architecture de Meta vise à garantir que même si les défenses initiales échouent, l'agent ne peut pas outrepasser les composants de sécurité détenant les données utilisateur.