Meta ha presentado Muse, un agente de IA personal basado en el modelo Muse Spark 1.3, diseñado con características de seguridad para protegerse contra ataques de inyección de prompts. El sistema ejecuta cada agente en una máquina virtual aislada dividida en una celda de ejecución sellada y zonas de servicios externos para separar los datos no confiables de las credenciales del usuario.

  • Muse se conecta a aplicaciones como correo electrónico, navegadores y calendarios, permitiendo a los usuarios establecer acceso de solo lectura o escritura seleccionable por servicio.
  • Un servicio de credenciales fuera de la celda de ejecución procesa las contraseñas mientras el agente utiliza tokens sustitutos, previniendo el robo de credenciales mediante inyección de prompts.
  • Un agente externo llamado Sentinel inspecciona las solicitudes salientes en función de los permisos del usuario antes de aprobar acciones o intercambiar por las credenciales reales.
  • El sistema incluye clasificadores para filtrar los datos entrantes y un sub-agente que lee árboles de accesibilidad estructurados en lugar del código crudo de la página para evitar instrucciones ocultas.

La seguridad es crítica para los sistemas agénticos, ya que la inyección de prompts sigue siendo una vulnerabilidad importante; la arquitectura de Meta busca garantizar que incluso si las defensas iniciales fallan, el agente no pueda anular los componentes de seguridad que contienen los datos del usuario.