A Meta apresentou o Muse, um agente de IA pessoal construído no modelo Muse Spark 1.3, projetado com recursos de segurança para proteger contra ataques de injeção de prompt. O sistema executa cada agente em uma máquina virtual isolada dividida em uma célula de tempo de execução selada e zonas de serviço externo para separar dados não confiáveis das credenciais do usuário.

  • O Muse se conecta a aplicativos como e-mail, navegadores e calendários, permitindo que os usuários definam acesso de leitura ou gravação selecionável por serviço.
  • Um serviço de credenciais fora da célula de tempo de execução processa senhas enquanto o agente usa tokens substitutos, impedindo o roubo de credenciais por injeção de prompt.
  • Um agente externo chamado Sentinel inspeciona as solicitações de saída em relação às permissões do usuário antes de aprovar ações ou substituir pelas credenciais reais.
  • O sistema inclui classificadores para filtrar dados de entrada e um subagente que lê árvores de acessibilidade estruturadas em vez de código bruto da página para evitar instruções ocultas.

A segurança é crítica para sistemas agênticos, pois a injeção de prompt continua sendo uma vulnerabilidade importante; a arquitetura da Meta visa garantir que, mesmo se as defesas iniciais falharem, o agente não possa substituir os componentes de segurança que armazenam os dados do usuário.