Meta推出了基于Muse Spark 1.3模型构建的个人AI代理Muse,该代理设计了安全功能以抵御提示注入攻击。该系统在隔离的虚拟机中运行每个代理,将其划分为密封的运行时单元和外部服务区域,以将不受信任的数据与用户凭据分离。
- Muse连接电子邮件、浏览器和日历等应用,允许用户为每项服务设置可选的读取或写入访问权限。
- 位于运行时单元外部的凭据服务处理密码,而代理使用占位令牌,从而防止通过提示注入窃取凭据。
- 名为Sentinel的外部代理在批准操作或替换真实凭据之前,会根据用户权限检查出站请求。
- 该系统包括用于筛选传入数据的分类器,以及一个读取结构化无障碍树而非原始页面代码以避免隐藏指令的子代理。
安全性对于代理系统至关重要,因为提示注入仍然是一个主要漏洞;Meta的架构旨在确保即使初始防御失败,代理也无法覆盖持有用户数据的安全组件。