Meta는 Muse Spark 1.3 모델을 기반으로 구축된 개인용 AI 에이전트인 Muse를 소개했으며, 이는 프롬프트 인젝션 공격으로부터 보호하기 위한 보안 기능을 갖추고 있습니다. 이 시스템은 신뢰할 수 없는 데이터와 사용자 자격 증명을 분리하기 위해 밀봉된 런타임 셀과 외부 서비스 영역으로 나뉜 격리된 가상 머신에서 각 에이전트를 실행합니다.

  • Muse는 이메일, 브라우저, 캘린더 등 앱에 연결하여 사용자가 각 서비스에 대해 선택 가능한 읽기 또는 쓰기 접근 권한을 설정할 수 있도록 합니다.
  • 런타임 셀 외부의 자격 증명 서비스는 비밀번호를 처리하는 동안 에이전트는 대리 토큰을 사용하여 프롬프트 인젝션을 통한 자격 증명 도난을 방지합니다.
  • Sentinel이라는 외부 에이전트는 작업을 승인하거나 실제 자격 증명으로 교체하기 전에 사용자 권한에 따라 아웃바운드 요청을 검사합니다.
  • 시스템에는 들어오는 데이터를 선별하는 분류자와 원시 페이지 코드가 아닌 구조화된 접근성 트리를 읽는 서브 에이전트가 포함되어 숨겨진 명령을 피합니다.

프롬프트 인젝션이 여전히 주요 취약점이므로 보안은 에이전트 시스템에서 매우 중요합니다. Meta의 아키텍처는 초기 방어선이 실패하더라도 에이전트가 사용자 데이터를 보유하는 보안 구성 요소를 재정의할 수 없도록 보장하는 것을 목표로 합니다.