연구는 분해 공격을 차단하기 위해 상태 기반 방어에 의존하는 대규모 언어 모델 서비스가 공격자가 연결 불가능한 신원과 재시도 메커니즘을 사용할 때 여전히 취약함을 보여줍니다. 연구는 양호한 요청에 대한 신뢰할 수 있는 그룹화 신호가 없으면 피드백이 공격자가 어떤 쿼리가 통과하는지 학습할 수 있게 함으로써 보안-유틸리티 트레이드오프가 붕괴됨을 증명합니다.

91개의 실행 가능한 작업과 11,393개의 능력 매칭된 양호한 요청에 대한 실험은 테스트된 모든 10가지 정책이 엄격한 제한 하에서 공격을 차단하지 못하거나 거부 예산을 초과했음을 보여줍니다.

방어 미시작 작업 계열에서 한 번의 시도 후 최소 99%, 두 번의 시도 후 100%의 공격 성공률에 도달했으며, 이는 효과적인 방어를 위해서는 신원 연결 또는 신규 신원에 대한 비용과 같은 추가 그룹화 증거가 필요함을 나타냅니다.