Fonte · Simon Willison
blog Simon Willison · há 2 d · 10 visualizações

Pesquisadores roubam rastros de raciocínio de APIs de LLM proprietárias por meio de ataques de replay

Um artigo demonstra que blocos de cadeia de pensamento criptografados retornados pela Anthropic, OpenAI e Google podem ser extraídos em texto simples. Os autores exploraram uma vulnerabilidade onde modelos dentro da mesma família compartilhavam chaves de criptografia, permitindo que eles retransmitissem os rastros para modelos irmãos mais fracos.