O Linda-Pro é uma nova ferramenta local para detectar texto em inglês gerado por IA que combina estilometria com dois modelos DeBERTa ajustados. Ele analisa o texto em janelas de aproximadamente 300 palavras e fornece um mapa de calor por frase para identificar autoria mista.
- No benchmark do Chicago Booth, ele alcança 99,7% de detecção para texto AI puro e 85% após a humanização com StealthGPT a 1% de falsos positivos.
- Ele sinalizou 92,6% dos textos de geradores que os modelos nunca viram durante o treinamento.
- Pontos fracos incluem ensaios do exame TOEFL com 8,8% de falsos positivos (reduzidos para 1,1% no modo preciso), texto humanizado e textos curtos.
Os pesos do modelo estão disponíveis para uso de pesquisa gratuito no Hugging Face, e o código é fornecido no GitHub para avaliação local.