Linda-Pro es una nueva herramienta local para detectar texto en inglés generado por IA que combina estilometría con dos modelos DeBERTa ajustados. Analiza el texto en ventanas de aproximadamente 300 palabras y proporciona un mapa de calor por oración para identificar autoría mixta.
- En la prueba Chicago Booth, logra una detección del 99,7% para texto AI puro y del 85% después de la humanización con StealthGPT al 1% de falsos positivos.
- Marcó el 92,6% de los textos de generadores que los modelos nunca vieron durante el entrenamiento.
- Los puntos débiles incluyen ensayos del examen TOEFL con un 8,8% de falsos positivos (reducidos al 1,1% en modo preciso), texto humanizado y textos cortos.
Los pesos del modelo están disponibles para uso de investigación gratuito en Hugging Face, y el código se proporciona en GitHub para evaluación local.