Linda-Pro est un nouvel outil local pour détecter le texte en anglais généré par l'IA qui combine la stylistométrie avec deux modèles DeBERTa ajustés. Il analyse le texte dans des fenêtres d'environ 300 mots et fournit une carte thermique par phrase pour identifier l'auteur mixte.
- Sur le benchmark de Chicago Booth, il atteint 99,7 % de détection pour le texte AI brut et 85 % après l'humanisation avec StealthGPT à 1 % de faux positifs.
- Il a signalé 92,6 % des textes provenant de générateurs que les modèles n'ont jamais vus pendant l'entraînement.
- Les points faibles incluent les essais d'examen TOEFL avec 8,8 % de faux positifs (réduits à 1,1 % en mode précis), le texte humanisé et les textes courts.
Les poids du modèle sont disponibles pour une utilisation de recherche gratuite sur Hugging Face, et le code est fourni sur GitHub pour l'évaluation locale.