Linda-Pro — это новый локальный инструмент для обнаружения текста, сгенерированного ИИ, на английском языке, который сочетает стилометрию с двумя дообученными моделями DeBERTa. Он анализирует текст в окнах примерно по 300 слов и предоставляет тепловую карту по предложениям для выявления смешанного авторства.
- На бенчмарке Chicago Booth он достигает 99,7% обнаружения для обычного ИИ-текста и 85% после обработки StealthGPT для имитации человека при уровне ложных срабатываний 1%.
- Он пометил 92,6% текстов от генераторов, которые модели никогда не видели во время обучения.
- Слабые места включают эссе экзамена TOEFL с 8,8% ложных срабатываний (снижено до 1,1% в точном режиме), обработанный текст и короткие тексты.
Веса модели доступны для бесплатного исследовательского использования на Hugging Face, а код предоставлен на GitHub для локальной оценки.