Linda-Pro — это новый локальный инструмент для обнаружения текста, сгенерированного ИИ, на английском языке, который сочетает стилометрию с двумя дообученными моделями DeBERTa. Он анализирует текст в окнах примерно по 300 слов и предоставляет тепловую карту по предложениям для выявления смешанного авторства.

  • На бенчмарке Chicago Booth он достигает 99,7% обнаружения для обычного ИИ-текста и 85% после обработки StealthGPT для имитации человека при уровне ложных срабатываний 1%.
  • Он пометил 92,6% текстов от генераторов, которые модели никогда не видели во время обучения.
  • Слабые места включают эссе экзамена TOEFL с 8,8% ложных срабатываний (снижено до 1,1% в точном режиме), обработанный текст и короткие тексты.

Веса модели доступны для бесплатного исследовательского использования на Hugging Face, а код предоставлен на GitHub для локальной оценки.