Linda-Pro는 스타일로메트리와 두 개의 파인튜닝된 DeBERTa 모델을 결합하여 AI 생성 영어 텍스트를 감지하는 새로운 로컬 도구입니다. 약 300단어 창에서 텍스트를 분석하고 혼합 저자를 식별하기 위해 문장별 히트맵을 제공합니다.
- 시카고 부스 벤치마크에서 일반 AI 텍스트에 대해 99.7%의 검출률을 달성했으며 StealthGPT 인간화 후 1%의 거짓 양성에서 85%를 달성했습니다.
- 학습 중에 모델이 본 적이 없는 생성기로부터 온 텍스트의 92.6%를 플래그 처리했습니다.
- 약점은 TOEFL 시험 에세이(거짓 양성 8.8%, 정밀 모드에서 1.1%로 감소), 인간화된 텍스트 및 짧은 텍스트입니다.
모델 가중치는 Hugging Face에서 무료 연구용으로 사용할 수 있으며, 로컬 평가를 위한 코드가 GitHub에서 제공됩니다.