Исследователи представляют TelecomGPT-R1, семейство открытых унифицированных моделей рассуждений для телекоммуникаций, предназначенных для автоматизации инженерных задач путем анализа стандартов, конфигураций и журналов. Модель решает ограничения существующих универсальных и специализированных LLM посредством структурированного подхода, охватывающего протоколы, знания, моделирование и устранение неисправностей.

  • Осведомленная об осях система генерации данных преобразует общедоступные телекоммуникационные артефакты в 104 880 проверенных пар вопрос-ответ с рассуждениями цепочки мыслей (chain-of-thought).
  • Контролируемое тонкое настраивание (SFT) внедряет телекоммуникационные знания для преодоления барьера холодного старта при обучении с подкреплением.
  • Оптимизация политики динамической выборки (DAPO) с наградами по рубрикам, маршрутизированным по задачам, стабилизирует обновления RL в гетерогенных задачах.
  • Модель TelecomGPT-R1-27B достигает среднего балла 89,64% на семи бенчмарках GSMA Open Telco Leaderboard, превосходя GPT-5, Claude и Gemini.

Авторы публикуют модели и воспроизводимый рецепт обучения для поддержки развития сообщества в области телекоммуникационной автоматизации.