研究者らは、TelecomGPT-R1を発表した。これは、規格、構成、ログに対する推論を通じてエンジニアリングタスクを自動化するために設計された、オープンソースの統一型テレコム推論モデルファミリーである。このモデルは、プロトコル、知識、モデリング、障害の各軸をカバーする構造化アプローチを通じて、既存の汎用および専門的なLLMの制限に対処する。
- 軸認識データ生成フレームワークが、公衆テレコムアーティファクトを104,880件の検証済み質問応答ペアにリファインし、チェーン・オブ・ソート推論を含む。
- 教師あり微調整によりテレコム知識を組み込み、強化学習の冷たいスタートの壁を克服する。
- タスクルーティングされたルブリック報酬を用いた動的サンプリングポリシー最適化(DAPO)が、異種タスクにわたるRL更新を安定化する。
- TelecomGPT-R1-27Bモデルは、7つのGSMA Open Telco Leaderboardベンチマークで89.64%の平均スコアを達成し、GPT-5、Claude、Geminiを上回る。
著者らは、テレコム自動化におけるコミュニティ開発をサポートするために、モデルと再現可能なトレーニングレシピを公開する。