Z.aiは、743Bベースモデルのpost-trainingに基づいて構築されたコーディングおよびサイバーセキュリティ焦点のモデルであるGLM-5.3をリリースしました。これは新しいpretrainingではなく行われています。リリースにはTerminal Bench 3.0で28.3、DeepSWEで66.9といった特定のベンチマークスコアが含まれています。
AlibabaはQwen3.8-27Bをリリースしました。これはネイティブなマルチモーダル密集モデルで、YaRNを使用して1Mまで拡張可能な262Kのコンテキストを持ち、17GB RAMでのローカル使用用に位置づけられています。一方、CursorはGrokおよび関連製品で作業するためにSpaceXAIに参加すると発表しました。
記事では、オープンウェイトモデルやエージェントランタイムに特化する中国のラボの傾向が最適化のターゲットになっていること、そしてベンダーのベンチマーク主張に対する懐疑論が強調されています。