Z.AIは水曜日に、Ox AlphaモデルがそのGLMシリーズの新しい反復であることを確認しました。同社はBloomberg Newsの問い合わせに応じ、その夜遅くにモデルの重みを公開すると述べました。
media
r/LocalLLaMA
·
1時間前
·
open_models
Z.AIはOx AlphaがGLMシリーズの新しいモデルであることを確認し、重みを公開
翻訳元 English → 日本語
関連記事
media
Interconnects
·
12日前
·
10 回表示
Z.aiが拡張されたポストトレーニング付きGLM-5.3をリリース
Z.aiは、ベースモデルGLM-5.2のポストトレーニングを拡張することで、エージェント型コーディングベンチマークで最先端のパフォーマンスを達成する新モデルGLM-5.3を発表しました。約750Bパラメータを持つこのモデルは、現在Kimi K3を上回り、Claude Fable 5およびGPT-5.6-Solと同等かそれ以上の性能を各種ベンチマークで示しています。
media
MarkTechPost
·
38日前
·
19 回表示
ベンチマーク、ライセンス、推論コストで比較されるKimi K3、DeepSeek V4 Pro、GLM-5.2
Moonshot AIのKimi K3、DeepSeek V4 Pro、Zhipu AIのGLM-5.2という3つのオープンウェイトなスパースMixture-of-Expertsモデルの比較は、長期のコーディングおよびエージェントワークロードにおけるその能力、ライセンス条項、推論コストを評価するものである。
media
r/LocalLLaMA
·
1時間前
ライブ
Z.AIはOx AlphaがGLMモデルであることを確認し、重みの公開を計画
Z.AIは、最近話題になっている「Ox Alpha」モデルが自社のGLMファミリーの一部であることを確認しました。同社はまた、モデルの重みを公にリリースする意向も発表しました。
media
Together AI Blog
·
4日前
·
13 回表示
GLM-5.3はDeepSWEにおいてClaude Fable 5の精度を第五のコストで達成
DeepSWEベンチマークにおけるGLM-5.3とClaude Fable 5の比較により、両モデルがほぼ同一のファーストショット精度(69.0%対69.7%)を達成している一方で、GLM-5.3は大幅にコスト効率が良く、複数試行シナリオでもより優れたパフォーマンスを示すことが明らかになった。
media
Together AI Blog
·
4日前
·
15 回表示
GLM-5.3とGPT-5.6 Solの連鎖的解決によりDeepSWEタスクの85.9%を$6.61で解決
DeepSWEベンチマークにおけるGLM-5.3とGPT-5.6 Solの比較分析により、カスケードルーティング戦略が単独で使用されるいずれかのモデルを上回ることを示した。まずGLM-5.3を実行し、テスト失敗時のみGPT-5.6 Solにエスカレーションすることで、システムはタスクあたり$6.61で85.9%のタスクを解決する。