DeepSeekはHugging FaceにDeepSeek-V4-Flash-Vision-Expモデルのチェックポイントを公開しました。 リポジトリは現在、一般公開されています。
DeepSeekがHugging FaceにDeepSeek-V4-Flash-Vision-Expをリリース
Thinking MachinesがInklingをリリース、TencentがHy3をApache 2.0ライセンスで更新
最新のオープンモデル成果物のまとめでは、Thinking MachinesとTencentによる重要なリリース、およびPoolsideとDeepSeekのアップデートが注目されています。
Thinking Machines Labがオープンウェイトのインクリング基盤モデルをリリース
Thinking Machines Labは、Inklingをローンチしました。これは同社が初めて完全に公開したオープンウェイトの基盤モデルファミリーです。ベンチマーク最大値を誇るフラッグシップではなく、カスタマイズ可能なマルチモーダルベースモデルとして位置づけられ、Inklingはネイティブなマルチモーダリティでテキスト、画像、音声の入力をサポートします。
アリババのQwenチームがQwen3.8-Flash-Nextをリリース、Qwen4のプレビュー
アリババのQwenチームは、今後のQwen4シリーズのアーキテクチャをプレビューするために設計されたオープンウェイトのマルチモーダルMixture-of-ExpertsモデルであるQwen3.8-Flash-Nextをリリースしました。このチェックポイントは、125Bのバックボーンと51BのN-gram埋め込みテーブル、および4Bのマルチトークン予測モジュールを組み合わせており、トークンごとに6Bのパラメータのみがアクティブになります。
智譜AIがマルチモーダルなオープンウェイトモデルGLM-5.3-Flashをリリース
智譜AIは、GLM-5シリーズで初めてネイティブにマルチモーダルに対応したモデルであるGLM-5.3-Flashと、glm5_nextアーキテクチャの初のオープンウェイトリリースを発表しました。320Bパラメータのモデルは、30Tトークンのマルチモーダルコーパスで学習され、長いコンテキストの推論コストを削減するために、ハイブリッドなスパース注意機構と線形注意機構を組み合わせています。
智譜が320Bパラメータのマルチモーダルモデル「GLM-5.3-Flash」をリリース
智譜は、GLM-5シリーズ初のネイティブマルチモーダルモデルであるGLM-5.3-Flashを発表しました。このモデルは、スパースアテンションと線形アテンションを組み合わせたハイブリッドアーキテクチャを採用し、精度を維持しつつ長文脈の推論コストを削減します。