Open weights
media MarkTechPost · 1日前 · 1 回表示

Mistral AIがポリシー適応型マルチモーダル安全分類器「Shieldstral 1.0 3B」をリリース

Mistral AIは、コンテンツモデレーションを固定された危害カテゴリに依存するのではなく、単なるyes/noの質問として扱うオープンウェイトモデル「Shieldstral 1.0 3B」をリリースしました。PixtralビジョンエンコーダとMinistral-3-3B-Base-2512を基盤として構築されており、再学習なしで推論時にプレーンな言語プロンプトを通じてポリシーを定義できます。

media MarkTechPost · 1日前

NVIDIAがAIエージェント構築用のオブジェクト指向Pythonフレームワーク「NOOA」をリリース

NVIDIA Labsは、モデル非依存のPythonフレームワークであるNOOA(NVIDIA Object-Oriented Agents)をオープンソース化しました。このフレームワークは、エージェント開発を単一のPythonクラスに集約します。このアプローチは、プロンプトテンプレートやワークフローグラフを含む断片化したワークフローに取って代わり、メソッドをアクションに、フィールドを状態に、docstringsをプロンプトに、型注釈を強制された契約にマッピングします。

media TLDR AI · 2日前 · 2 回表示

GoogleがWeatherNextモデルをオープンソース化;Metaがクロスモーダルシナジーを探求

Googleは、サイクロンの予測精度を向上させるため、WeatherNext 2およびWeatherNext Cyclones AIモデルのソースコードを公開しました。これらのモデルは、経路、強度、風構造の予測においてstate-of-the-artな結果を実現し、現在の手法と比較して予報士に平均で1日分の予測精度を追加で提供します。

media The Batch · 2日前 Code Arena (Elo) · 1577.0Elo · 1 回表示

DeepSeekがV4-Flash-0731をリリース、低コストでV4-Proを上回る性能

DeepSeekは、より小型の「Flash」モデルの更新版であるDeepSeek-V4-Flash-0731をリリースしました。このモデルは、独立したベンチマークにおいてより大規模なDeepSeek-V4-Proを上回る性能を示しています。今回のリリースでは、元のMixture-of-Expertsアーキテクチャ(総パラメータ数2840億)を維持しつつ、新しいファインチューニングプロセスを採用しています。

media MarkTechPost · 2日前 · 1 回表示

Liquid AIがオンデバイス用エージェントモデル「LFM2.5-2.6B」をオープンウェイトで公開

Liquid AIは、スマートフォン、ノートPC、ロボットなどのローカルデバイス上で完全に動作するように設計された26億9000万パラメータのモデル「LFM2.5-2.6B」をリリースした。このモデルは131,072トークンのコンテキストウィンドウを持ち、約34兆トークンで事前学習されている。

media Hugging Face Forums · 3日前 · 1 回表示

QuantCheck、4ビット量子化において最終チェックポイントが最適であると仮定しないよう警告

QuantCheckという新しいツールは、プレトレーニングの最終チェックポイントが4ビット量子化にとって最適な選択ではない可能性があると強調しています。ベンチマークが平坦なままであっても、脆弱性が増加する可能性があります。著者はPythia-160mでこのパターンを観察し、最終チェックポイントは同等の品質を持つ早期チェックポイントと比較して約4倍の品質ダメージを受けたことを示しました。

media MarkTechPost · 4日前 · 1 回表示

NVIDIA、自律運転向け34BオープンVLAモデル「Alpamayo 2 Super」をリリース

NVIDIAは、OpenMDW-1.1ライセンスの下で、ロボタクシーや自律運転用に設計された340億パラメータのビジョン・ランゲージ・アクション(VLA)モデルであるAlpamayo 2 Superをリリースしました。このモデルは、32BのCosmos 3 Super Reasonerバックボーンと2.3Bの拡散ベースのアクションデコーダを組み合わせてマルチカメラ映像から軌道、因果説明、メタアクションを生成することで、ロングテール事象に対応します。

media AI News (smol.ai) · 4日前 Terminal-Bench 2 · 67.4% · 8 回表示

アリババ、2.4TパラメータのQwen3.8-Maxを発表し、間もなくオープンウェイトを公開

アリババは、新しいフラッグシップモデルとしてQwen3.8-Maxを発表し、これは長期のエージェントワーク、コーディング、マルチモーダル推論に焦点を当てた2.4Tパラメータのスパースアーキテクチャであると説明した。同社は、Qwen3.8-Maxのオープンウェイトが、オープンウェイト版のQwen3.8-27Bとともに来週公開されると確認した。

lab Liquid AI · 5日前 · 5 回表示

LFM2.5-2.6Bがオンデバイス対応のエージェント型モデルをリリース、ローカル推論を無料提供

著者らは、計画、ツール呼び出し、マルチステップタスクのために完全にオンデバイスで実行できるように設計された26億パラメータのエージェント型モデルLFM2.5-2.6Bをリリースしました。このモデルはスマートフォン上で動作するに十分な小ささであり、CPU上でも応答性を維持できるほど高速で、クラウドAPIへの依存なしに無料の推論、低レイテンシ、プライバシーを実現します。

lab Mistral AI News · 5日前 · 3 回表示

Shieldstralがポリシー適応型3Bマルチモーダル安全分類器を導入

Shieldstralは、コンテンツモデレーションをポリシー適応型の質問応答タスクとして位置づける3Bのオープンウェイト・マルチモーダル安全分類器であり、再学習なしで推論時に自然言語によるポリシーを受け入れることができる。テキストと画像の安全評価を統一し、多様なベンチマークで補正された安全スコアを提供しながら、単一の16GB NVIDIA GPU上で効率的に動作する。

media Latent Space · 5日前 · 2 回表示

アリババ、来週公開ウェイト付きの2.4Tパラメータモデル「Qwen 3.8 Max」を発表

アリババのQwenチームは、コーディング、長期ホライゾンのエージェント作業、マルチモーダル推論に焦点を当てた新しい2.4Tパラメータのフラッグシップモデル「Qwen 3.8 Max」を発表した。同社は、Qwen 3.8 Maxと小規模なQwen 3.8-27Bの両方のオープンウェイト版が来週リリースされることを確認した。