ラボ · MiniMax
github llama.cpp · 20日前 · 19 回表示

llama.cpp b10437 が MiniMax-Text-01 および MiniMax-M1 モデルのサポートを追加

llama.cpp プロジェクトはバージョン b10437 をリリースし、MiniMax-Text-01 および MiniMax-M1 因果言語モデルのネイティブサポートを導入しました。このアップデートには、llama.cpp フレームワーク内でこれらの特定のモデルを実行するために必要な変換スクリプト、チャットテンプレート、およびモデルアーキテクチャの実装が含まれています。

media r/LocalLLaMA · 25日前 · 14 回表示

MiniMaxが同期オーディオ付きのオープンウェイトH3ビデオモデルをリリース

MiniMaxは、テキスト、画像、動画、オーディオを処理できるオープンウェイトのマルチモーダル動画生成モデル「MiniMax H3」をリリースしました。このモデルは、オーディオを後処理ステップとして追加するのではなく、視覚と同期したステレオオーディオ(会話、効果音、環境音、音楽を含む)を同時に生成します。

media r/LocalLLaMA · 25日前 · 19 回表示

MiniMaxがネイティブステレオオーディオ付きのオープンウェイトH3動画生成モデルをリリース

MiniMaxは、Hugging FaceでオープンウェイトのH3オムニモーダル動画生成モデルをリリースしました。このモデルはネイティブステレオオーディオを搭載し、単一フォワードパスで動画を駆動できます。モデルは5〜15秒のクリップに対して2K解像度・24fpsをサポートし、1回の生成あたり最大9枚の参照画像、3本の動画、3つのオーディオクリップを受け入れます。