ソース · llama.cpp
github llama.cpp · 3時間前

llama.cpp b10437 が MiniMax-Text-01 および MiniMax-M1 モデルのサポートを追加

llama.cpp プロジェクトはバージョン b10437 をリリースし、MiniMax-Text-01 および MiniMax-M1 因果言語モデルのネイティブサポートを導入しました。このアップデートには、llama.cpp フレームワーク内でこれらの特定のモデルを実行するために必要な変換スクリプト、チャットテンプレート、およびモデルアーキテクチャの実装が含まれています。

github llama.cpp · 2日前 · 1 回表示

llama.cpp b10412 が dflash および dspark のバックエンドサンプリングを有効化

llama.cpp プロジェクトはバージョン b10412 をリリースし、dflash と dspark の両バックエンドに対してバックエンドサンプリングのサポートを導入しました。このアップデートでは、バックエンドサンプリングロジック内で p_min が 0 より大きい値を許可し、対応する保護措置も追加されました。

github llama.cpp · 2日前 · 8 回表示

llama.cpp b10408がQ3_K ESIMDカーネルを追加し、制御をランタイムに移行

llama.cppプロジェクトはバージョンb10408をリリースし、Intel GPU用のDMMV Q3_K ESIMDカーネルを導入しました。このリリースには、新しいQ4_KおよびQ6_K ESIMDカーネルも含まれており、ESIMDの制御をコンパイル時ではなくランタイムで可能にするためにコードベースがリファクタリングされました。

github llama.cpp · 4日前 · 4 回表示

llama.cpp b10356がROCmを7.14に更新し、Windows CUDA 13のサポートを追加

llama.cppプロジェクトはバージョンb10356をリリースしました。これは主にビルドインフラストラクチャを対象としており、ROCmバックエンドをバージョン7.2.1から7.14へ切り替えています。この更新は、TheRockビルドシステムを使用する初の製品版リリースであるROCm 7.14に整合性を取るものであり、LinuxとWindowsの両方でマルチアーキテクチャホイールを使用するようにCIジョブを移行することを含みます。

github llama.cpp · 4日前 · 5 回表示

llama.cpp b10355がトークン推測付きのマルチ出力バックエンドサンプリングを追加

llama.cppプロジェクトはバージョンb10355をリリースし、マルチ出力バックエンドサンプリングのサポートを導入しました。このアップデートにより、バックエンドサンプリングとトークン推測を組み合わせて有効にし、シーケンスあたりの最大出力数を宣言するための数値コンテキストパラメータが追加されました。