ラボ · Hugging Face
lab Hugging Face Blog · 4時間前 · 1 回表示

Open TTS Leaderboardがスケーラブルな多言語TTS評価を公開

Open TTS Leaderboardは、Text-to-Speech (TTS) 評価における断片化と標準化の欠如に対処するため、遅くアリーナベースの人間による好みスコアに依存するのではなく、客観的な指標を使用してリリースされました。Qwen3 ASRおよびWavLM埋め込みを用いて、明瞭性、速度、話者類似性の各モデルを評価します。

github llama.cpp · 19時間前 · 2 回表示

llama.cpp b11266はIntelのVulkan向けにF32 A行列を一度に2つ読み込む

llama.cppプロジェクトは、Vulkanの最適化を含むビルドb11266をリリースしました。この最適化では、2アラインメントされたF32 A行列を一度に2要素ずつ読み込みます。この変更は、浮動小数点数を一つずつ読み込むのが非効率なIntelハードウェアでのパフォーマンス問題を解決し、元のパッチで`a_offset`の整列に関する検証が欠落していた点も修正します。

media MarkTechPost · 1日前 Android World · 85.1% · 8 回表示

H社がデスクトップ、Web、モバイル向けのHolo4オープンウェイトコンピュータ操作モデルをリリース

H社は、デスクトップ、Web、Android、API環境でクリック、入力、コード記述、ツール呼び出しを行うために設計された汎用コンピュータ操作ビジョン言語モデルのファミリーであるHolo4をリリースした。今回のリリースには2つのモデルサイズが含まれる:Holo4 27B(デンス)とHolo4 35B-A3B(エキスパート混合、アクティブパラメータ3B)。どちらも256Kのコンテキストウィンドウをサポートする。

media r/LocalLLaMA · 1日前 · 3 回表示

IQuestLabがエージェント型コーディング用の320B MoEモデル「IQuest-Q1」をリリース

IQuestは、エージェント型コーディング、推論、マルチステップツール使用のために設計されたMixture-of-Experts (MoE)モデルであるIQuest-Q1をリリースしました。 このモデルは約3200億の総パラメータを持ち、トークンあたり約150億のパラメータが活性化されます。 Hugging Faceで利用可能です。

github llama.cpp · 2日前 · 4 回表示

llama.cpp b11238 が ggml_pad_ext を追加し、左パディングに対応して DFlash2 タップをスキップ

llama.cpp プロジェクトはビルド b11238 をリリースし、新しい `ggml_pad_ext` 関数を通じて統一された左パディング実装を導入しました。この変更により、Parakeet、LFM2-Audio、Granite Speech、Gemma 4 などの音声エンコーダーで以前使用されていた方法が統合され、Gemma 4 の埋め込みがビット単位で同一になることが保証されるとともに、バックエンドのサポートが簡素化されました。

github llama.cpp · 2日前 · 3 回表示

llama.cpp b11228 が Metal GGML_OP_PAD に左側および円形パディングのサポートを追加

llama.cpp b11228 リリースは、Metal バックエンドの GGML_OP_PAD 操作において左側および円形パディングのサポートを導入し、CPU、CUDA、Vulkan の実装と整合させました。この変更により、置換されたソースの右側パディングの問題が修正され、異なるハードウェアバックエンド間で一貫した動作が保証されます。

media Hugging Face Forums · 3日前 · 9 回表示

Claude Opus 5とTetsuが自プロジェクトの6つの空虚なCIチェックを発見

9月27日、Claude Opus 5と3BモデルのTetsuは、パブリックリポジトリにある6つの個別の継続的インテグレーション(CI)チェックを特定した。これらは本来測定すべきものを検証せずにグリーンまたは合格と報告していた。問題は、古いダイジェストのために有効な再起動を拒否するデプロイメントゲートから、無意味なパフォーマンス差を受け入れる空虚な閾値を持つタイミングベンチマークまで多岐にわたった。

github llama.cpp · 3日前 · 13 回表示

llama.cpp b11216が512を超えるブロック幅に対するSYCL FWHTカーネルを追加

llama.cpp b11216リリースでは、512より大きいブロック幅をサポートするSYCLバックエンドにFast Walsh-Hadamard Transform (FWHT) カーネルが導入されました。以前は、より大きな幅はO(n^2)の複雑さを持つ密なGEMMにフォールバックしていましたが、この変更によりこれらのサイズでO(n log n)のパフォーマンスが可能になります。

github llama.cpp · 3日前 · 14 回表示

llama.cpp b11214 が CDNA で大きなバッチサイズ向けに fattn-mma カーネルを有効化

llama.cpp プロジェクトはバージョン b11214 をリリースしました。これには HIP バックエンドへの重要な更新が含まれています。このリリースでは、dkq > 256 の場合、CDNA アーキテクチャ上で fattn-mma カーネルが有効化され、大きなバッチサイズ向けの性能向上を特に狙っています。

github llama.cpp · 4日前 · 10 回表示

llama.cpp b11207 が Hexagon 向けに Q4_0 および Q8_0 GET_ROWS のタイルサポートを追加

llama.cpp プロジェクトはビルド b11207 をリリースし、Hexagon バックエンドで Q4_0 と Q8_0 の GET_ROWS 操作のタイルサポートを導入しました。このアップデートには、マクロ、レジスタスパイル、DMA パイプラインの修正に加え、カーネル選択ロジックの改善とベクトル化の再有効化が含まれています。

github llama.cpp · 4日前 · 16 回表示

llama.cpp b11195がk-quants向けのタイル化mul_matを追加し、3〜6倍の高速化を実現

llama.cppプロジェクトはバージョンb11195をリリースし、CPUバックエンドにおけるk-quants用のタイル化行列乗算実装を導入しました。この変更により、量子化データを256x256のint8タイルに展開し、マイクロカーネルを使用して結果を計算することで、大規模な行列演算のパフォーマンスが向上します。