llama.cpp プロジェクトはビルド b11238 をリリースし、新しい `ggml_pad_ext` 関数を通じて統一された左パディング実装を導入しました。この変更により、Parakeet、LFM2-Audio、Granite Speech、Gemma 4 などの音声エンコーダーで以前使用されていた方法が統合され、Gemma 4 の埋め込みがビット単位で同一になることが保証されるとともに、バックエンドのサポートが簡素化されました。
- `ggml_pad_ext` ノードは、すべてのバックエンドがこれをサポートするようになったため、左パディングを単一操作で処理し、複雑なロールやゼロ埋め結合ロジックに取って代わりました。
- この更新には、ブロックサイズ以上またはその位置にある項がゼロであるため、パディングデータのみを読み取る DFlash2 タップをスキップする最適化が含まれています。
- macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL、Snapdragon)、Android、Windows、openEuler 用のビルド済みバイナリが利用可能です。
このリリースは、パディング操作を標準化することで異なるモデルアーキテクチャ間の一貫性を向上させ、幅広いハードウェアプラットフォーム向けの更新されたバイナリを提供します。