llama.cpp プロジェクトはビルド b10153 をリリースし、Nanbeige4.2 モデルアーキテクチャのサポートを導入しました。

  • Nanbeige4.2 モデルの読み込みと実行の互換性を追加しました。
  • コードベース内の flake8 リンティングチェックを修正しました。
  • ループ境界チェックを修正し、冗長な head_dim のロジックを削除しました。
  • CPU、CUDA、ROCm、Vulkan、OpenVINO、SYCL およびその他のバックエンド向けに、macOS (Apple Silicon および Intel)、Linux、Windows、Android、iOS 用のバイナリを提供しました。

このアップデートにより、ユーザーは llama.cpp フレームワーク内で Nanbeige4.2 モデルを利用できるとともに、全体的なコード品質の向上からも恩恵を受けます。