Le projet llama.cpp a publié la build b10691, qui résout un problème critique de stabilité dans le backend Metal. La mise à jour résout spécifiquement un crash de null-pipeline survenant lors des opérations de multiplication de sources F16.

  • Corrige le crash null-pipeline pour les opérations mul_mat et mul_mat_id avec src1 F16.
  • Implémente un comportement fail-closed pour les formes mul_mat dépourvues de kernels F16.
  • Ajoute une logique d'abort pour les pipelines nil dans encoder_set_pipeline.
  • Partage le dispatch de mul_mat mm avec supports_op pour améliorer la cohérence du code.

Cette version fournit des binaires pour macOS, iOS, Linux, Windows, Android et openEuler via CPU, GPU et backends matériels spécialisés incluant CUDA, ROCm, Vulkan et OpenVINO.