Le projet llama.cpp a publié la compilation b10622, qui inclut une correction critique pour le backend Metal afin d'éviter les plantages par manque de mémoire. La mise à jour traite un problème où le retour de `ggml_metal_buffer_init` à NULL en raison d'une échec d'allocation n'était pas vérifié, entraînant un plantage dur via `EXC_BAD_ACCESS` lors de la déréférencement du pointeur nul.

  • metal : Ajout d'une vérification de null pour les résultats de `ggml_metal_buffer_init` dans `ggml_backend_metal_buffer_type_alloc_buffer` pour gérer gracieusement les conditions OOM.
  • cont : Correction des problèmes de journalisation au sein de la base de code.

Ce changement garantit que les appareils à mémoire limitée comme iOS peuvent afficher des erreurs diagnosables au lieu de planter lorsqu'un modèle ou un contexte dépasse le budget Metal disponible.