O projeto llama.cpp lançou a compilação b10622, que inclui uma correção crítica para o backend do Metal para evitar falhas por falta de memória. A atualização aborda um problema onde `ggml_metal_buffer_init` retornando NULL devido a uma falha de alocação não era verificado, levando a uma falha grave via `EXC_BAD_ACCESS` ao dereferenciar o ponteiro nulo.
- metal: Adicionada uma verificação de nulo para os resultados de `ggml_metal_buffer_init` em `ggml_backend_metal_buffer_type_alloc_buffer` para lidar com condições OOM de forma graciosa.
- cont: Corrigidos problemas de log dentro da base de código.
Esta alteração garante que dispositivos com memória limitada, como o iOS, possam exibir erros diagnosticáveis em vez de falhar quando um modelo ou contexto excede o orçamento disponível do Metal.