O projeto llama.cpp lançou a versão b11053, que inclui uma melhoria específica nas mensagens de log de inicialização do servidor. Esta alteração aumenta a visibilidade sobre como os modelos são carregados, substituindo marcadores criptográficos por tags de origem explícitas.

  • O servidor agora exibe uma tag [source] indicando se um modelo vem de preset, models_dir ou cache.
  • A entrada de log 'Loaded cached model presets' agora mostra o caminho do cache do Hugging Face Hub.
  • Uma função de acesso público hf_cache::get_cache_dir() foi adicionada para suportar essas melhorias de log.

Essas atualizações ajudam os usuários a verificar a origem dos modelos carregados e depurar problemas de configuração mais facilmente.