O projeto llama.cpp lançou a versão b11104, introduzindo um novo recurso que permite ao componente llama-server se vincular a múltiplos endereços de rede simultaneamente.

  • O servidor agora suporta vinculação a múltiplos endereços por meio do pull request #28690.
  • A atualização inclui limpeza de código, como a remoção de manipuladores de threads redundantes e a melhoria do tratamento de argumentos.
  • Binários pré-compilados estão disponíveis para macOS (Apple Silicon e Intel), Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android e a interface do llama.cpp.

Este lançamento fornece aos usuários capacidades de servidor atualizadas para configuração de rede junto com o suporte padrão de plataformas.