O projeto llama.cpp lançou a compilação b10326, que modifica como as medições de tempo são calculadas ao incluir a passagem do vocoder.

  • A atualização garante que `get_output` execute o trabalho de forma de onda adiado pelo pipeline, medindo-o desde uma única janela final até uma passagem completa, dependendo do modelo.
  • Esta alteração mantém a precisão do tempo total relatado e da relação de áudio para processamento.
  • Os binários estão disponíveis para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) e openEuler.

A modificação melhora a precisão das métricas de desempenho ao garantir que os custos de processamento de áudio sejam corretamente contabilizados nos tempos relatados.