O vLLM lançou a versão 0.27.1, uma atualização de correção construída sobre o lançamento anterior v0.27.0.

  • A atualização introduz suporte para cabeças DSpark Markov quantizadas.