El proyecto vLLM lanzó la versión 0.29.0, que incluye una corrección de error central respecto al caché de prefijos denso.

  • La actualización aplica la configuración predeterminada del caché de prefijos denso específicamente a modelos híbridos.