Le projet vLLM a publié la version 0.29.0, qui inclut une correction de bug principale concernant le cache de préfixe dense.

  • La mise à jour applique le paramètre par défaut du cache de préfixe dense spécifiquement aux modèles hybrides.