Le projet llama.cpp a publié la version b10906, qui comprend une correction pour le composant serveur concernant le décodage spéculatif après des entrées d'image. Le changement garantit que la position réelle est transmise au rédacteur au lieu du nombre de tokens, affectant tous les rédacteurs et non seulement DFlash.
- Renommé le paramètre de brouillon `n_past` en `pos0` pour refléter avec précision son rôle d'indicateur de position plutôt que de compteur de tokens.
- Fourni des binaires précompilés pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA, OpenCL, Vulkan, OpenVINO, SYCL, ROCm) et openEuler.
Cette mise à jour corrige une incohérence dans le nom du paramètre et assure un traitement correct de la position dans la logique de décodage spéculatif du serveur.