Le projet llama.cpp a publié la compilation b10293, qui inclut l'intégration continue AMD ROCm pour l'architecture gfx1151 et résout les problèmes de correction sur les GPU intégrés RDNA3.5.
- Corrige test-recurrent-state-rollback sur gfx1151 en autorisant les tampons de sortie hôte du GPU intégré dans les assertions de débogage.
- Restaure la correction de l'inférence sur RDNA3.5 en activant la mémoire unifiée pour contourner les problèmes de cohérence du GPU avec les poids chargés via mmap.
- Traite les erreurs d'exécution asynchrone dans le chemin HIP en utilisant HIP_LAUNCH_BLOCKING=1 pour sérialiser les lancements de noyaux.
- Ignore les tests de l'architecture jamba et les sous-tests top-k sur le backend HIP en raison d'opérations non prises en charge et d'une sortie incorrecte.
Cette mise à jour permet des tests et une inférence fiables des modèles llama.cpp sur le matériel AMD RDNA3.5 via ROCm.