El proyecto llama.cpp lanzó la compilación b10293, que incluye la integración continua de AMD ROCm para la arquitectura gfx1151 y resuelve problemas de corrección en GPUs integradas con RDNA3.5.
- Corrige test-recurrent-state-rollback en gfx1151 permitiendo buffers de salida del host de GPU integrada en aserciones de depuración.
- Restaura la corrección de inferencia en RDNA3.5 habilitando memoria unificada para evitar problemas de coherencia de GPU con pesos cargados mediante mmap.
- Aborda errores de ejecución asíncrona en la ruta HIP utilizando HIP_LAUNCH_BLOCKING=1 para serializar lanzamientos de núcleos.
- Omite pruebas de arquitectura jamba y subpruebas top-k en el backend HIP debido a operaciones no soportadas y salida incorrecta.
Esta actualización permite pruebas e inferencia confiables de modelos llama.cpp en hardware AMD RDNA3.5 a través de ROCm.