Proyek llama.cpp merilis build b10293, yang mencakup onboarding integrasi berkelanjutan AMD ROCm untuk arsitektur gfx1151 dan menyelesaikan masalah kebenaran pada GPU terintegrasi RDNA3.5.
- Memperbaiki test-recurrent-state-rollback pada gfx1151 dengan mengizinkan buffer output host GPU terintegrasi dalam assert debug.
- Memulihkan kebenaran inferensi pada RDNA3.5 dengan mengaktifkan memori terpadu untuk mengatasi masalah koherensi GPU dengan bobot yang dimuat melalui mmap.
- Menangani kesalahan eksekusi asinkron di jalur HIP dengan menggunakan HIP_LAUNCH_BLOCKING=1 untuk serialisasi peluncuran kernel.
- Melewati tes arsitektur jamba dan subtes top-k di backend HIP karena operasi yang tidak didukung dan output yang salah.
Pembaruan ini memungkinkan pengujian dan inferensi model llama.cpp yang andal pada perangkat keras AMD RDNA3.5 melalui ROCm.