Proyek llama.cpp merilis build b10293, yang mencakup onboarding integrasi berkelanjutan AMD ROCm untuk arsitektur gfx1151 dan menyelesaikan masalah kebenaran pada GPU terintegrasi RDNA3.5.

  • Memperbaiki test-recurrent-state-rollback pada gfx1151 dengan mengizinkan buffer output host GPU terintegrasi dalam assert debug.
  • Memulihkan kebenaran inferensi pada RDNA3.5 dengan mengaktifkan memori terpadu untuk mengatasi masalah koherensi GPU dengan bobot yang dimuat melalui mmap.
  • Menangani kesalahan eksekusi asinkron di jalur HIP dengan menggunakan HIP_LAUNCH_BLOCKING=1 untuk serialisasi peluncuran kernel.
  • Melewati tes arsitektur jamba dan subtes top-k di backend HIP karena operasi yang tidak didukung dan output yang salah.

Pembaruan ini memungkinkan pengujian dan inferensi model llama.cpp yang andal pada perangkat keras AMD RDNA3.5 melalui ROCm.