Rilis llama.cpp b10677 mengatasi bug kritis di backend Vulkan di mana ketergantungan view-alias yang hilang menyebabkan pengoptimal graf salah mengurutkan node.

  • Perbaikan memastikan bahwa `is_src_of` secara benar memperlakukan dua tampilan dari satu tensor sebagai bergantung, mencegah kesalahan diam selama decoding serakah dan decoding spekulatif.
  • Node dengan operasi seperti NONE, RESHAPE, TRANSPOSE, VIEW, atau PERMUTE tidak lagi diperlakukan sebagai ketergantungan aliasing, mengembalikan kebebasan pengoptimal tanpa mengorbankan kebenaran.
  • Kode dikompilasi dengan membuat parameter lambda menjadi const dan menangkap `is_empty` di dalam `is_src_of`, menyelesaikan masalah visibilitas dengan pointer non-const.
  • Perubahan ini secara khusus memperbaiki masalah state berulang untuk model seperti Qwen3.8 pada perangkat keras Vulkan AMD dan NVIDIA, sementara CUDA tetap tidak terpengaruh.

Rilis ini mengatasi isu #27805 dan menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di seluruh CPU, GPU, dan berbagai backend akselerator.