Rilis llama.cpp b10144 menangani masalah kritis pada server dan UI terkait aliran yang dapat dilanjutkan, khususnya memperbaiki penanganan nama model yang mengandung garis miring. Ini juga menyelesaikan bug di mana permintaan tidak dibatalkan atau dilanjutkan dengan benar selama pemuatan model.

  • Memfaktorkan ulang rute aliran yang dapat dilanjutkan untuk menggunakan string kueri `conv_id`, memungkinkan nama model dengan garis miring tetap utuh saat dienkoding dalam mode router.
  • Membatalkan permintaan tertunda ketika alirannya dihentikan selama pemuatan model dengan mendaftarkan percakapan sebelum menunggu muat otomatis.
  • Mengaktifkan lanjutan aliran setelah memuat ulang halaman selama pemuatan model dengan memutuskan permintaan sesi dari soket klien dan mengembalikan 503 untuk upaya coba ulang.
  • Memulihkan visibilitas kemajuan pemuatan model di UI setelah menyegarkan halaman dengan mempertahankan keadaan aliran tertunda.

Perubahan ini memastikan bahwa percakapan tetap tangguh terhadap pemutusan koneksi klien dan masalah pengkodean URL, mencegah permintaan terlantar dan sesi hilang selama fase pemuatan model.