Penulis merilis Dev-4B, model lokal kecil berbasis Qwen3-4B-Instruct yang menjawab pertanyaan ketik tentang dokumen dengan kepercayaan terkalibrasi. Ini menggunakan router bawaan untuk memutuskan apakah akan memberikan jawaban cepat atau beralih ke penalaran langkah demi langkah hanya ketika prediksi awal kemungkinan salah.

  • Dievaluasi pada 7.100 pertanyaan uji beku, Dev-4B mencapai akurasi 81,8% dalam 1,37 detik per pertanyaan.
  • Ini melampaui jawaban selalu cepat (76,3%, 0,16 s/pertanyaan) dan pendekatan selalu bernalar (78,0%, 10,2 s/pertanyaan).
  • Model ini menggunakan adapter LoRA yang diaktifkan untuk pertanyaan dan router kecil, dengan build MLX 8-bit tersedia.

Alat ini dirancang untuk eksperimen kalibrasi lokal dan pengalihan offline, khususnya untuk pengembang indie Mac.