Seorang pengguna di forum Hugging Face mengusulkan eksperimen dalam transfer pengetahuan progresif, di mana model siswa berukuran tetap (Qwen 4B) belajar secara berurutan dari model guru yang semakin besar, bukan langsung dari yang terbesar yang tersedia.

  • Proses ini melibatkan model 4B belajar dari Qwen 8B atau 9B, lalu membuang guru tersebut untuk belajar dari Qwen 12B, dan selanjutnya dari Qwen 27B.
  • Pendekatan ini meniru pembelajaran manusia dengan membangun pada pengetahuan yang sebelumnya diperoleh alih-alih mencoba menjembatani kesenjangan kemampuan besar dalam satu langkah.
  • Proposal ini menyarankan penggunaan metode mirip proyek Heretic, menerapkan strategi "cari dan perkuat" untuk mengidentifikasi dan menambahkan kemampuan yang berguna sambil menghindari penemuan kembali sifat-sifat yang sudah dipelajari.
  • Keberhasilan akan diukur apakah model berukuran tetap meningkat secara terukur dan mempertahankan peningkatan sebelumnya, memberikan wawasan tentang kapasitas pengetahuan praktis model kecil.

Penulis menyarankan bahwa metode ini dapat menentukan apakah akumulasi pengetahuan bertahap lebih efektif daripada distilasi langsung dari guru terbesar untuk model kecil.