Microsoft telah menerbitkan laporan teknis untuk Phi-4, sebuah model bahasa dengan 14 miliar parameter yang mengutamakan kualitas data melalui penggunaan strategis data sintetis selama pelatihan. Berbeda dengan model Phi sebelumnya yang mendistilasi kemampuan dari GPT-4, Phi-4 melampaui gurunya dalam tugas QA berfokus STEM, menunjukkan bahwa teknik generasi data dan pasca-pelatihannya melampaui distilasi sederhana.

  • Model ini menggunakan resep pelatihan yang berfokus pada data sintetis berkualitas tinggi, bukan hanya konten web organik atau kode.
  • Phi-4 secara substansial mengungguli GPT-4 dalam kemampuan menjawab pertanyaan berfokus STEM.
  • Model ini mencapai kinerja yang kuat relatif terhadap ukurannya, terutama pada benchmark berfokus penalaran, berkat peningkatan data, kurikulum pelatihan, dan inovasi pasca-pelatihan.

Laporan tersebut menyoroti bahwa meskipun perubahan arsitektur dari phi-3 sangat minim, fokus pada kualitas data memungkinkan model melampaui kemampuan guru di domain tertentu.