Tim Qwen telah memperkenalkan seri Qwen2.5-Coder, serangkaian model bahasa khusus kode baru yang diturunkan dari arsitektur Qwen2.5. Seri ini mencakup enam ukuran model mulai dari 0,5B hingga 32B parameter dan dilatih pada lebih dari 5,5 triliun token kode sumber yang dibersihkan dan data sintetis.

  • Model-model ini mencapai kinerja state-of-the-art di lebih dari 10 benchmark untuk generasi kode, penyelesaian, penalaran, dan perbaikan.
  • Qwen2.5-Coder-32B-Instruct menyamai kemampuan pengkodean GPT-4o sambil mempertahankan keterampilan umum dan matematika yang kuat.
  • Arsitektur ini menyertakan token khusus untuk mendukung operasi Fill-in-the-Middle (FIM) dan manajemen konteks tingkat repositori.
  • Rilis ini mencakup lisensi permisif untuk memfasilitasi adopsi yang lebih luas oleh pengembang.

Para penulis bertujuan untuk memajukan penelitian dalam kecerdasan kode dan mendukung aplikasi dunia nyata melalui model sumber terbuka ini.