Alibaba telah merilis laporan teknis Qwen2.5, memperkenalkan seri komprehensif model bahasa besar dengan peningkatan signifikan pada tahap pra-pelatihan dan pasca-pelatihan. Pembaruan ini memperluas dataset pra-pelatihan berkualitas tinggi dari 7 triliun menjadi 18 triliun token dan menerapkan penyetelan halus terawasi yang rumit dengan lebih dari 1 juta sampel serta pembelajaran penguatan bertahap.

  • Penawaran bobot terbuka mencakup model dasar dan model yang disetel untuk instruksi, dengan versi kuantisasi tersedia.
  • Solusi berbayar yang dihosting memiliki dua varian campuran ahli: Qwen2.5-Turbo dan Qwen2.5-Plus.
  • Model unggulan Qwen2.5-72B-Instruct mengungguli banyak model terbuka dan berbayar, menunjukkan kinerja kompetitif dibandingkan dengan Llama-3-405B-Instruct.
  • Qwen2.5-Turbo dan Qwen2.5-Plus menawarkan efisiensi biaya yang lebih unggul sambil tetap bersaing secara kompetitif terhadap GPT-4o-mini dan GPT-4o secara berurutan.

Peningkatan ini memberikan fondasi kuat untuk akal sehat, pengetahuan ahli, dan kemampuan penalaran, sementara teknik pasca-pelatihan secara signifikan meningkatkan generasi teks panjang, analisis data terstruktur, dan kepatuhan instruksi.