Alibaba telah merilis laporan teknis Qwen2.5, memperkenalkan seri komprehensif model bahasa besar dengan peningkatan signifikan pada tahap pra-pelatihan dan pasca-pelatihan. Pembaruan ini memperluas dataset pra-pelatihan berkualitas tinggi dari 7 triliun menjadi 18 triliun token dan menerapkan penyetelan halus terawasi yang rumit dengan lebih dari 1 juta sampel serta pembelajaran penguatan bertahap.
- Penawaran bobot terbuka mencakup model dasar dan model yang disetel untuk instruksi, dengan versi kuantisasi tersedia.
- Solusi berbayar yang dihosting memiliki dua varian campuran ahli: Qwen2.5-Turbo dan Qwen2.5-Plus.
- Model unggulan Qwen2.5-72B-Instruct mengungguli banyak model terbuka dan berbayar, menunjukkan kinerja kompetitif dibandingkan dengan Llama-3-405B-Instruct.
- Qwen2.5-Turbo dan Qwen2.5-Plus menawarkan efisiensi biaya yang lebih unggul sambil tetap bersaing secara kompetitif terhadap GPT-4o-mini dan GPT-4o secara berurutan.
Peningkatan ini memberikan fondasi kuat untuk akal sehat, pengetahuan ahli, dan kemampuan penalaran, sementara teknik pasca-pelatihan secara signifikan meningkatkan generasi teks panjang, analisis data terstruktur, dan kepatuhan instruksi.