Model bahasa besar milik Alibaba Cloud, Qwen2.5-Max, telah mencapai peringkat #7 secara keseluruhan di Chatbot Arena, menyamai LLM eksklusif terkemuka lainnya dengan kemampuan luar biasa di domain teknis.
- Ia memegang posisi #1 dalam benchmark matematika dan pemrograman.
- Model ini menempati peringkat #2 dalam prompt sulit, yang melibatkan tugas-tugas kompleks.
- Sebagai model Mixture of Experts (MoE), model ini dipra-latih pada lebih dari 20 triliun token dan disempurnakan melalui Fine-Tuning Terawasi dan Pembelajaran Penguatan dari Umpan Balik Manusia.
- Model ini meraih skor terdepan di benchmark utama termasuk MMLU-Pro, LiveCodeBench, LiveBench, dan Arena-Hard.
Pengembang dapat mengakses Qwen2.5-Max melalui Model Studio Alibaba Cloud atau platform Qwen Chat.