El modelo de lenguaje grande propietario de Alibaba Cloud, Qwen2.5-Max, ha alcanzado el puesto #7 general en Chatbot Arena, igualando a otras LLM propietarias destacadas con capacidades excepcionales en dominios técnicos.

  • Ocupa la posición #1 en los benchmarks de matemáticas y programación.
  • El modelo ocupa el puesto #2 en prompts difíciles, que involucran tareas complejas.
  • Como un modelo Mixture of Experts (MoE), fue preentrenado con más de 20 billones de tokens y refinado mediante Fine-Tuning Supervisado y Aprendizaje por Refuerzo con Retroalimentación Humana.
  • Obtuvo las mejores puntuaciones en los principales benchmarks, incluidos MMLU-Pro, LiveCodeBench, LiveBench y Arena-Hard.

Los desarrolladores pueden acceder a Qwen2.5-Max a través del Model Studio de Alibaba Cloud o la plataforma Qwen Chat.