El benchmark AA se ha actualizado para reflejar el último rendimiento de los modelos de lenguaje de vanguardia. La actualización incluye datos de prueba frescos para modelos de primera categoría.

  • Se informa que Flash-next supera a 3.5 max en los nuevos rankings.
  • Gemini 3.1 pro se señala como estando significativamente detrás de otros contendientes.

El artículo destaca estos cambios en el panorama competitivo entre los principales modelos de IA.