Benchmark AA telah diperbarui untuk mencerminkan kinerja terbaru dari model bahasa terdepan. Pembaruan ini mencakup data pengujian segar untuk model tingkat atas.

  • Flash-next dilaporkan unggul dari 3.5 max dalam peringkat baru.
  • Gemini 3.1 pro dicatat sebagai tertinggal signifikan dari pesaing lainnya.

Artikel ini menyoroti pergeseran ini dalam lanskap kompetitif di antara model AI terkemuka.