Benchmark AA telah diperbarui untuk mencerminkan kinerja terbaru dari model bahasa terdepan. Pembaruan ini mencakup data pengujian segar untuk model tingkat atas.
- Flash-next dilaporkan unggul dari 3.5 max dalam peringkat baru.
- Gemini 3.1 pro dicatat sebagai tertinggal signifikan dari pesaing lainnya.
Artikel ini menyoroti pergeseran ini dalam lanskap kompetitif di antara model AI terkemuka.