Benchmark · general
SimpleQA
OpenAI's short-form factuality benchmark; accuracy in %.
| Data | Modelo | Pontuação | Fonte |
|---|---|---|---|
| 2026-08-03 | Inkling-Small | 20.6% | Thinking Machines Lab lança Inkling-Small, um modelo MoE multimodal de pesos abertos com 276B |
| 2025-04-15 | Gemini 2.0 Flash | 29.9% | Google lança Gemini 2.0 Flash com qualidade aprimorada e o dobro da velocidade do Gemini 1.5 Pro |
| 2025-03-05 | GPT-4.5 | 62.5% | OpenAI lança GPT-4.5, seu maior modelo, para o ChatGPT Plus |
| 2024-10-30 | GPT-4o | 38.2% | OpenAI |