Benchmark · general
SimpleQA
OpenAI's short-form factuality benchmark; accuracy in %.
| Date | Modèle | Score | Source |
|---|---|---|---|
| 2026-08-03 | Inkling-Small | 20.6% | Thinking Machines Lab publie Inkling-Small, un modèle MoE multimodal à poids ouverts de 276B |
| 2025-04-15 | Gemini 2.0 Flash | 29.9% | Google lance Gemini 2.0 Flash avec une qualité améliorée et deux fois la vitesse de Gemini 1.5 Pro |
| 2025-03-05 | GPT-4.5 | 62.5% | OpenAI publie GPT-4.5, son plus grand modèle, pour ChatGPT Plus |
| 2024-10-30 | GPT-4o | 38.2% | OpenAI |