Benchmark · general
SimpleQA
OpenAI's short-form factuality benchmark; accuracy in %.
| التاريخ | النموذج | النتيجة | المصدر |
|---|---|---|---|
| 2026-08-03 | Inkling-Small | 20.6% | مختبر الآلات المفكرة يُصدر Inkling-Small، وهو نموذج MoE متعدد الوسائط بوزن مفتوح يتكون من 276 مليار معلمة |
| 2025-04-15 | Gemini 2.0 Flash | 29.9% | جوجل تطلق Gemini 2.0 Flash بجودة محسّنة وسرعة ضعف سرعة Gemini 1.5 Pro |
| 2025-03-05 | GPT-4.5 | 62.5% | OpenAI تطلق GPT-4.5، أكبر نموذج لها، لـ ChatGPT Plus |
| 2024-10-30 | GPT-4o | 38.2% | OpenAI |