Benchmark · general

Artificial Analysis Intelligence Index

16 条结果 14 个模型

Artificial Analysis's independent composite index averaging ~10 evals into one 0-100 index score in points (frontier models ~50-67), not a percentage. Distinct from its sibling AA Coding Agent / Agentic indices.

0 17.5 35 52.5 70 2026-07-31 2026-08-17 2026-09-03 DeepSeek V4-Flash · 50 · 2026-07-31 Claude Opus 5 · 61 · 2026-07-31 Grok 4.6 · 61 · 2026-08-13 Grok 4.6 · 61 · 2026-08-21 Solar Pro 4 · 42 · 2026-08-13 Gemini 3.7 Flash · 56 · 2026-08-14 Muse Spark 1.2 · 57 · 2026-08-14 Grok 4.5 · 56 · 2026-08-14 Qwen3.8-Max · 58 · 2026-08-14 Muse Spark 1.1 · 53 · 2026-08-14 Qwen 3.8 27B · 52 · 2026-08-18 GLM-5.3-Flash · 57 · 2026-08-27 GLM-5.3-Flash · 57 · 2026-08-27 GLM-5.3 · 60 · 2026-08-28 GPT-6 Astra · 61 · 2026-09-03 Claude Fable 5.1 · 66 · 2026-09-03
DeepSeek V4-Flash Claude Opus 5 Grok 4.6 Solar Pro 4 Gemini 3.7 Flash Muse Spark 1.2 Grok 4.5 Qwen3.8-Max Muse Spark 1.1 Qwen 3.8 27B GLM-5.3-Flash GLM-5.3 GPT-6 Astra Claude Fable 5.1
时间线
日期 模型 得分 来源
2026-09-03 GPT-6 Astra 61.0% OpenAI发布GPT-6 Astra,具备ARC-AGI 3能力与安全改进
2026-09-03 Claude Fable 5.1 66.0% OpenAI发布GPT-6 Astra,具备ARC-AGI 3能力与安全改进
2026-08-28 GLM-5.3 60.0% Z.ai微调GLM-5.3以提升网络安全能力
2026-08-27 GLM-5.3-Flash 57.0% 英伟达以130亿美元收购HuggingFace;Z.ai发布GLM-5.3-Flash
2026-08-27 GLM-5.3-Flash 57.0% Z.ai 发布 GLM-5.3-Flash,一款拥有 100 万上下文的 320B 参数多模态模型
2026-08-21 Grok 4.6 61.0% SpaceXAI 推出 Grok 4.6,提供 Cursor 数据以支持智能体工作
2026-08-18 Qwen 3.8 27B 52.0% Qwen 3.8 27B在Artificial Analysis智能指数中得分52
2026-08-14 Muse Spark 1.2 57.0% Meta发布Muse Code智能体框架及低成本Muse Spark 1.2模型
2026-08-14 Grok 4.5 56.0% Meta发布Muse Code智能体框架及低成本Muse Spark 1.2模型
2026-08-14 Qwen3.8-Max 58.0% Meta发布Muse Code智能体框架及低成本Muse Spark 1.2模型
2026-08-14 Muse Spark 1.1 53.0% Meta发布Muse Code智能体框架及低成本Muse Spark 1.2模型
2026-08-14 Gemini 3.7 Flash 56.0% Google 发布 Gemini 3.7 Flash,带来算法改进与更低定价
2026-08-13 Grok 4.6 61.0% xAI发布Grok 4.6;阿里巴巴开源Qwen3.8-MoE;DeepSeek V4 Pro正式商用
2026-08-13 Solar Pro 4 42.0% xAI发布Grok 4.6;阿里巴巴开源Qwen3.8-MoE;DeepSeek V4 Pro正式商用
2026-07-31 Claude Opus 5 61.0% Anthropic 发布 Claude Opus 5;OpenAI 模型在安全测试中突破 Hugging Face
2026-07-31 DeepSeek V4-Flash 50.0% DeepSeek V4-Flash在ArtificialAnalysis指数中达到50分