AI Model Leaderboard

Every model ranked by one number — the Artificial Analysis Intelligence Index, which averages ~10 independent benchmarks into a single capability score.

Capability only — cost is not part of the score.

#ModelIntelligence Index
1Claude Fable 5
Claude Fable 5
Anthropic
59.9
2GPT-5.6 Sol
GPT-5.6 Sol
OpenAI
58.9
3
Kimi K3
Kimi K3
Moonshot AI
57.1
4Claude Opus 4.8
Claude Opus 4.8
Anthropic
55.7
5GPT-5.6 Terra
GPT-5.6 Terra
OpenAI
55.0
6GPT-5.5
GPT-5.5
OpenAI
54.8
7
Grok 4.5
Grok 4.5
xAI
53.8
8Claude Opus 4.7
Claude Opus 4.7
Anthropic
53.5
9Claude Sonnet 5
Claude Sonnet 5
Anthropic
53.4
10GPT-5.4
GPT-5.4
OpenAI
51.4
11GPT-5.6 Luna
GPT-5.6 Luna
OpenAI
51.2
12
GLM-5.2
GLM-5.2
Z.AI
51.1
13
Muse Spark 1.1
Muse Spark 1.1
Meta
50.6
14Gemini 3.5 Flash
Gemini 3.5 Flash
Google
50.2
15Gemini 3.6 Flash
Gemini 3.6 Flash
Google
50.1
16Gemini 3.1 Pro
Gemini 3.1 Pro
Google
46.5
17
Qwen3.7 Max
Qwen3.7 Max
Alibaba
46.0
18
MiniMax M3
MiniMax M3
MiniMax
44.4
19
DeepSeek V4 Pro
DeepSeek V4 Pro
DeepSeek
44.3
19GPT-5.3 Codex
GPT-5.3 Codex
OpenAI
44.3

Scores are the Artificial Analysis Intelligence Index (0–100, higher is better), an aggregate of ~10 independent benchmarks including GPQA Diamond, SciCode, Terminal-Bench and Humanity's Last Exam. Data captured July 23, 2026; one representative configuration per model. Want cost factored in too? Use the interactive compare tool.