DruxAI

Live Leaderboard

AI Model Rankings

Global benchmarks from Artificial Analysis — plus real-world performance data from every query run on Drux.

Rankings last updated: 20260822 · 100 models

#ModelIntelligence
1Claude Opus 5 (Adaptive Reasoning, Max Effort)
63.1
2Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
62.5
3Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
62.1
4Claude Opus 5 (Adaptive Reasoning, High Effort)
61.5
5GPT-5.6 Sol (max)
60.9
6Grok 4.6 (high)
60.9
7Kimi K3 (max)
59.7
8GLM-5.3 (max)
59.5
9GPT-5.6 Sol (xhigh)
59
10Claude Opus 5 (Adaptive Reasoning, Medium Effort)
58.6
11Qwen3.8 Max
58.1
12Qwen3.8 2.4T A95B
57.7
13GPT-5.6 Sol (high)
57.3
14Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
57.3
15Muse Spark 1.2 (xhigh)
56.8
16GPT-5.6 Terra (max)
56.6
17GPT-5.5 (xhigh)
56.3
18Gemini 3.7 Flash (high)
56
19Grok 4.5 (high)
55.8
20GPT-5.6 Sol (medium)
55.6
21Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
55.3
22Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
55
23GPT-5.5 (high)
54.7
24Gemini 3.7 Flash (medium)
53.4
25DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
53.2
26Muse Spark 1.1 (xhigh)
53.2
27GPT-5.4 (xhigh)
53.1
28GPT-5.6 Terra (xhigh)
52.8
29GLM-5.2 (max)
52.6
30Claude Opus 5 (Adaptive Reasoning, Low Effort)
52.5
31GPT-5.6 Luna (max)
52.3
32Qwen3.8 27B
52
33Gemini 3.5 Flash (high)
52
34DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
51.8
35Gemini 3.6 Flash (high)
51.6
36GPT-5.5 (medium)
51.4
37Gemini 3.7 Flash (low)
50.9
38GPT-5.6 Sol (low)
50.7
39GPT-5.6 Luna (xhigh)
50.1
40GPT-5.6 Terra (high)
50.1
41Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
48.4
42Kimi K3 (low)
48.3
43Gemini 3.1 Pro Preview
47.7
44Motif 3
47.4
45GPT-5.6 Luna (high)
47
46GPT-5.6 Terra (medium)
46.8
47Gemini 3.5 Flash (medium)
46.7
48Qwen3.7 Max
46.7
49GPT-5.3 Codex (xhigh)
45.5
50MiniMax-M3
45.4
51DeepSeek V4 Pro (Reasoning, Max Effort)
45.3
52Motif 3 (Beta)
45.3
53Kimi K2.6
45.1
54Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
44.9
55GPT-5.5 (low)
44.5
56Muse Spark
44.3
57Claude Opus 4.7 (Non-reasoning, High Effort)
43.9
58DeepSeek V4 Pro (Reasoning, High Effort)
43.7
59GPT-5.2 (xhigh)
43.3
60Kimi K2.7 Code
43
61MiMo-V2.5-Pro
42.9
62Claude Sonnet 5 (Non-reasoning, High Effort)
42.6
63Inkling (xhigh)
42.3
64Hy3
42.2
65DeepSeek V4 Flash (Reasoning, Max Effort)
42.1
66GPT-5.6 Sol (Non-reasoning)
41.9
67Claude Opus 4.5 (Reasoning)
41.9
68Nex-N2-Pro
41.7
69Solar Pro 4
41.6
70MiMo-V2-Pro
41.4
71GPT-5.6 Terra (low)
41.3
72Inkling Small
41.2
73GPT-5.2 Codex (xhigh)
41.2
74Qwen3.6 Max Preview
41.1
75GLM-5.1 (Reasoning)
41
76GPT-5.4 mini (xhigh)
40.9
77Grok Build 0.1 0616
40.7
78Gemini 3 Pro Preview (high)
40.6
79GLM-5 (Reasoning)
40.6
80Qwen3.6 Plus
40.5
81GPT-5.4 (low)
40.2
82JT-4.1 Flash 236B A21B
39.9
83Agnes 2.5 Pro Alpha
39.7
84GPT-5.4 nano (xhigh)
39.7
85Qwen3.7 Plus
39.4
86GLM-5-Turbo
39.1
87DeepSeek V4 Flash (Reasoning, High Effort)
39
88GPT-5.6 Luna (medium)
38.9
89GPT-5.2 (medium)
38.9
90MiniMax-M2.7
38.9
91Claude Opus 4.6 (Non-reasoning, High Effort)
38.8
92Gemini 3 Flash Preview (Reasoning)
38.7
93Nemotron 3 Ultra 550B A55B (Reasoning)
38.3
94MiMo-V2.5
38
95Grok 4.20 0309 v2 (Reasoning)
38
96Grok 4.3 (high)
37.9
97Ling 3.0 Flash
37.8
98Qwen3.6 27B (Reasoning)
37.7
99GPT-5.1 (high)
37.5
100Gemini 3.5 Flash-Lite
37.4

Get the DruxAI daily digest

AI Rankings movers, fresh Hub stories, and the hottest RoundTable debate — in one email.

About this ranking

Intelligence Index is a composite quality score aggregating performance across reasoning, coding, math, and instruction-following benchmarks into a single comparable number.

Data source: Artificial Analysis — independent AI benchmarking. Intelligence Index, benchmark scores, pricing, and speed data are © Artificial Analysis. DruxAI fetches this data daily via the Artificial Analysis API and does not modify or influence the scores.