Neura Intelligence Index
AI Model Benchmarks
Neura Market
Marketplace
Directories
Resources
Sell
Search...
⌘
K
Sign In
Get Started
Back to Leaderboard
Humanity's Last Exam
Expert-level questions across diverse domains, designed to be the hardest public benchmark.
reasoning
0-100 percent
Model Rankings (103)
#
Model
Score
Provider
Source
1
Claude Fable 5.1
🇺🇸
65
Anthropic
verified
2
Claude Mythos Preview
🇺🇸
64.7
Anthropic
verified
3
Claude Opus 5
🇺🇸
64.7
Anthropic
verified
4
Claude Fable 5
🇺🇸
64.5
Anthropic
verified
5
Z
GLM-5.3
🇨🇳
62.5
Zhipu AI
verified
6
M
Muse Spark 1.1
🇺🇸
62.1
Meta
verified
7
DeepSeek-V4-Pro-0813
🇨🇳
60
DeepSeek
verified
8
M
Muse Spark
🇺🇸
58.4
Meta
verified
9
Claude Opus 4.8
🇺🇸
57.9
Anthropic
verified
10
Claude Sonnet 5
🇺🇸
57.4
Anthropic
verified
11
GPT-5.5 Pro
🇺🇸
57.2
OpenAI
verified
12
M
Kimi K3
🇨🇳
56
Moonshot AI
verified
13
B
Seed 2.1 Pro
🇨🇳
55.7
ByteDance
verified
14
Z
GLM-5.3-Flash
🇨🇳
55.3
Zhipu AI
verified
15
Z
GLM-5.2
🇨🇳
54.7
Zhipu AI
verified
16
Claude Opus 4.7
🇺🇸
54.7
Anthropic
verified
17
B
Seed 2.1 Turbo
🇨🇳
54.6
ByteDance
verified
18
Claude Opus 4.6
🇺🇸
53.1
Anthropic
verified
19
Z
GLM-5.1
🇨🇳
52.3
Zhipu AI
verified
20
GPT-5.5
🇺🇸
52.2
OpenAI
verified
21
Gemini 3.1 Pro
🇺🇸
51.4
Google
verified
22
M
Kimi K2-Thinking-0905
🇨🇳
51
Moonshot AI
verified
23
X
Grok-4 Heavy
🇺🇸
50.7
xAI
verified
24
M
Kimi K2.5
🇨🇳
50.2
Moonshot AI
verified
25
Claude Sonnet 4.6
🇺🇸
49
Anthropic
verified
26
Q
Qwen3.5-27B
🇨🇳
48.5
Alibaba Cloud / Qwen Team
verified
27
DeepSeek-V4-Pro-Max
🇨🇳
48.2
DeepSeek
verified
28
Q
Qwen3.5-122B-A10B
🇨🇳
47.5
Alibaba Cloud / Qwen Team
verified
29
Q
Qwen3.5-35B-A3B
🇨🇳
47.4
Alibaba Cloud / Qwen Team
verified
30
Gemini 3 Pro
🇺🇸
45.8
Google
verified
31
DeepSeek-V4-Flash-Max
🇨🇳
45.1
DeepSeek
verified
32
Q
Qwen3.8 Max
🇨🇳
43.6
Alibaba Cloud / Qwen Team
verified
33
Gemini 3 Flash
🇺🇸
43.5
Google
verified
34
Z
GLM-4.7
🇨🇳
42.8
Zhipu AI
verified
35
Q
Qwen3.7 Max
🇨🇳
41.4
Alibaba Cloud / Qwen Team
verified
36
DeepSeek-V3.2
🇨🇳
40.8
DeepSeek
verified
37
DeepSeek-V4-Flash-0423
🇨🇳
40.3
DeepSeek
verified
38
Gemini 3.5 Flash
🇺🇸
40.2
Google
verified
39
X
Grok-4
🇺🇸
40
xAI
verified
40
GPT-5.4
🇺🇸
39.8
OpenAI
verified
41
ERNIE 5.0
🇨🇳
39
Baidu
verified
42
Nemotron 3 Ultra (550B A55B)
🇺🇸
37.4
NVIDIA
verified
43
GPT-5.2 Pro
🇺🇸
36.6
OpenAI
verified
44
M
Kimi K2.6
🇨🇳
36.4
Moonshot AI
verified
45
Q
Qwen3.8 Flash
🇨🇳
35.9
Alibaba Cloud / Qwen Team
verified
46
Q
Qwen3.8-Flash-Next
🇨🇳
35.9
Alibaba Cloud / Qwen Team
verified
47
Q
Qwen3.7-Plus
🇨🇳
34.7
Alibaba Cloud / Qwen Team
verified
48
GPT-5.2
🇺🇸
34.5
OpenAI
verified
49
X
MiMo-V2.5-Pro
🇨🇳
34
Xiaomi
verified
50
T
Inkling-Small
🇺🇸
31.6
Thinking Machines Lab
verified
51
Q
Qwen3.8-27B
🇨🇳
30.8
Alibaba Cloud / Qwen Team
verified
52
DeepSeek-V3.2-Speciale
🇨🇳
30.6
DeepSeek
verified
53
Q
Qwen3.6 Plus
🇨🇳
28.8
Alibaba Cloud / Qwen Team
verified
54
Q
Qwen3.5-397B-A17B
🇨🇳
28.7
Alibaba Cloud / Qwen Team
verified
55
GPT-5.4 mini
🇺🇸
28.2
OpenAI
verified
56
Gemma 4 31B
🇺🇸
26.5
Google
verified
57
M
LongCat-Flash-Thinking-2601
🇨🇳
25.2
Meituan
verified
58
DeepSeek-V3.2 (Thinking)
🇨🇳
25.1
DeepSeek
verified
59
GPT-5
🇺🇸
24.8
OpenAI
verified
60
GPT-5.4 nano
🇺🇸
24.3
OpenAI
verified
61
Q
Qwen3.6-27B
🇨🇳
24
Alibaba Cloud / Qwen Team
verified
62
Nemotron 3 Super (120B A12B)
🇺🇸
22.8
NVIDIA
verified
63
X
MiMo-V2-Flash
🇨🇳
22.1
Xiaomi
verified
64
M
Muse Glimmer-30B
🇺🇸
22
Meta
verified
65
MiniMax M2.1
🇨🇳
22
MiniMax
verified
66
Gemini 2.5 Pro Preview 06-05
🇺🇸
21.6
Google
verified
67
Q
Qwen3.6-35B-A3B
🇨🇳
21.4
Alibaba Cloud / Qwen Team
verified
68
X
Grok 4 Fast
🇺🇸
20
xAI
verified
69
DeepSeek-V3.2-Exp
🇨🇳
19.8
DeepSeek
verified
70
Q
Qwen3-235B-A22B-Thinking-2507
🇨🇳
18.2
Alibaba Cloud / Qwen Team
verified
71
MAI-Code-1-Flash
🇺🇸
18
Microsoft
verified
72
Gemini 2.5 Pro
🇺🇸
17.8
Google
verified
73
DeepSeek-R1-0528
🇨🇳
17.7
DeepSeek
verified
74
Gemma 4 26B-A4B
🇺🇸
17.2
Google
verified
75
Z
GLM-4.6
🇨🇳
17.2
Zhipu AI
verified
76
GPT-5 mini
🇺🇸
16.7
OpenAI
verified
77
Gemini 3.1 Flash-Lite
🇺🇸
16
Google
verified
78
DeepSeek-V3.1
🇨🇳
15.9
DeepSeek
verified
79
Nemotron 3 Nano (30B A3B)
🇺🇸
15.5
NVIDIA
verified
80
GPT OSS 120B
🇺🇸
14.9
OpenAI
verified
81
o4-mini
🇺🇸
14.7
OpenAI
verified
82
o3
🇺🇸
14.7
OpenAI
verified
83
Z
GLM-4.5
🇨🇳
14.4
Zhipu AI
verified
84
Z
GLM-4.7-Flash
🇨🇳
14.4
Zhipu AI
verified
85
Q
Qwen3 VL 235B A22B Thinking
🇨🇳
13.6
Alibaba Cloud / Qwen Team
verified
86
MiniMax M2
🇨🇳
12.5
MiniMax
verified
87
DiffusionGemma 26B-A4B
🇺🇸
11.9
Google
verified
88
Nemotron 3.5 Lightning (30B A3B)
🇺🇸
11.7
NVIDIA
verified
89
S
Sarvam-105B
🇮🇳
11.2
Sarvam AI
verified
90
Gemini 2.5 Flash
🇺🇸
11
Google
verified
91
GPT OSS 20B
🇺🇸
10.9
OpenAI
verified
92
Z
GLM-4.5-Air
🇨🇳
10.6
Zhipu AI
verified
93
Magistral Medium
🇫🇷
9
Mistral AI
verified
94
GPT-5 nano
🇺🇸
8.7
OpenAI
verified
95
MiniMax M1 80K
🇨🇳
8.4
MiniMax
verified
96
MiniMax M1 40K
🇨🇳
7.2
MiniMax
verified
97
GPT-4.1
🇺🇸
5.4
OpenAI
verified
98
GPT-4o
🇺🇸
5.3
OpenAI
verified
99
Gemma 4 12B
🇺🇸
5.2
Google
verified
100
Gemini 2.5 Flash-Lite
🇺🇸
5.1
Google
verified
101
M
Kimi K2 Instruct
🇨🇳
4.7
Moonshot AI
verified
102
M
Kimi K2-Instruct-0905
🇨🇳
4.7
Moonshot AI
verified
103
GPT-4.1 mini
🇺🇸
3.7
OpenAI
verified
Humanity's Last Exam — AI Model Leaderboard & Results | Neura Market