Neura Intelligence Index
AI Model Benchmarks
Neura Market
Marketplace
Directories
Resources
Sell
Search...
⌘
K
Sign In
Get Started
Back to Leaderboard
AIME 2025
American Invitational Mathematics Examination 2025 — competition-level math problems.
math
0-100 percent
Model Rankings (119)
#
Model
Score
Provider
Source
1
GPT-5.2
🇺🇸
100
OpenAI
verified
2
Gemini 3 Pro
🇺🇸
100
Google
verified
3
X
Grok-4 Heavy
🇺🇸
100
xAI
verified
4
M
Kimi K2-Thinking-0905
🇨🇳
100
Moonshot AI
verified
5
GPT-5.2 Pro
🇺🇸
100
OpenAI
verified
6
Claude Opus 4.6
🇺🇸
99.8
Anthropic
verified
7
Gemini 3 Flash
🇺🇸
99.7
Google
verified
8
M
LongCat-Flash-Thinking-2601
🇨🇳
99.6
Meituan
verified
9
GPT-5.1 High
🇺🇸
99.6
OpenAI
verified
10
Nemotron 3 Nano (30B A3B)
🇺🇸
99.2
NVIDIA
verified
11
GPT OSS 20B High
🇺🇸
98.7
OpenAI
verified
12
GPT-5.1 Medium
🇺🇸
98.4
OpenAI
verified
13
B
Seed 2.0 Pro
🇨🇳
98.3
ByteDance
verified
14
S
Step-3.5-Flash
🇨🇳
97.3
StepFun
verified
15
MAI-Thinking-1
🇺🇸
97
Microsoft
verified
16
GPT-5.1 Codex High
🇺🇸
96.7
OpenAI
verified
17
S
Sarvam-30B
🇮🇳
96.7
Sarvam AI
verified
18
S
Sarvam-105B
🇮🇳
96.7
Sarvam AI
verified
19
M
Kimi K2.5
🇨🇳
96.1
Moonshot AI
verified
20
DeepSeek-V3.2-Speciale
🇨🇳
96
DeepSeek
verified
21
Z
GLM-4.7
🇨🇳
95.7
Zhipu AI
verified
22
GPT-5
🇺🇸
94.6
OpenAI
verified
23
GPT-5 High
🇺🇸
94.6
OpenAI
verified
24
X
MiMo-V2-Flash
🇨🇳
94.1
Xiaomi
verified
25
GPT-5.1 Thinking
🇺🇸
94
OpenAI
verified
26
GPT-5.1
🇺🇸
94
OpenAI
verified
27
GPT-5.1 Instant
🇺🇸
94
OpenAI
verified
28
Z
GLM-4.6
🇨🇳
93.9
Zhipu AI
verified
29
X
Grok-3
🇺🇸
93.3
xAI
verified
30
DeepSeek-V3.2
🇨🇳
93.1
DeepSeek
verified
31
DeepSeek-V3.2 (Thinking)
🇨🇳
93.1
DeepSeek
verified
32
B
Seed 2.0 Lite
🇨🇳
93
ByteDance
verified
33
L
EXAONE 4.5 33B
🇰🇷
92.9
LG AI Research
verified
34
L
K-EXAONE-236B-A23B
🇰🇷
92.8
LG AI Research
verified
35
o4-mini
🇺🇸
92.7
OpenAI
verified
36
GPT OSS 120B High
🇺🇸
92.5
OpenAI
verified
37
Nova 2 Pro
🇺🇸
92.3
Amazon
verified
38
Q
Qwen3-235B-A22B-Thinking-2507
🇨🇳
92.3
Alibaba Cloud / Qwen Team
verified
39
Nova 2 Omni
🇺🇸
92.1
Amazon
verified
40
X
Grok 4 Fast
🇺🇸
92
xAI
verified
41
X
Grok-4
🇺🇸
91.7
xAI
verified
42
Z
GLM-4.7-Flash
🇨🇳
91.6
Zhipu AI
verified
43
I
Mercury 2
🇺🇸
91.1
Inception
verified
44
GPT-5 mini
🇺🇸
91.1
OpenAI
verified
45
Nova 2 Lite
🇺🇸
91
Amazon
verified
46
X
Grok-3 Mini
🇺🇸
90.8
xAI
verified
47
M
LongCat-Flash-Thinking
🇨🇳
90.6
Meituan
verified
48
Nemotron 3 Super (120B A12B)
🇺🇸
90.2
NVIDIA
verified
49
Command A+
🇨🇦
90
Cohere
verified
50
Q
Qwen3 VL 235B A22B Thinking
🇨🇳
89.7
Alibaba Cloud / Qwen Team
verified
51
DeepSeek-V3.2-Exp
🇨🇳
89.3
DeepSeek
verified
52
I
IBM Granite 4.2 30B
🇺🇸
89.2
IBM
verified
53
GPT-5 Medium
🇺🇸
88.9
OpenAI
verified
54
Gemini 2.5 Pro Preview 06-05
🇺🇸
88
Google
verified
55
Q
Qwen3-Next-80B-A3B-Thinking
🇨🇳
87.8
Alibaba Cloud / Qwen Team
verified
56
S
Step3-VL-10B
🇨🇳
87.7
StepFun
verified
57
DeepSeek-R1-0528
🇨🇳
87.5
DeepSeek
verified
58
Claude Sonnet 4.5
🇺🇸
87
Anthropic
verified
59
ERNIE 5.0
🇨🇳
87
Baidu
verified
60
I
IBM Granite 4.2 8B
🇺🇸
86.7
IBM
verified
61
o3
🇺🇸
86.4
OpenAI
verified
62
Mistral Medium 3.5
🇫🇷
86.3
Mistral AI
verified
63
GPT-5 nano
🇺🇸
85.2
OpenAI
verified
64
Ministral 3 (14B Reasoning 2512)
🇫🇷
85
Mistral AI
verified
65
Mistral Small 4
🇫🇷
83.8
Mistral AI
verified
66
Q
Qwen3 VL 32B Thinking
🇨🇳
83.7
Alibaba Cloud / Qwen Team
verified
67
Q
Qwen3 VL 30B A3B Thinking
🇨🇳
83.1
Alibaba Cloud / Qwen Team
verified
68
Gemini 2.5 Pro
🇺🇸
83
Google
verified
69
Q
Qwen3 Max
🇨🇳
81.6
Alibaba Cloud / Qwen Team
verified
70
Q
Qwen3 235B A22B
🇨🇳
81.5
Alibaba Cloud / Qwen Team
verified
71
GPT-5.5 Instant
🇺🇸
81.2
OpenAI
verified
72
MiniMax M2.1
🇨🇳
81
MiniMax
verified
73
Claude Haiku 4.5
🇺🇸
80.7
Anthropic
verified
74
Q
Qwen3 VL 8B Thinking
🇨🇳
80.3
Alibaba Cloud / Qwen Team
verified
75
Ministral 3 (8B Reasoning 2512)
🇫🇷
78.7
Mistral AI
verified
76
O
MiniCPM-SALA
🇨🇳
78.3
OpenBMB
verified
77
I
IBM Granite 4.2 3B
🇺🇸
78.3
IBM
verified
78
MiniMax M2
🇨🇳
78
MiniMax
verified
79
Claude Opus 4.1
🇺🇸
78
Anthropic
verified
80
Phi 4 Reasoning Plus
🇺🇸
78
Microsoft
verified
81
MiniMax M1 80K
🇨🇳
76.9
MiniMax
verified
82
Claude Opus 4
🇺🇸
75.5
Anthropic
verified
83
Q
Qwen3 VL 235B A22B Instruct
🇨🇳
74.7
Alibaba Cloud / Qwen Team
verified
84
MiniMax M1 40K
🇨🇳
74.6
MiniMax
verified
85
Q
Qwen3 VL 4B Thinking
🇨🇳
74.5
Alibaba Cloud / Qwen Team
verified
86
Q
Qwen3 32B
🇨🇳
72.9
Alibaba Cloud / Qwen Team
verified
87
Llama 3.1 Nemotron Ultra 253B v1
🇺🇸
72.5
NVIDIA
verified
88
Min istral 3 (3B Reasoning 2512)
🇫🇷
72.1
Mistral AI
verified
89
Nemotron Nano 9B v2
🇺🇸
72.1
NVIDIA
verified
90
Gemini 2.5 Flash
🇺🇸
72
Google
verified
91
Q
Qwen3 30B A3B
🇨🇳
70.9
Alibaba Cloud / Qwen Team
verified
92
Claude Sonnet 4
🇺🇸
70.5
Anthropic
verified
93
Q
Qwen3-235B-A22B-Instruct-2507
🇨🇳
70.3
Alibaba Cloud / Qwen Team
verified
94
Q
Qwen3-Next-80B-A3B-Instruct
🇨🇳
69.5
Alibaba Cloud / Qwen Team
verified
95
Q
Qwen3 VL 30B A3B Instruct
🇨🇳
69.3
Alibaba Cloud / Qwen Team
verified
96
Q
Qwen3 VL 32B Instruct
🇨🇳
66.2
Alibaba Cloud / Qwen Team
verified
97
Magistral Medium
🇫🇷
64.9
Mistral AI
verified
98
M
LongCat-Flash-Lite
🇨🇳
63.2
Meituan
verified
99
Phi 4 Reasoning
🇺🇸
62.9
Microsoft
verified
100
Magistral Small 2506
🇫🇷
62.8
Mistral AI
verified
101
M
LongCat-Flash-Chat
🇨🇳
61.3
Meituan
verified
102
Llama-3.3 Nemotron Super 49B v1
🇺🇸
58.4
NVIDIA
verified
103
Claude 3.7 Sonnet
🇺🇸
54.8
Anthropic
verified
104
L
LFM2.5-2.6B
🇺🇸
51.9
Liquid AI
verified
105
DeepSeek-V3.1
🇨🇳
49.8
DeepSeek
verified
106
Gemini 2.5 Flash-Lite
🇺🇸
49.8
Google
verified
107
M
Kimi K2 Instruct
🇨🇳
49.5
Moonshot AI
verified
108
M
Kimi K2-Instruct-0905
🇨🇳
49.5
Moonshot AI
verified
109
Llama 3.1 Nemotron Nano 8B V1
🇺🇸
47.1
NVIDIA
verified
110
Q
Qwen3 VL 4B Instruct
🇨🇳
46.6
Alibaba Cloud / Qwen Team
verified
111
GPT-4.1
🇺🇸
46.4
OpenAI
verified
112
Q
Qwen3 VL 8B Instruct
🇨🇳
45.9
Alibaba Cloud / Qwen Team
verified
113
GPT-5.1 Codex Mini
🇺🇸
42.1
OpenAI
verified
114
GPT-4.1 mini
🇺🇸
40.2
OpenAI
verified
115
Gemini Diffusion
🇺🇸
23.3
Google
verified
116
Gemma 3n E4B Instructed LiteRT Preview
🇺🇸
11.6
Google
verified
117
Gemma 3n E4B Instructed
🇺🇸
11.6
Google
verified
118
Gemma 3n E2B Instructed LiteRT (Preview)
🇺🇸
6.7
Google
verified
119
Gemma 3n E2B Instructed
🇺🇸
6.7
Google
verified
AIME 2025 — AI Model Leaderboard & Results | Neura Market