Neura Intelligence Index
AI Model Benchmarks
MMMU — AI Model Leaderboard & Results | Neura Market
Neura Market
Marketplace
Directories
Resources
Sell
Search...
⌘
K
Sign In
Get Started
Back to Leaderboard
MMMU
Massive Multi-discipline Multimodal Understanding — college-level multimodal questions.
multimodal
0-100 percent
Paper / Website
Model Rankings (68)
#
Model
Score
Provider
Source
1
Q
Qwen3.6 Plus
🇨🇳
86
Alibaba Cloud / Qwen Team
verified
2
GPT-5.1
🇺🇸
85.4
OpenAI
verified
3
GPT-5.1 Thinking
🇺🇸
85.4
OpenAI
verified
4
GPT-5.1 Instant
🇺🇸
85.4
OpenAI
verified
5
GPT-5
🇺🇸
84.2
OpenAI
verified
6
Q
Qwen3.5-122B-A10B
🇨🇳
83.9
Alibaba Cloud / Qwen Team
verified
7
o3
🇺🇸
82.9
OpenAI
verified
8
Q
Qwen3.6-27B
🇨🇳
82.9
Alibaba Cloud / Qwen Team
verified
9
Q
Qwen3.5-27B
🇨🇳
82.3
Alibaba Cloud / Qwen Team
verified
10
Gemini 2.5 Pro Preview 06-05
🇺🇸
82
Google
verified
11
Q
Qwen3.6-35B-A3B
🇨🇳
81.7
Alibaba Cloud / Qwen Team
verified
12
o4-mini
🇺🇸
81.6
OpenAI
verified
13
Q
Qwen3.5-35B-A3B
🇨🇳
81.4
Alibaba Cloud / Qwen Team
verified
14
Gemini 2.5 Flash
🇺🇸
79.7
Google
verified
15
Gemini 2.5 Pro
🇺🇸
79.6
Google
verified
16
L
EXAONE 4.5 33B
🇰🇷
78.7
LG AI Research
verified
17
S
Step3-VL-10B
🇨🇳
78.1
StepFun
verified
18
X
Grok-3
🇺🇸
78
xAI
verified
19
o1
🇺🇸
77.6
OpenAI
verified
20
Gemini 2.0 Flash Thinking
🇺🇸
75.4
Google
verified
21
GPT-4.5
🇺🇸
75.2
OpenAI
verified
22
Command A+
🇨🇦
75.1
Cohere
verified
23
Claude 3.7 Sonnet
🇺🇸
75
Anthropic
verified
24
GPT-4.1
🇺🇸
74.8
OpenAI
verified
25
Claude Sonnet 4
🇺🇸
74.4
Anthropic
verified
26
Claude Opus 4
🇺🇸
74.2
Anthropic
aggregated
27
M
Llama 4 Maverick
🇺🇸
73.4
Meta
verified
28
Gemini 2.5 Flash-Lite
🇺🇸
72.9
Google
verified
29
GPT-4.1 mini
🇺🇸
72.7
OpenAI
verified
30
Claude Sonnet 4
🇺🇸
72.5
Anthropic
aggregated
31
GPT-4o
🇺🇸
72.2
OpenAI
verified
32
Gemini 2.0 Flash
🇺🇸
70.7
Google
verified
33
Q
QvQ-72B-Preview
🇨🇳
70.3
Alibaba Cloud / Qwen Team
verified
34
Q
Qwen2.5 VL 72B Instruct
🇨🇳
70.2
Alibaba Cloud / Qwen Team
verified
35
Q
Qwen2.5 VL 32B Instruct
🇨🇳
70
Alibaba Cloud / Qwen Team
verified
36
M
Kimi-k1.5
🇨🇳
70
Moonshot AI
verified
37
M
Llama 4 Scout
🇺🇸
69.4
Meta
verified
38
GPT-4o
🇺🇸
69.1
OpenAI
aggregated
39
Claude 3.5 Sonnet
🇺🇸
68.3
Anthropic
aggregated
40
Claude 3.5 Sonnet
🇺🇸
68.3
Anthropic
verified
41
Gemini 2.0 Flash-Lite
🇺🇸
68
Google
verified
42
X
Grok-2
🇺🇸
66.1
xAI
verified
43
Gemini 1.5 Pro
🇺🇸
65.9
Google
verified
44
Pixtral Large
🇫🇷
64
Mistral AI
verified
45
X
Grok-2 mini
🇺🇸
63.2
xAI
verified
46
Mistral Small 3.2 24B Instruct
🇫🇷
62.5
Mistral AI
verified
47
Gemini 1.5 Flash
🇺🇸
62.3
Google
verified
48
Nova Pro
🇺🇸
61.7
Amazon
verified
49
M
Llama 3.2 90B Instruct
🇺🇸
60.3
Meta
verified
50
GPT-4o mini
🇺🇸
59.4
OpenAI
verified
51
Mistral Small 3.1 24B Base
🇫🇷
59.3
Mistral AI
verified
52
Mistral Small 3.1 24B Instruct
🇫🇷
59.3
Mistral AI
verified
53
Q
Qwen2.5-Omni-7B
🇨🇳
59.2
Alibaba Cloud / Qwen Team
verified
54
Q
Qwen2.5 VL 7B Instruct
🇨🇳
58.6
Alibaba Cloud / Qwen Team
verified
55
Nova Lite
🇺🇸
56.2
Amazon
verified
56
GPT-4.1 nano
🇺🇸
55.4
OpenAI
verified
57
Phi-4-multimodal-instruct
🇺🇸
55.1
Microsoft
verified
58
Gemini 1.5 Flash 8B
🇺🇸
53.7
Google
verified
59
X
Grok-1.5V
🇺🇸
53.6
xAI
verified
60
X
Grok-1.5
🇺🇸
53.6
xAI
verified
61
Pixtral-12B
🇫🇷
52.5
Mistral AI
verified
62
DeepSeek VL2
🇨🇳
51.1
DeepSeek
verified
63
M
Llama 3.2 11B Instruct
🇺🇸
50.7
Meta
verified
64
DeepSeek VL2 Small
🇨🇳
48
DeepSeek
verified
65
Gemini 1.0 Pro
🇺🇸
47.9
Google
verified
66
Phi-3.5-vision-instruct
🇺🇸
43
Microsoft
verified
67
DeepSeek VL2 Tiny
🇨🇳
40.7
DeepSeek
verified
68
GPT-3.5 Turbo
🇺🇸
0
OpenAI
verified