Neura Intelligence Index
AI Model Benchmarks
Neura Market
Marketplace
Directories
Resources
Sell
Search...
β
K
Sign In
Get Started
Back to Leaderboard
WinoGrande
Large-scale Winograd schema challenge for commonsense reasoning
language
0-100 percent
Saturated
Paper / Website
Model Rankings (14)
#
Model
Score
Provider
Source
1
Llama 3.1 405B
πΊπΈ
87.6
Meta
aggregated
2
GPT-4 Turbo
πΊπΈ
87.5
OpenAI
aggregated
3
Nemotron 4 340B
πΊπΈ
86.2
NVIDIA
aggregated
4
Llama 3.3 70B
πΊπΈ
86.1
Meta
aggregated
5
GPT-4o
πΊπΈ
85.7
OpenAI
aggregated
6
Claude 3 Opus
πΊπΈ
85.4
Anthropic
aggregated
7
Llama 3.1 70B
πΊπΈ
85.3
Meta
aggregated
8
Qwen 2.5 72B
π¨π³
84.8
Alibaba
aggregated
9
Claude 3.5 Sonnet
πΊπΈ
83.2
Anthropic
aggregated
10
GPT-4o mini
πΊπΈ
82.3
OpenAI
aggregated
11
Mixtral 8x22B
π«π·
82.1
Mistral
aggregated
12
Phi-3 Medium
πΊπΈ
81.4
Microsoft
aggregated
13
Command R+
π¨π¦
80.2
Cohere
aggregated
14
Llama 3.1 8B
πΊπΈ
78.9
Meta
aggregated
WinoGrande β AI Model Leaderboard & Results | Neura Market