All Comparisons

Grok-3 vs o3

X
Grok-3
xAI πŸ‡ΊπŸ‡Έ
77.9
#38β€”
low
$3.00/M in Β· $15.00/M out
128K context
o3
OpenAI πŸ‡ΊπŸ‡Έ
47.9
#174β€”
high
Most Affordable
Grok-3
$3.00/M input
Largest Context
Grok-3
128K tokens
Best Benchmark Score
Grok-3
77.9/100

Model Specifications

SpecGrok-3o3
ProviderxAIOpenAI
Release DateFeb 2025Apr 2025
Knowledge Cutoff2024-11-172024-05-31
ParametersUndisclosedUndisclosed
Context Window128Kβ€”
Max Outputβ€”β€”
Open SourceNoNo
Licenseproprietaryproprietary
Tokenizerβ€”β€”
Modalityβ€”β€”
Reasoning ModelNoNo
ModeratedNoNo

Pricing Comparison

Price (per 1M tokens)Grok-3o3
Input$3.00β€”
Output$15.00β€”

API Provider Pricing

Capabilities

FeatureGrok-3o3
Text Input
Image Input (Vision)
Audio Input
Video Input
File Input
Image Output
Audio Output
Tool Use
Structured Output (JSON)
Streaming
Reasoning Tokens
Web Search
Temperature Control
Top-P Sampling
Stop Sequences
Seed (Reproducibility)
Log Probabilities

Category Comparison

Benchmark-by-Benchmark

math

BenchmarkGrok-3o3
AIME 2025
93.3
86.4
FrontierMathβ€”
15.8

reasoning

BenchmarkGrok-3o3
GPQA Diamond
84.6
83.3
Humanity's Last Examβ€”
14.7
ARC-AGI v2β€”
6.5

multimodal

BenchmarkGrok-3o3
MMMU
78
82.9
MMMU-Proβ€”
76.4
CharXiv Reasoningβ€”
78.6

coding

BenchmarkGrok-3o3
SWE-bench Verifiedβ€”
69.1

agent

BenchmarkGrok-3o3
BrowseCompβ€”
49.7

Category Winners

coding
o3
58.4
math
X
Grok-3
75.2
reasoning
X
Grok-3
80.6
multimodal
X
Grok-3
76.7
agent
o3
23.4

Compare More Models

Frequently Asked Questions