All Comparisons

Claude Opus 4 vs o3

Claude Opus 4
Anthropic πŸ‡ΊπŸ‡Έ
75.1
#52β€”
high
$15.00/M in Β· $75.00/M out
200K context
o3
OpenAI πŸ‡ΊπŸ‡Έ
47.9
#174β€”
high
Most Affordable
Claude Opus 4
$15.00/M input
Largest Context
Claude Opus 4
200K tokens
Best Benchmark Score
Claude Opus 4
75.1/100

Model Specifications

SpecClaude Opus 4o3
ProviderAnthropicOpenAI
Release DateMay 2025Apr 2025
Knowledge CutoffMar 20252024-05-31
ParametersunknownUndisclosed
Context Window200Kβ€”
Max Outputβ€”β€”
Open SourceNoNo
Licenseproprietaryproprietary
Tokenizerβ€”β€”
Modalityβ€”β€”
Reasoning ModelNoNo
ModeratedNoNo

Pricing Comparison

Price (per 1M tokens)Claude Opus 4o3
Input$15.00β€”
Output$75.00β€”

API Provider Pricing

Capabilities

FeatureClaude Opus 4o3
Text Input
Image Input (Vision)
Audio Input
Video Input
File Input
Image Output
Audio Output
Tool Use
Structured Output (JSON)
Streaming
Reasoning Tokens
Web Search
Temperature Control
Top-P Sampling
Stop Sequences
Seed (Reproducibility)
Log Probabilities

Category Comparison

Benchmark-by-Benchmark

general

BenchmarkClaude Opus 4o3
Chatbot Arena Elo
1365
β€”
IFEval
91.5
β€”
MMLU-Pro
83.5
β€”

coding

BenchmarkClaude Opus 4o3
HumanEval
95.1
β€”
SWE-bench Verified
55.8
69.1

math

BenchmarkClaude Opus 4o3
MATH
85.2
β€”
GSM8K
97.8
β€”
AIME 2024
35
β€”
AIME 2025β€”
86.4
FrontierMathβ€”
15.8

reasoning

BenchmarkClaude Opus 4o3
GPQA Diamond
74.8
83.3
BigBench-Hard
93.2
β€”
Humanity's Last Examβ€”
14.7
ARC-AGI v2β€”
6.5

multimodal

BenchmarkClaude Opus 4o3
MMMU
74.2
82.9
MMMU-Proβ€”
76.4
CharXiv Reasoningβ€”
78.6

agent

BenchmarkClaude Opus 4o3
BrowseCompβ€”
49.7

Category Winners

coding
o3
58.4
math
Claude Opus 4
75.5
reasoning
Claude Opus 4
79.7
general
Claude Opus 4
96.0
multimodal
o3
73.4
agent
o3
23.4

Compare More Models

Frequently Asked Questions