All Comparisons

Claude Sonnet 4 vs GPT-4o

Claude Sonnet 4
Anthropic πŸ‡ΊπŸ‡Έ
68.5
#83β€”
high
$3.00/M in Β· $15.00/M out
200K context
GPT-4o
OpenAI πŸ‡ΊπŸ‡Έ
58.3
#136β€”
high
$2.50/M in Β· $10.00/M out
128K context
Most Affordable
GPT-4o
$2.50/M input
Largest Context
Claude Sonnet 4
200K tokens
Best Benchmark Score
Claude Sonnet 4
68.5/100

Model Specifications

SpecClaude Sonnet 4GPT-4o
ProviderAnthropicOpenAI
Release DateMay 2025May 2024
Knowledge CutoffMar 2025Oct 2023
Parametersunknownunknown
Context Window200K128K
Max Outputβ€”β€”
Open SourceNoNo
Licenseproprietaryproprietary
Tokenizerβ€”β€”
Modalityβ€”β€”
Reasoning ModelNoNo
ModeratedNoNo

Pricing Comparison

Price (per 1M tokens)Claude Sonnet 4GPT-4o
Input$3.00$2.50
Output$15.00$10.00

API Provider Pricing

Capabilities

FeatureClaude Sonnet 4GPT-4o
Text Input
Image Input (Vision)
Audio Input
Video Input
File Input
Image Output
Audio Output
Tool Use
Structured Output (JSON)
Streaming
Reasoning Tokens
Web Search
Temperature Control
Top-P Sampling
Stop Sequences
Seed (Reproducibility)
Log Probabilities

Category Comparison

Benchmark-by-Benchmark

general

BenchmarkClaude Sonnet 4GPT-4o
IFEval
90.1
83.6
MMLU-Pro
80.2
74.5
Chatbot Arena Elo
1310
1285

coding

BenchmarkClaude Sonnet 4GPT-4o
HumanEval
93.8
90.2
SWE-bench Verified
53.2
33.2

math

BenchmarkClaude Sonnet 4GPT-4o
MATH
81.4
76.6
GSM8K
97.2
95.8
AIME 2024
24.5
13.4

reasoning

BenchmarkClaude Sonnet 4GPT-4o
BigBench-Hard
90.8
87.3
GPQA Diamond
70.5
53.6
ARC-Challengeβ€”
96.4

multimodal

BenchmarkClaude Sonnet 4GPT-4o
MMMU
72.5
69.1

language

BenchmarkClaude Sonnet 4GPT-4o
HellaSwagβ€”
96.4
WinoGrandeβ€”
85.7

safety

BenchmarkClaude Sonnet 4GPT-4o
TruthfulQAβ€”
73.5

Category Winners

coding
Claude Sonnet 4
54.0
math
Claude Sonnet 4
66.8
reasoning
Claude Sonnet 4
70.9
general
Claude Sonnet 4
90.0
language
GPT-4o
79.9
multimodal
Claude Sonnet 4
63.3
safety
GPT-4o
94.3

Compare More Models

Frequently Asked Questions