All Comparisons

Claude Sonnet 4 vs Gemini 2.5 Pro

Claude Sonnet 4
Anthropic πŸ‡ΊπŸ‡Έ
68.3
#93β€”
high
$3.00/M in Β· $15.00/M out
200K context
Gemini 2.5 Pro
Google πŸ‡ΊπŸ‡Έ
53.5
#169β€”
medium
$1.25/M in Β· $10.00/M out
1.0M context
Most Affordable
Gemini 2.5 Pro
$1.25/M input
Largest Context
Gemini 2.5 Pro
1.0M tokens
Best Benchmark Score
Claude Sonnet 4
68.3/100

Model Specifications

SpecClaude Sonnet 4Gemini 2.5 Pro
ProviderAnthropicGoogle
Release DateMay 2025May 2025
Knowledge CutoffMar 20252025-01-31
ParametersunknownUndisclosed
Context Window200K1.0M
Max Outputβ€”β€”
Open SourceNoNo
Licenseproprietaryproprietary
Tokenizerβ€”β€”
Modalityβ€”β€”
Reasoning ModelNoNo
ModeratedNoNo

Pricing Comparison

Price (per 1M tokens)Claude Sonnet 4Gemini 2.5 Pro
Input$3.00$1.25
Output$15.00$10.00

API Provider Pricing

Capabilities

FeatureClaude Sonnet 4Gemini 2.5 Pro
Text Input
Image Input (Vision)
Audio Input
Video Input
File Input
Image Output
Audio Output
Tool Use
Structured Output (JSON)
Streaming
Reasoning Tokens
Web Search
Temperature Control
Top-P Sampling
Stop Sequences
Seed (Reproducibility)
Log Probabilities

Category Comparison

Benchmark-by-Benchmark

general

BenchmarkClaude Sonnet 4Gemini 2.5 Pro
IFEval
90.1
β€”
Chatbot Arena Elo
1310
β€”
MMLU-Pro
80.2
β€”
SimpleQAβ€”
50.8

coding

BenchmarkClaude Sonnet 4Gemini 2.5 Pro
SWE-bench Verified
53.2
63.2
HumanEval
93.8
β€”

math

BenchmarkClaude Sonnet 4Gemini 2.5 Pro
GSM8K
97.2
β€”
MATH
81.4
β€”
AIME 2024
24.5
β€”
AIME 2025β€”
83

reasoning

BenchmarkClaude Sonnet 4Gemini 2.5 Pro
BigBench-Hard
90.8
β€”
GPQA Diamond
70.5
83
Humanity's Last Examβ€”
17.8
ARC-AGI v2β€”
4.9

multimodal

BenchmarkClaude Sonnet 4Gemini 2.5 Pro
MMMU
72.5
79.6

Category Winners

coding
Claude Sonnet 4
53.9
math
Claude Sonnet 4
66.8
reasoning
Claude Sonnet 4
70.5
general
Claude Sonnet 4
90.0
multimodal
Gemini 2.5 Pro
79.3

Compare More Models

Frequently Asked Questions