All Comparisons
Gemini 2.5 Pro vs Llama 4 Maverick
Gemini 2.5 Pro
Google πΊπΈ
53.6
#156β
medium$1.25/M in Β· $10.00/M out
1.0M context
M
Llama 4 Maverick
Meta πΊπΈ
52.1
#160β
lowMost Affordable
Gemini 2.5 Pro
$1.25/M input
Largest Context
Gemini 2.5 Pro
1.0M tokens
Best Benchmark Score
Gemini 2.5 Pro
53.6/100
Model Specifications
| Spec | Gemini 2.5 Pro | Llama 4 Maverick |
|---|---|---|
| Provider | Meta | |
| Release Date | May 2025 | Apr 2025 |
| Knowledge Cutoff | 2025-01-31 | β |
| Parameters | Undisclosed | 400000000000B |
| Context Window | 1.0M | β |
| Max Output | β | β |
| Open Source | No | Yes |
| License | proprietary | llama_4_community_license_agreement |
| Tokenizer | β | β |
| Modality | β | β |
| Reasoning Model | No | No |
| Moderated | No | No |
Pricing Comparison
| Price (per 1M tokens) | Gemini 2.5 Pro | Llama 4 Maverick |
|---|---|---|
| Input | $1.25 | β |
| Output | $10.00 | β |
API Provider Pricing
Capabilities
| Feature | Gemini 2.5 Pro | Llama 4 Maverick |
|---|---|---|
| Text Input | ||
| Image Input (Vision) | ||
| Audio Input | ||
| Video Input | ||
| File Input | ||
| Image Output | ||
| Audio Output | ||
| Tool Use | ||
| Structured Output (JSON) | ||
| Streaming | ||
| Reasoning Tokens | ||
| Web Search | ||
| Temperature Control | ||
| Top-P Sampling | ||
| Stop Sequences | ||
| Seed (Reproducibility) | ||
| Log Probabilities |
Category Comparison
Benchmark-by-Benchmark
general
| Benchmark | Gemini 2.5 Pro | Llama 4 Maverick |
|---|---|---|
| SimpleQA | 50.8 | β |
coding
| Benchmark | Gemini 2.5 Pro | Llama 4 Maverick |
|---|---|---|
| SWE-bench Verified | 63.2 | β |
math
| Benchmark | Gemini 2.5 Pro | Llama 4 Maverick |
|---|---|---|
| AIME 2025 | 83 | β |
reasoning
| Benchmark | Gemini 2.5 Pro | Llama 4 Maverick |
|---|---|---|
| GPQA Diamond | 83 | 69.8 |
| Humanity's Last Exam | 17.8 | β |
| ARC-AGI v2 | 4.9 | β |
Category Winners
coding
44.1
math
57.6
reasoning
M
Llama 4 Maverick54.8
general
69.1
multimodal
80.0