All Comparisons

Claude Haiku 4.5 vs o4-mini
Claude Haiku 4.5
Anthropic 🇺🇸
59.0
#140—
medium$1.00/M in · $5.00/M out
200K context
o4-mini
OpenAI 🇺🇸
57.1
#155—
highMost Affordable
Claude Haiku 4.5
$1.00/M input
Largest Context
Claude Haiku 4.5
200K tokens
Best Benchmark Score
Claude Haiku 4.5
59.0/100
Model Specifications
| Spec | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| Provider | Anthropic | OpenAI |
| Release Date | Oct 2025 | Apr 2025 |
| Knowledge Cutoff | 2025-02-01 | 2024-05-31 |
| Parameters | Undisclosed | Undisclosed |
| Context Window | 200K | — |
| Max Output | — | — |
| Open Source | No | No |
| License | proprietary | proprietary |
| Tokenizer | — | — |
| Modality | — | — |
| Reasoning Model | No | No |
| Moderated | No | No |
Pricing Comparison
| Price (per 1M tokens) | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| Input | $1.00 | — |
| Output | $5.00 | — |
API Provider Pricing
Capabilities
| Feature | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| Text Input | ||
| Image Input (Vision) | ||
| Audio Input | ||
| Video Input | ||
| File Input | ||
| Image Output | ||
| Audio Output | ||
| Tool Use | ||
| Structured Output (JSON) | ||
| Streaming | ||
| Reasoning Tokens | ||
| Web Search | ||
| Temperature Control | ||
| Top-P Sampling | ||
| Stop Sequences | ||
| Seed (Reproducibility) | ||
| Log Probabilities |
Category Comparison
Benchmark-by-Benchmark
general
| Benchmark | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| MMMLU | 83 | — |
coding
| Benchmark | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| SWE-bench Verified | 73.3 | 68.1 |
| TerminalBench | 41 | — |
math
| Benchmark | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| AIME 2025 | 80.7 | 92.7 |
reasoning
| Benchmark | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| GPQA Diamond | 73 | 81.4 |
| Humanity's Last Exam | — | 14.7 |
agent
| Benchmark | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| OSWorld | 50.7 | — |
| BrowseComp | — | 51.5 |
| TAU-Bench Retail | — | 71.8 |
multimodal
| Benchmark | Claude Haiku 4.5 | o4-mini |
|---|---|---|
| MMMU | — | 81.6 |
| CharXiv Reasoning | — | 72 |
Category Winners
coding
70.3
math
74.3
reasoning
60.2
general
48.8
multimodal
62.5
agent
57.3