All Comparisons

GPT-4o mini vs o4-mini

GPT-4o mini
OpenAI πŸ‡ΊπŸ‡Έ
41.4
#217β€”
high
$0.15/M in Β· $0.60/M out
128K context
o4-mini
OpenAI πŸ‡ΊπŸ‡Έ
57.1
#155β€”
high
Most Affordable
GPT-4o mini
$0.15/M input
Largest Context
GPT-4o mini
128K tokens
Best Benchmark Score
o4-mini
57.1/100

Model Specifications

SpecGPT-4o minio4-mini
ProviderOpenAIOpenAI
Release DateJul 2024Apr 2025
Knowledge CutoffOct 20232024-05-31
ParametersunknownUndisclosed
Context Window128Kβ€”
Max Outputβ€”β€”
Open SourceNoNo
Licenseproprietaryproprietary
Tokenizerβ€”β€”
Modalityβ€”β€”
Reasoning ModelNoNo
ModeratedNoNo

Pricing Comparison

Price (per 1M tokens)GPT-4o minio4-mini
Input$0.15β€”
Output$0.60β€”

API Provider Pricing

Capabilities

FeatureGPT-4o minio4-mini
Text Input
Image Input (Vision)
Audio Input
Video Input
File Input
Image Output
Audio Output
Tool Use
Structured Output (JSON)
Streaming
Reasoning Tokens
Web Search
Temperature Control
Top-P Sampling
Stop Sequences
Seed (Reproducibility)
Log Probabilities

Category Comparison

Benchmark-by-Benchmark

general

BenchmarkGPT-4o minio4-mini
Chatbot Arena Elo
1219
β€”
IFEval
80.1
β€”
MMLU-Pro
63.2
β€”

coding

BenchmarkGPT-4o minio4-mini
HumanEval
87.2
β€”
SWE-bench Verifiedβ€”
68.1

math

BenchmarkGPT-4o minio4-mini
GSM8K
93.2
β€”
MATH
70.2
β€”
AIME 2025β€”
92.7

reasoning

BenchmarkGPT-4o minio4-mini
ARC-Challenge
93.1
β€”
GPQA Diamond
40.2
81.4
BigBench-Hard
78.5
β€”
Humanity's Last Examβ€”
14.7

language

BenchmarkGPT-4o minio4-mini
HellaSwag
91.2
β€”
WinoGrande
82.3
β€”

safety

BenchmarkGPT-4o minio4-mini
TruthfulQA
65.8
β€”

multimodal

BenchmarkGPT-4o minio4-mini
MMMUβ€”
81.6
CharXiv Reasoningβ€”
72

agent

BenchmarkGPT-4o minio4-mini
BrowseCompβ€”
51.5
TAU-Bench Retailβ€”
71.8

Category Winners

coding
GPT-4o mini
61.6
math
o4-mini
74.3
reasoning
o4-mini
46.0
general
GPT-4o mini
34.6
language
GPT-4o mini
35.0
multimodal
o4-mini
62.5
safety
GPT-4o mini
62.9
agent
o4-mini
43.4

Compare More Models

Frequently Asked Questions