Models, measured side by side
Gemini 2.5 Flash vs GPT-4o mini
Compare Gemini 2.5 Flash, GPT-4o mini by token pricing, context length, benchmark results, speed and tool support.
Monthly workload
Monthly cost breakdown
InputOutput
Gemini 2.5 Flash
$19 / mo
GPT-4o mini
$6.00 / mo
Performance comparison
Gemini 2.5 Flash
9.9
GPT-4o mini
6.7
Overview
Pricing & capacity
| Pricing & capacity | Gemini 2.5 Flash | GPT-4o mini |
|---|---|---|
| Input / 1M tokens | $0.30 | $0.15 |
| Output / 1M tokens | $2.50 | $0.60 |
| Cached input / 1M | $0.03 | $0.07 |
| Monthly cost | $19 | $6.00 |
| Context window | 1M | 128K |
| Maximum output | 66K | 16K |
Input / 1M tokens
- Gemini 2.5 Flash
- $0.30
- GPT-4o mini
- $0.15
Output / 1M tokens
- Gemini 2.5 Flash
- $2.50
- GPT-4o mini
- $0.60
Cached input / 1M
- Gemini 2.5 Flash
- $0.03
- GPT-4o mini
- $0.07
Monthly cost
- Gemini 2.5 Flash
- $19
- GPT-4o mini
- $6.00
Context window
- Gemini 2.5 Flash
- 1M
- GPT-4o mini
- 128K
Maximum output
- Gemini 2.5 Flash
- 66K
- GPT-4o mini
- 16K
Benchmarks & performance
| Benchmarks & performance | Gemini 2.5 Flash | GPT-4o mini |
|---|---|---|
| Arena Elo | 1,200 | 1,123 |
| MMLU-Pro | 73.6% | 60.7% |
| Intelligence Index | 9.9 | 6.7 |
| GPQA | 68.3% | 42.6% |
| Humanity’s Last Exam | 4.7% | 4.2% |
| SciCode | Not listed | Not listed |
| Output speed | 190 tokens/s | 89 tokens/s |
| Time to first token | 0.46 s | 0.88 s |
| DesignArena rating | 1,063 | Not listed |
| DesignArena win rate | 45.4% | Not listed |
Arena Elo
- Gemini 2.5 Flash
- 1,200
- GPT-4o mini
- 1,123
MMLU-Pro
- Gemini 2.5 Flash
- 73.6%
- GPT-4o mini
- 60.7%
Intelligence Index
- Gemini 2.5 Flash
- 9.9
- GPT-4o mini
- 6.7
GPQA
- Gemini 2.5 Flash
- 68.3%
- GPT-4o mini
- 42.6%
Humanity’s Last Exam
- Gemini 2.5 Flash
- 4.7%
- GPT-4o mini
- 4.2%
SciCode
- Gemini 2.5 Flash
- Not listed
- GPT-4o mini
- Not listed
Output speed
- Gemini 2.5 Flash
- 190 tokens/s
- GPT-4o mini
- 89 tokens/s
Time to first token
- Gemini 2.5 Flash
- 0.46 s
- GPT-4o mini
- 0.88 s
DesignArena rating
- Gemini 2.5 Flash
- 1,063
- GPT-4o mini
- Not listed
DesignArena win rate
- Gemini 2.5 Flash
- 45.4%
- GPT-4o mini
- Not listed
6 of 10
Tools & features
| Tools & features | Gemini 2.5 Flash | GPT-4o mini |
|---|---|---|
| Function calling | Supported | Supported |
| Structured outputs | Supported | Supported |
| JSON mode | Supported | Supported |
| Reasoning | Supported | Not listed |
| Built-in web search | Not listed | Supported |
| Log probabilities | Not listed | Supported |
| Deterministic seed | Supported | Supported |
| Parallel tool calls | Not listed | Not listed |
| Prompt caching | Supported | Supported |
Function calling
- Gemini 2.5 Flash
- Supported
- GPT-4o mini
- Supported
Structured outputs
- Gemini 2.5 Flash
- Supported
- GPT-4o mini
- Supported
JSON mode
- Gemini 2.5 Flash
- Supported
- GPT-4o mini
- Supported
Reasoning
- Gemini 2.5 Flash
- Supported
- GPT-4o mini
- Not listed
Built-in web search
- Gemini 2.5 Flash
- Not listed
- GPT-4o mini
- Supported
Log probabilities
- Gemini 2.5 Flash
- Not listed
- GPT-4o mini
- Supported
Deterministic seed
- Gemini 2.5 Flash
- Supported
- GPT-4o mini
- Supported
Parallel tool calls
- Gemini 2.5 Flash
- Not listed
- GPT-4o mini
- Not listed
Prompt caching
- Gemini 2.5 Flash
- Supported
- GPT-4o mini
- Supported
6 of 9
API & availability
| API & availability | Gemini 2.5 Flash | GPT-4o mini |
|---|---|---|
| API identifier | gemini-2.5-flash | gpt-4o-mini |
| API providers | Google, Google, Google, Google AI Studio, Google AI Studio, Google, Google AI Studio | Azure, OpenAI, Azure |
| Knowledge cutoff | 2025-01-31 | 2023-10-31 |
| Prices checked | Oct 8, 2026 | Oct 8, 2026 |
API identifier
- Gemini 2.5 Flash
gemini-2.5-flash- GPT-4o mini
gpt-4o-mini
API providers
- Gemini 2.5 Flash
- Google, Google, Google, Google AI Studio, Google AI Studio, Google, Google AI Studio
- GPT-4o mini
- Azure, OpenAI, Azure
Knowledge cutoff
- Gemini 2.5 Flash
- 2025-01-31
- GPT-4o mini
- 2023-10-31
Prices checked
- Gemini 2.5 Flash
- Oct 8, 2026
- GPT-4o mini
- Oct 8, 2026
About the models
Comparison FAQ
Gemini 2.5 Flash: $0.30 input and $2.50 output per million tokens. GPT-4o mini: $0.15 input and $0.60 output per million tokens. The cheaper choice depends on your input-to-output ratio; a model can have a lower input rate but a higher output rate.
