- Models
- 27
- Cheapest /1M
- $0.06
- Avg blended
- $1.66
- Max context
- 1M
- Top Arena Elo
- 82
- 6-mo trend
- -2%
Labs & inference hosts
AI Providers
Compare 110 AI providers side by side — who builds each model, what their APIs cost per million tokens, how large their context windows are and how they score on benchmarks. Use it to pick the right AI vendor before you commit.
110
Providers tracked
20 labs · 90 hosts
317
Models priced
Input, output & cached rates
$0.02
Cheapest model
Mistral Nemo · Mistral AI
90
Top quality score
GPT-5.2 Pro · OpenAI
At a glance
AI provider comparison table
Every provider's model count, cheapest blended price (75% input / 25% output per 1M tokens), largest context window, best benchmark score and 6-month price trend. Click any column to sort.
- Models
- 17
- Cheapest /1M
- $0.20
- Avg blended
- $9.22
- Max context
- 1M
- Top Arena Elo
- 57.6
- 6-mo trend
- 0%
- Models
- 54
- Cheapest /1M
- $0.04
- Avg blended
- $8.22
- Max context
- 1.1M
- Top Arena Elo
- 90
- 6-mo trend
- 1%
- Models
- 7
- Cheapest /1M
- $1.25
- Avg blended
- $2.13
- Max context
- 2M
- Top Arena Elo
- 46.4
- 6-mo trend
- 23%
- Models
- 14
- Cheapest /1M
- $0.06
- Avg blended
- $0.59
- Max context
- 1.3M
- Top Arena Elo
- 48.1
- 6-mo trend
- 9%
- Models
- 15
- Cheapest /1M
- $0.04
- Avg blended
- $0.50
- Max context
- 1M
- Top Arena Elo
- 39.5
- 6-mo trend
- 32%
- Models
- 20
- Cheapest /1M
- $0.02
- Avg blended
- $0.92
- Max context
- 1M
- Top Arena Elo
- 14.2
- 6-mo trend
- -9%
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 53
- Cheapest /1M
- $0.06
- Avg blended
- $0.80
- Max context
- 1M
- Top Arena Elo
- 39.9
- 6-mo trend
- 20%
- Models
- 16
- Cheapest /1M
- $0.07
- Avg blended
- $1.27
- Max context
- 1M
- Top Arena Elo
- 44.8
- 6-mo trend
- 25%
- Models
- 8
- Cheapest /1M
- $0.37
- Avg blended
- $0.54
- Max context
- 1M
- Top Arena Elo
- 29.2
- 6-mo trend
- 45%
- Models
- 7
- Cheapest /1M
- $0.90
- Avg blended
- $1.67
- Max context
- 1M
- Top Arena Elo
- 43.6
- 6-mo trend
- 21%
- Models
- 7
- Cheapest /1M
- $0.08
- Avg blended
- $0.34
- Max context
- 1M
- Top Arena Elo
- 25.3
- 6-mo trend
- 74%
- Models
- 6
- Cheapest /1M
- $0.87
- Avg blended
- $1.88
- Max context
- 262K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 6
- Cheapest /1M
- $0.13
- Avg blended
- $0.63
- Max context
- 262K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 5
- Cheapest /1M
- $0.07
- Avg blended
- $1.94
- Max context
- 256K
- Top Arena Elo
- 13.1
- 6-mo trend
- 0%
- Models
- 5
- Cheapest /1M
- $0.07
- Avg blended
- $0.29
- Max context
- 262K
- Top Arena Elo
- 12.9
- 6-mo trend
- 89%
- Models
- 5
- Cheapest /1M
- $1.00
- Avg blended
- $4.00
- Max context
- 200K
- Top Arena Elo
- 11.8
- 6-mo trend
- 0%
- Models
- 5
- Cheapest /1M
- $0.18
- Avg blended
- $1.38
- Max context
- 1.1M
- Top Arena Elo
- 46.3
- 6-mo trend
- 0%
- Models
- 4
- Cheapest /1M
- $1.71
- Avg blended
- $6.80
- Max context
- 1M
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 3
- Cheapest /1M
- $0.15
- Avg blended
- $0.67
- Max context
- 1M
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 3
- Cheapest /1M
- $0.09
- Avg blended
- $0.17
- Max context
- 524K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $0.07
- Avg blended
- $0.22
- Max context
- 260K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $0.06
- Avg blended
- $0.08
- Max context
- 128K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $0.09
- Avg blended
- $0.35
- Max context
- 66K
- Top Arena Elo
- 5.9
- 6-mo trend
- -3%
- Models
- 2
- Cheapest /1M
- $0.90
- Avg blended
- $1.02
- Max context
- 262K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $0.04
- Avg blended
- $0.08
- Max context
- 262K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $0.49
- Avg blended
- $0.49
- Max context
- 37K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $0.07
- Avg blended
- $0.09
- Max context
- 1M
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $0.95
- Avg blended
- $1.23
- Max context
- 256K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $0.64
- Avg blended
- $1.20
- Max context
- 524K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 2
- Cheapest /1M
- $1.40
- Avg blended
- $2.58
- Max context
- 1M
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 1
- Cheapest /1M
- $0.39
- Avg blended
- $0.39
- Max context
- 262K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 1
- Cheapest /1M
- $0.63
- Avg blended
- $0.63
- Max context
- 123K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 1
- Cheapest /1M
- $6.00
- Avg blended
- $6.00
- Max context
- 1M
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 1
- Cheapest /1M
- $0.49
- Avg blended
- $0.49
- Max context
- 8K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 1
- Cheapest /1M
- $0.38
- Avg blended
- $0.38
- Max context
- 128K
- Top Arena Elo
- —
- 6-mo trend
- 0%
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
- Models
- 0
- Cheapest /1M
- —
- Avg blended
- —
- Max context
- —
- Top Arena Elo
- —
- 6-mo trend
- —
6 of 110
Visualised
AI provider price comparison charts
How average and entry-level prices differ between providers, and which vendors give the most quality per dollar.
Average vs cheapest price by provider
Blended USD per 1M tokens, excluding embedding models.
Price vs benchmark, every model
Up and to the left means better value. Price axis is logarithmic.
Directory
Every AI provider and its models
Logos, positioning, key numbers and the full model lineup for each provider — with prices linked to detailed model pages.
Gemini multimodal models via AI Studio and Vertex.
- Models
- 27
- From /1M
- $0.05
- Max context
- 1M
- Nano Banana (Gemini 2.5 Flash Image)$0.30 in · $2.50 out
- Gemini 2.5 Pro Preview 06-05$1.25 in · $10 out
- Nano Banana 2 (Gemini 3.1 Flash Image Preview)$0.50 in · $3.00 out
- Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)$0.25 in · $1.50 out
- Gemini 3.1 Flash Lite Preview$0.25 in · $1.50 out
- Gemini 3.1 Pro Preview Custom Tools$2.00 in · $12 out
- Nano Banana Pro (Gemini 3 Pro Image Preview)$2.00 in · $12 out
- Nano Banana 2.1$1.50 in · $7.50 out
- Gemma 2 27B$0.65 in · $0.65 out
- Gemma 3 12B$0.05 in · $0.15 out
- Gemma 3 27B$0.08 in · $0.45 out
- Gemma 3 4B$0.05 in · $0.10 out
- Gemma 4 26B A4B$0.09 in · $0.30 out
- Gemma 4 31B$0.09 in · $0.34 out
- Gemini 3.1 Pro (Preview)$2.00 in · $12 out
- Gemini 3.8 Flash$0.75 in · $3.75 out
- Gemini 3.7 Flash$0.75 in · $3.75 out
- Gemini 3.6 Flash$0.75 in · $3.75 out
- Gemini 3.5 Flash$1.50 in · $9.00 out
- Gemini 3 Flash (Preview)$0.50 in · $3.00 out
- Gemini 3.5 Flash-Lite$0.30 in · $2.50 out
- Gemini 3.1 Flash-Lite$0.25 in · $1.50 out
- Gemini 2.5 Flash-Lite$0.10 in · $0.40 out
- Nano Banana 2 (Gemini 3.1 Flash Image)$0.50 in · $3.00 out
- Nano Banana Pro (Gemini 3 Pro Image)$2.00 in · $12 out
- Gemini 2.5 Pro$1.25 in · $10 out
- Gemini 2.5 Flash$0.30 in · $2.50 out
Anthropic
labSafety-focused lab behind the Claude family.
- Models
- 17
- From /1M
- $0.10
- Max context
- 1M
- Claude 3 Haiku$0.25 in · $1.25 out
- Claude Fable 5$10 in · $50 out
- Claude Fable 5.1$10 in · $50 out
- Claude Haiku 4.5$1.00 in · $5.00 out
- Claude Haiku 5.5$0.10 in · $0.50 out
- Claude Opus 4.1$15 in · $75 out
- Claude Opus 4.5$5.00 in · $25 out
- Claude Opus 4.6$5.00 in · $25 out
- Claude Opus 4.7$5.00 in · $25 out
- Claude Opus 4.8$5.00 in · $25 out
- Claude Opus 5$5.00 in · $25 out
- Claude Opus 5.5$4.00 in · $20 out
- Claude Sonnet 4.5$3.00 in · $15 out
- Claude Sonnet 4.6$3.00 in · $15 out
- Claude Sonnet 5$2.00 in · $10 out
- Claude Sonnet 5.5$2.00 in · $10 out
- Claude Sonnet 4$3.00 in · $15 out
OpenAI
labCreator of GPT and o-series reasoning models.
- Models
- 54
- From /1M
- $0.02
- Max context
- 1.1M
- GPT-3.5 Turbo$0.50 in · $1.50 out
- GPT-3.5 Turbo (older v0613)$1.00 in · $2.00 out
- GPT-3.5 Turbo 16k$3.00 in · $4.00 out
- GPT-3.5 Turbo Instruct$1.50 in · $2.00 out
- GPT-4$30 in · $60 out
- GPT-4 Turbo$10 in · $30 out
- GPT-4o (2024-05-13)$5.00 in · $15 out
- GPT-4o (2024-08-06)$2.50 in · $10 out
- GPT-4o (2024-11-20)$2.50 in · $10 out
- GPT-4o-mini (2024-07-18)$0.15 in · $0.60 out
- GPT-5.1-Codex$1.25 in · $10 out
- GPT-5.1-Codex-Max$1.25 in · $10 out
- GPT-5.1-Codex-Mini$0.25 in · $2.00 out
- GPT-5.2 Chat$1.75 in · $14 out
- GPT-5.2-Codex$1.75 in · $14 out
- GPT-5.4$2.50 in · $15 out
- GPT-5.4 Image 2$8.00 in · $15 out
- GPT-5.4 Pro$30 in · $180 out
- GPT-5.5$5.00 in · $30 out
- GPT-5.5 Pro$30 in · $180 out
- GPT-5.6 Luna Pro$0.20 in · $1.20 out
- GPT-5.6 Sol Pro$2.00 in · $10 out
- GPT-5.6 Terra Pro$2.00 in · $12 out
- GPT-5 Image$10 in · $10 out
- GPT-5 Image Mini$2.50 in · $2.00 out
- GPT-6.1 Sol$2.00 in · $10 out
- GPT-6.1 Sol Pro$2.00 in · $10 out
- GPT-6 Astra$10 in · $50 out
- GPT-6 Astra Pro$10 in · $50 out
- GPT-6 Luna Pro$0.10 in · $0.50 out
- GPT-6 Sol Pro$2.00 in · $10 out
- GPT Audio$2.50 in · $10 out
- GPT Audio Mini$0.60 in · $2.40 out
- GPT Chat Latest$5.00 in · $30 out
- gpt-oss-120b$0.15 in · $0.60 out
- gpt-oss-20b$0.02 in · $0.09 out
- gpt-oss-safeguard-20b$0.07 in · $0.30 out
- o3 Mini High$1.10 in · $4.40 out
- o4 Mini High$1.10 in · $4.40 out
- GPT-6 Sol$2.00 in · $10 out
- GPT-6 Luna$0.10 in · $0.50 out
- GPT-5.6 Sol$2.00 in · $10 out
- GPT-5.6 Terra$2.00 in · $12 out
- GPT-5.6 Luna$0.20 in · $1.20 out
- GPT-5.4 mini$0.75 in · $4.50 out
- GPT-5.4 nano$0.20 in · $1.25 out
- GPT-5.3 Codex$1.75 in · $14 out
- GPT-5.2$1.75 in · $14 out
- GPT-5.2 Pro$21 in · $168 out
- GPT-5.1$1.25 in · $10 out
- GPT-4.1$2.00 in · $8.00 out
- GPT-4.1 mini$0.40 in · $1.60 out
- GPT-4o$2.50 in · $10 out
- GPT-4o mini$0.15 in · $0.60 out
xAI
labAI lab behind the Grok family of models.
- Models
- 7
- From /1M
- $1.00
- Max context
- 2M
- Grok 4.20$1.25 in · $2.50 out
- Grok 4.20 Multi-Agent$1.25 in · $2.50 out
- Grok 4.3$1.25 in · $2.50 out
- Grok 4.5$2.00 in · $6.00 out
- Grok 4.6$2.00 in · $6.00 out
- Grok 4.7$2.00 in · $6.00 out
- Grok Build 0.1$1.00 in · $2.00 out
Meta
labOpen-weight Llama models, hosted by many providers.
- Models
- 14
- From /1M
- $0.03
- Max context
- 1.3M
- Llama 3.1 70B Instruct$0.40 in · $0.40 out
- Llama 3.1 8B Instruct$0.05 in · $0.08 out
- Llama 3.2 1B Instruct$0.03 in · $0.20 out
- Llama 3.2 3B Instruct$0.05 in · $0.33 out
- Llama 3.3 70B Instruct$0.10 in · $0.32 out
- Llama 4 Maverick$0.19 in · $0.65 out
- Llama 4 Scout$0.10 in · $0.30 out
- Llama Guard 4 12B$0.18 in · $0.18 out
- Muse Glimmer 30B$0.30 in · $1.20 out
- Muse Spark 1.1$1.25 in · $4.25 out
- Muse Spark 1.2$1.25 in · $4.25 out
- Muse Spark 1.2 Contributor$0.10 in · $0.20 out
- Muse Spark 1.3$1.25 in · $4.25 out
- Muse Spark 1.3 Contributor$0.10 in · $0.20 out
DeepSeek
labAggressively priced open reasoning models.
- Models
- 15
- From /1M
- $0.02
- Max context
- 1M
- DeepSeek V3 0324$0.29 in · $1.14 out
- DeepSeek V3.1$0.25 in · $0.95 out
- R1 0528$0.50 in · $2.15 out
- R1 Distill Llama 70B$0.80 in · $0.80 out
- DeepSeek V3.1 Terminus$0.27 in · $1.00 out
- DeepSeek V3.2$0.26 in · $0.42 out
- DeepSeek V3.2 Exp$0.27 in · $0.41 out
- DeepSeek V4.1 Flash$0.05 in · $1.20 out
- DeepSeek V4 Flash 0423$0.03 in · $0.06 out
- DeepSeek V4 Flash 0731$0.02 in · $0.32 out
- DeepSeek V4 Flash Vision Exp$0.22 in · $0.65 out
- DeepSeek V4 Pro 0423$0.29 in · $0.58 out
- DeepSeek V4 Pro 0813$0.66 in · $1.98 out
- DeepSeek V3$0.26 in · $1.03 out
- DeepSeek R1$0.70 in · $2.50 out
Mistral AI
labEuropean lab with open and commercial models.
- Models
- 20
- From /1M
- $0.02
- Max context
- 1M
- Codestral 2508$0.30 in · $0.90 out
- Devstral 2 2512$0.40 in · $2.00 out
- Ministral 3 14B 2512$0.20 in · $0.20 out
- Ministral 3 3B 2512$0.10 in · $0.10 out
- Ministral 3 8B 2512$0.15 in · $0.15 out
- Mistral Large 2407$2.00 in · $6.00 out
- Mistral Large 3 2512$0.50 in · $1.50 out
- Mistral Large 4$0.68 in · $2.09 out
- Mistral Medium 3$0.40 in · $2.00 out
- Mistral Medium 3.1$0.40 in · $2.00 out
- Mistral Medium 3.5$1.50 in · $7.50 out
- Mistral Nemo$0.02 in · $0.03 out
- Saba$0.20 in · $0.60 out
- Mistral Small 3$0.05 in · $0.08 out
- Mistral Small 4$0.15 in · $0.60 out
- Mistral Small 3.1 24B$0.35 in · $0.56 out
- Mistral Small 3.2 24B$0.09 in · $0.25 out
- Mixtral 8x22B Instruct$2.00 in · $6.00 out
- Voxtral Small 24B 2507$0.10 in · $0.30 out
- Mistral Large$2.00 in · $6.00 out
Alibaba
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Alibaba pricing & modelsQwen
lab- Models
- 53
- From /1M
- $0.03
- Max context
- 1M
- Qwen2.5 72B Instruct$0.36 in · $0.40 out
- Qwen2.5 7B Instruct$0.10 in · $0.20 out
- Qwen2.5 Coder 32B Instruct$0.66 in · $1.00 out
- Qwen-Plus$0.26 in · $0.78 out
- Qwen Plus 0728$0.26 in · $0.78 out
- Qwen2.5 VL 72B Instruct$0.80 in · $1.00 out
- Qwen3 14B$0.12 in · $0.24 out
- Qwen3 235B A22B$0.46 in · $1.82 out
- Qwen3 235B A22B Instruct 2507$0.09 in · $0.55 out
- Qwen3 235B A22B Thinking 2507$0.23 in · $2.30 out
- Qwen3 30B A3B$0.12 in · $0.50 out
- Qwen3 30B A3B Instruct 2507$0.10 in · $0.30 out
- Qwen3 30B A3B Thinking 2507$0.20 in · $2.40 out
- Qwen3 32B$0.08 in · $0.28 out
- Qwen3.5-122B-A10B$0.26 in · $2.08 out
- Qwen3.5-27B$0.26 in · $2.60 out
- Qwen3.5-35B-A3B$0.15 in · $1.00 out
- Qwen3.5 397B A17B$0.45 in · $3.00 out
- Qwen3.5-9B$0.10 in · $0.15 out
- Qwen3.5-Flash$0.07 in · $0.26 out
- Qwen3.5 Plus 2026-02-15$0.26 in · $1.56 out
- Qwen3.5 Plus 2026-04-20$0.30 in · $1.80 out
- Qwen3.6 27B$0.45 in · $2.70 out
- Qwen3.6 35B A3B$0.15 in · $1.00 out
- Qwen3.6 Flash$0.19 in · $1.13 out
- Qwen3.6 Max Preview$1.03 in · $6.16 out
- Qwen3.6 Plus$0.33 in · $1.95 out
- Qwen3.7 Flash$0.03 in · $0.13 out
- Qwen3.7 Max$1.48 in · $4.42 out
- Qwen3.7 Plus$0.32 in · $1.28 out
- Qwen3.8 2.4T A95B$2.00 in · $6.00 out
- Qwen3.8 27B$0.42 in · $2.55 out
- Qwen3.8 Flash$0.15 in · $0.47 out
- Qwen3.8 Max (0902)$2.00 in · $6.00 out
- Qwen3.8 Max Prime$4.00 in · $12 out
- Qwen3.8 Omni Flash$0.15 in · $0.47 out
- Qwen3 8B$0.12 in · $0.46 out
- Qwen3 Coder 480B A35B$0.30 in · $1.00 out
- Qwen3 Coder 30B A3B Instruct$0.07 in · $0.28 out
- Qwen3 Coder Flash$0.20 in · $0.97 out
- Qwen3 Coder Next$0.12 in · $0.80 out
- Qwen3 Coder Plus$0.65 in · $3.25 out
- Qwen3 Max$0.78 in · $3.90 out
- Qwen3 Max Thinking$0.78 in · $3.90 out
- Qwen3 Next 80B A3B Instruct$0.15 in · $1.50 out
- Qwen3 Next 80B A3B Thinking$0.15 in · $1.20 out
- Qwen3 VL 235B A22B Instruct$0.21 in · $1.90 out
- Qwen3 VL 235B A22B Thinking$0.40 in · $4.00 out
- Qwen3 VL 30B A3B Instruct$0.15 in · $0.60 out
- Qwen3 VL 30B A3B Thinking$0.20 in · $2.40 out
- Qwen3 VL 32B Instruct$0.10 in · $0.42 out
- Qwen3 VL 8B Instruct$0.12 in · $0.46 out
- Qwen3 VL 8B Thinking$0.18 in · $2.10 out
Z.ai
lab- Models
- 16
- From /1M
- $0.04
- Max context
- 1M
- GLM 4.5$0.60 in · $2.20 out
- GLM 4.5 Air$0.13 in · $0.85 out
- GLM 4.5V$0.60 in · $1.80 out
- GLM 4.6$0.43 in · $1.75 out
- GLM 4.6V$0.30 in · $0.90 out
- GLM 4.7$0.60 in · $2.20 out
- GLM 4.7 Flash$0.06 in · $0.40 out
- GLM 5$0.60 in · $1.92 out
- GLM 5.1$0.97 in · $3.04 out
- GLM 5.2$0.17 in · $10 out
- GLM 5.3$1.40 in · $3.39 out
- GLM 5.3 Flash$0.04 in · $0.14 out
- GLM 5.3 FlashX$0.37 in · $1.25 out
- GLM 5.3 Prime$2.80 in · $8.80 out
- GLM 5 Turbo$1.20 in · $4.00 out
- GLM 5V Turbo$1.20 in · $4.00 out
MiniMax
lab- Models
- 8
- From /1M
- $0.20
- Max context
- 1M
- MiniMax-01$0.20 in · $1.10 out
- MiniMax M1$0.55 in · $2.20 out
- MiniMax M2$0.30 in · $1.20 out
- MiniMax M2.1$0.30 in · $1.20 out
- MiniMax M2.5$0.27 in · $1.08 out
- MiniMax M2.7$0.21 in · $0.84 out
- MiniMax M2-her$0.30 in · $1.20 out
- MiniMax M3$0.30 in · $1.20 out
MoonshotAI
lab- Models
- 7
- From /1M
- $0.44
- Max context
- 1M
- Kimi K2 0711$0.57 in · $2.30 out
- Kimi K2 0905$0.60 in · $2.50 out
- Kimi K2.5$0.45 in · $2.25 out
- Kimi K2.6$0.44 in · $2.45 out
- Kimi K2.7 Code$0.67 in · $3.35 out
- Kimi K2 Thinking$0.60 in · $2.50 out
- Kimi K3$3.00 in · $12 out
Tencent
lab- Models
- 7
- From /1M
- $0.04
- Max context
- 1M
- Hunyuan A13B Instruct$0.14 in · $0.57 out
- Hy-MT2-1.8B$0.04 in · $0.18 out
- Hy-MT2-30B-A3B$0.07 in · $0.29 out
- Hy-MT2-7B$0.07 in · $0.29 out
- Hy3$0.13 in · $0.53 out
- Hy3 preview$0.18 in · $0.60 out
- Hy4 preview$0.83 in · $2.50 out
AionLabs
lab- Models
- 6
- From /1M
- $0.70
- Max context
- 262K
- Aion-2.0$0.80 in · $1.60 out
- Aion-3.0$3.00 in · $6.00 out
- Aion-3.0-Mini$0.70 in · $1.40 out
- Aion 3.5$3.00 in · $6.00 out
- Aion 3.5 Mini$0.70 in · $1.40 out
- Aion-RP 1.0 (8B)$0.80 in · $1.60 out
- Models
- 6
- From /1M
- $0.07
- Max context
- 262K
- Seed 1.6$0.25 in · $2.00 out
- Seed 1.6 Flash$0.07 in · $0.30 out
- Seed-2.0-Code$0.50 in · $3.00 out
- Seed-2.0-Lite$0.25 in · $2.00 out
- Seed-2.0-Mini$0.10 in · $0.40 out
- Seed 2.1 Turbo$0.50 in · $2.50 out
Cohere
lab- Models
- 5
- From /1M
- $0.04
- Max context
- 256K
- Command A$2.50 in · $10 out
- Command A+$0.30 in · $1.50 out
- Command R (08-2024)$0.15 in · $0.60 out
- Command R+ (08-2024)$2.50 in · $10 out
- Command R7B (12-2024)$0.04 in · $0.15 out
NVIDIA
lab- Models
- 5
- From /1M
- $0.05
- Max context
- 262K
- Nemotron 3.5 Content Safety$0.20 in · $0.20 out
- Nemotron 3.5 Lightning$0.05 in · $0.14 out
- Nemotron 3 Nano 30B A3B$0.06 in · $0.24 out
- Nemotron 3 Super$0.09 in · $0.40 out
- Nemotron 3 Ultra$0.50 in · $2.20 out
Perplexity
lab- Models
- 5
- From /1M
- $1.00
- Max context
- 200K
- Sonar$1.00 in · $1.00 out
- Sonar Deep Research$2.00 in · $8.00 out
- Sonar Pro$3.00 in · $15 out
- Sonar Pro Search$3.00 in · $15 out
- Sonar Reasoning Pro$2.00 in · $8.00 out
Xiaomi
lab- Models
- 5
- From /1M
- $0.14
- Max context
- 1.1M
- MiMo-V2.5$0.14 in · $0.28 out
- MiMo-V2.5-Pro$0.43 in · $0.87 out
- MiMo-V2.6-Flash$0.14 in · $0.28 out
- MiMo-V2.6-Pro$0.43 in · $0.87 out
- MiMo-V2.6-Pro-UltraSpeed$4.35 in · $8.70 out
Sakana AI
host- Models
- 4
- From /1M
- $0.95
- Max context
- 1M
- Fugu Max$2.00 in · $6.00 out
- Fugu Ultra$5.00 in · $30 out
- Fugu Ultra v2$5.00 in · $30 out
- Sakana Namazu$0.95 in · $4.00 out
StepFun
host- Models
- 3
- From /1M
- $0.10
- Max context
- 1M
- Step 3.5 Flash$0.10 in · $0.30 out
- Step 3.7 Flash$0.20 in · $1.15 out
- Step 5 Preview$1.00 in · $2.70 out
Upstage
host- Models
- 3
- From /1M
- $0.05
- Max context
- 524K
Inception
host- Models
- 2
- From /1M
- $0.04
- Max context
- 260K
InferenceNet
host- Models
- 2
- From /1M
- $0.03
- Max context
- 128K
Microsoft
labPhi small language models and Azure AI hosting.
- Models
- 2
- From /1M
- $0.07
- Max context
- 66K
Morph
host- Models
- 2
- From /1M
- $0.80
- Max context
- 262K
Nex AGI
host- Models
- 2
- From /1M
- $0.03
- Max context
- 262K
Perceptron
host- Models
- 2
- From /1M
- $0.15
- Max context
- 37K
Poolside
host- Models
- 2
- From /1M
- $0.06
- Max context
- 1M
Relace
host- Models
- 2
- From /1M
- $0.85
- Max context
- 256K
- Models
- 2
- From /1M
- $0.45
- Max context
- 524K
Unbiased
host- Models
- 2
- From /1M
- $0.80
- Max context
- 1M
Arcee AI
host- Models
- 1
- From /1M
- $0.25
- Max context
- 262K
Baidu
host- Models
- 1
- From /1M
- $0.42
- Max context
- 123K
Fireworks
host- Models
- 1
- From /1M
- $3.00
- Max context
- 1M
Mancer 2
host- Models
- 1
- From /1M
- $0.40
- Max context
- 8K
Venice
host- Models
- 1
- From /1M
- $0.20
- Max context
- 128K
AI21
hostAI21 Labs is an Israeli company specializing in natural language processing (NLP), developing advanced AI systems and foundation models designed for enterprise applications. Their mission is to empower businesses with state-of-the-art Large Language Models (LLMs) and AI applications to redefine how humans interact with text.
- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
AI21 pricing & modelsAkashML
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
AkashML pricing & modelsAmazon Bedrock
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Amazon Bedrock pricing & modelsAmazon Nova
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Amazon Nova pricing & modelsAmbient
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Ambient pricing & modelsAssemblyAI
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
AssemblyAI pricing & modelsAtlasCloud
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
AtlasCloud pricing & modelsAvian
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Avian pricing & modelsAzure
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Azure pricing & modelsBaseTen
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
BaseTen pricing & models- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Black Forest Labs pricing & modelsCerebras
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Cerebras pricing & modelsChutes
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Chutes pricing & modelsCirrascale
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Cirrascale pricing & modelsClarifai
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Clarifai pricing & models- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Claude Platform on AWS pricing & modelsCosine
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Cosine pricing & modelsCrucible
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Crucible pricing & modelsCrusoe
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Crusoe pricing & modelsDarkbloom
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Darkbloom pricing & modelsDatabricks
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Databricks pricing & modelsDecart
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Decart pricing & modelsDeepgram
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Deepgram pricing & modelsDeepInfra
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
DeepInfra pricing & modelsDekaLLM
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
DekaLLM pricing & modelsDigitalOcean
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
DigitalOcean pricing & modelsFakeProvider
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
FakeProvider pricing & modelsFeatherless
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Featherless pricing & modelsFish Audio
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Fish Audio pricing & modelsFriendli
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Friendli pricing & modelsGMICloud
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
GMICloud pricing & modelsGoogle AI Studio
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Google AI Studio pricing & modelsGroq
hostLPU-powered ultra low latency inference.
- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Groq pricing & modelsHeyGen
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
HeyGen pricing & modelsInceptron
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Inceptron pricing & modelsInferact vLLM
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Inferact vLLM pricing & modelsInfermatic
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Infermatic pricing & modelsInflection
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Inflection pricing & modelsIo Net
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Io Net pricing & modelsIonstream
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Ionstream pricing & modelsKrea
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Krea pricing & modelsLiquid
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Liquid pricing & modelsMakora
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Makora pricing & modelsMara
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Mara pricing & modelsModelRun
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
ModelRun pricing & modelsModular
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Modular pricing & modelsNear AI
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Near AI pricing & modelsNebius
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Nebius pricing & modelsNextBit
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
NextBit pricing & modelsNovita
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Novita pricing & modelsOllama
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Ollama pricing & modelsOpenInference
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
OpenInference pricing & modelsParasail
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Parasail pricing & modelsPhala
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Phala pricing & modelsPrimeIntellect
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
PrimeIntellect pricing & modelsQuiver
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Quiver pricing & modelsRecraft
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Recraft pricing & modelsReka
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Reka pricing & modelsRunway
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Runway pricing & modelsSail Research
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Sail Research pricing & modelsSambaNova
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
SambaNova pricing & modelsSeed
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Seed pricing & modelsSiliconFlow
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
SiliconFlow pricing & modelsSourceful
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Sourceful pricing & modelsStealth
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Stealth pricing & modelsStreamLake
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
StreamLake pricing & modelsSwitchpoint
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Switchpoint pricing & modelsTenstorrent
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Tenstorrent pricing & modelsTogether AI
hostInference host for open-weight models.
- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Together AI pricing & modelsTypeSafe
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
TypeSafe pricing & modelsVoyage AI
labRetrieval-focused embedding and reranking models.
- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Voyage AI pricing & models- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
VoyageAI by MongoDB pricing & modelsWafer
host- Models
- 0
- From /1M
- —
- Max context
- —
Hosts open-weight models such as Llama 3.3 70B. Dedicated pricing coming soon.
Wafer pricing & modelsAI labs: who builds the models
Labs train foundation models and sell first-party API access. Pricing is set by the lab, and new models and price cuts usually appear here first.
Inference hosts: who serves them
Hosts run open-weight models such as Llama or DeepSeek on their own hardware. The same model can cost very different amounts, and run at different speeds, depending on the host.
Head to head
Popular cross-provider comparisons
Flagship models from rival providers, compared on price, context and benchmark.
FAQ
AI provider questions, answered
Which AI provider is the cheapest?
Right now the lowest blended price we track is Mistral Nemo from Mistral AI at $0.02 per 1M tokens. Open-weight models served by hosts are often the cheapest route for high-volume workloads.
Which AI provider has the best models?
GPT-5.2 Pro from OpenAI has the highest measured quality score in our dataset (quality score 90 · Arena Elo 1255 · MMLU-Pro 82.8%). The best choice still depends on your task, latency and budget.
Which provider offers the largest context window?
Grok 4.20 from xAI supports up to 2M tokens.
What is the difference between an AI lab and an inference host?
A lab trains and publishes its own models; an inference host runs models (usually open-weight ones) on its infrastructure and sells API access to them.
How is the blended price calculated?
Blended price assumes a typical 3:1 input-to-output token ratio: 75% of the input price plus 25% of the output price, per 1M tokens.
How often are provider prices updated?
Prices are checked against official pricing pages and every change is stored with its date, so the history charts show exactly when a provider changed its rates. Always confirm with the vendor before committing.
