inspired by: gputable.dev · Brandon @burcs
ModelTable - LLM prices · all providers
18 rows. Prices USD / 1M tokens.
| Model | Via | $/M in | $/M out | Cache R | Cache W | Blend | vs cheapest | Ctx | |
|---|---|---|---|---|---|---|---|---|---|
| NVIDIA Nemotron 3.5 Lightning 30B A3B | — | $0.050 | $0.200 | $0.010 | — | $0.163 | cheapest | 262k | src |
| OpenAI GPT OSS 120B | — | $0.150 | $0.600 | $0.015 | — | $0.487 | +144% vs Novita | 131k | src |
| DeepSeek V4 Flash (0731) | — | $0.220 | $0.660 | $0.0070 | — | $0.550 | cheapest | 1M | src |
| MiniMax M3 | — | $0.300 | $1.20 | $0.060 | — | $0.975 | 0% vs Novita | 512k | src |
| Muse Glimmer 30B | — | $0.350 | $1.50 | $0.040 | — | $1.21 | +35% vs OpenRouter | 131k | src |
| Qwen 3.7 Plus | — | $0.400 | $1.60 | $0.080 | — | $1.30 | cheapest | 262k | src |
| NVIDIA Nemotron 3 Ultra (Preview) | — | $0.600 | $2.40 | $0.120 | — | $1.95 | cheapest | 262k | src |
| Kimi K2.6 | — | $0.950 | $4.00 | $0.160 | — | $3.24 | +18% vs Novita | 262k | src |
| Kimi K2.7 Code | — | $0.950 | $4.00 | $0.190 | — | $3.24 | +19% vs OpenRouter | 262k | src |
| DeepSeek V4 Pro (0813) | — | $1.32 | $3.96 | $0.044 | — | $3.30 | cheapest | 1M | src |
| GLM 5.2 | — | $1.40 | $4.40 | $0.140 | — | $3.65 | +73% vs Vercel AI Gateway | 1.0M | src |
| GLM 5.3 | — | $1.40 | $4.40 | $0.260 | — | $3.65 | +11% vs OpenRouter | 1M | src |
| Qwen 3.8 Max | — | $2.00 | $6.00 | $0.250 | — | $5.00 | cheapest | 262k | src |
| GLM 5.2 Fast | — | $2.10 | $6.60 | $0.210 | — | $5.47 | cheapest | src | |
| GLM 5.2 Fast US | — | $2.10 | $6.60 | $0.210 | — | $5.47 | cheapest | src | |
| Kimi K3 | — | $3.00 | $15.00 | $0.300 | — | $12.00 | 0% vs Novita | 1.0M | src |
| Kimi K3 US | — | $3.30 | $16.50 | $0.330 | — | $13.20 | cheapest | src | |
| Kimi K3 Fast | — | $4.50 | $22.50 | $0.450 | — | $18.00 | cheapest | 1.0M | src |
created by: @dunder_bird