LLM API Pricing Calculator
Enter your tokens per request and requests per month to estimate what each of 36 LLM API models would cost at the official price. For example, 2,000 input and 500 output tokens per request, 10,000 times a month, costs about $250 on GPT-5.5.
Prices checked Oct 10, 2026
Cost per request
$0.03
Cost per month
$250
GPT-5.5 price per 1M tokens
$5.00 in / $30.00 out
Every model for this usage
Monthly cost of the same usage on each model, cheapest first.
| Rank | Model | Family | Per request | Per month |
|---|---|---|---|---|
| 1 | DeepSeek V4 Flash | DeepSeek | $0.00042 | $4.20 |
| 2 | MiMo V2.5 | MiMo | $0.00042 | $4.20 |
| 3 | GPT-6 Luna | OpenAI | $0.00045 | $4.50 |
| 4 | Qwen3.5 Plus | Qwen | $0.0006 | $5.96 |
| 5 | Step 3.7 Flash | StepFun | $0.001 | $10.06 |
| 6 | GPT-5.4 Nano | OpenAI | $0.001 | $10.25 |
| 7 | Qwen3.7 Plus | Qwen | $0.0012 | $11.93 |
| 8 | MiniMax M3 | MiniMax | $0.0012 | $12.00 |
| 9 | MiniMax M2.7 | MiniMax | $0.0012 | $12.00 |
| 10 | MiniMax M2.5 | MiniMax | $0.0012 | $12.00 |
| 11 | Gemini 3.1 Flash-Lite | Gemini | $0.0013 | $12.50 |
| 12 | DeepSeek V4 Pro | DeepSeek | $0.0013 | $13.05 |
| 13 | MiMo V2.5 Pro | MiMo | $0.0013 | $13.05 |
| 14 | Qwen3.6 Plus | Qwen | $0.0015 | $14.91 |
| 15 | Qwen3 Coder Plus | Qwen | $0.0024 | $23.86 |
| 16 | Gemini 3 Flash Preview | Gemini | $0.0025 | $25.00 |
| 17 | GLM-5 | GLM | $0.0025 | $25.35 |
| 18 | Kimi K2.5 | Kimi | $0.0028 | $27.59 |
| 19 | GLM-5.1 | GLM | $0.0036 | $35.79 |
| 20 | GPT-5.4 Mini | OpenAI | $0.0038 | $37.50 |
| 21 | Kimi K2.6 | Kimi | $0.004 | $39.51 |
| 22 | Claude Haiku 4.5 | Claude | $0.0045 | $45.00 |
| 23 | Qwen3.7 Max | Qwen | $0.0063 | $62.63 |
| 24 | GPT-6 Sol | OpenAI | $0.009 | $90.00 |
| 25 | Claude Sonnet 5 | Claude | $0.009 | $90.00 |
| 26 | Gemini 3.1 Pro Preview | Gemini | $0.01 | $100 |
| 27 | GPT-5.4 | OpenAI | $0.01 | $125 |
| 28 | Kimi K3 | Kimi | $0.01 | $134 |
| 29 | Claude Sonnet 4.6 | Claude | $0.01 | $135 |
| 30 | Claude Opus 5 | Claude | $0.02 | $225 |
| 31 | Claude Opus 4.8 | Claude | $0.02 | $225 |
| 32 | Claude Opus 4.7 | Claude | $0.02 | $225 |
| 33 | Claude Opus 4.6 | Claude | $0.02 | $225 |
| 34 | GPT-5.5 | OpenAI | $0.03 | $250 |
| 35 | GPT-6 Astra | OpenAI | $0.05 | $450 |
| 36 | Claude Fable 5 | Claude | $0.05 | $450 |
FAQ
How is the API cost calculated?
Cost per request = input tokens × input price + output tokens × output price, with prices per 1 million tokens. Cached input tokens use the cached-input price when the provider publishes one.
How many tokens is a word?
For English text, 1,000 tokens is roughly 750 words. Code, other languages and images use different amounts, so check with your provider's tokenizer for exact counts.
Does the calculator include batch or long-context pricing?
No. It uses the standard official rate. Batch processing is usually cheaper, and some models charge more above a long-context threshold.
Related pricing
- Compare all LLM API prices
- OpenAI API pricing
- Claude API pricing
- Gemini API pricing
- DeepSeek API pricing
- Qwen API pricing
- Kimi API pricing
- MiniMax API pricing
- GLM API pricing
- Xiaomi MiMo API pricing
- Grok API pricing
- Mistral API pricing
- Claude Opus API pricing
- Claude Sonnet API pricing
- GPT-5 API pricing
- Gemini Pro API pricing
- Cheapest LLM API
Estimates use official standard prices per 1M tokens and do not include taxes, batch or long-context rates, or free tiers. BiWu.Ai does not sell API access; check the provider's pricing page before you build on it.