AI Model Pricing Comparison — API Costs for 466 Models
Compare costs across all models. Calculate your monthly spend based on usage.
Estimate your cost
| Model | Provider | Cost Visualization | ||||
|---|---|---|---|---|---|---|
| Phi-4 Mini open source | Microsoft | Free | Free | 131K | 150 tok/s | |
| Lyria 3 Clip Preview budget | Free | Free | 1.0M | — | ||
| Lyria 3 Pro Preview budget | Free | Free | 1.0M | — | ||
| Devstral Small 2 open source | Mistral | Free | Free | 256K | — | |
| Gemma 2 2b It open source | NVIDIA | Free | Free | 128K | — | |
| GLM-4.5-Flash open source | Zhipu AI | Free | Free | 131K | — | |
| North Mini Code open source | Cohere | Free | Free | 256K | — | |
| Qwen Image budget | NVIDIA | Free | Free | 0 | — | |
| Qwen Image Edit budget | NVIDIA | Free | Free | 0 | — | |
| Mistral Large 3 675B Instruct 2512 open source | NVIDIA | Free | Free | 262K | — | |
| Ministral 3 14B Instruct 2512 open source | NVIDIA | Free | Free | 262K | — | |
| mistral-small-4-119b-2603 open source | NVIDIA | Free | Free | 128K | — | |
| Mistral: Mixtral 8x7B Instruct open source | NVIDIA | Free | Free | 33K | — | |
| Mistral-7B-Instruct-v0.3 open source | NVIDIA | Free | Free | 66K | — | |
| Magistral Small 2506 budget | NVIDIA | Free | Free | 33K | — | |
| streampetr open source | NVIDIA | Free | Free | 128K | — | |
| Llama 3.3 Nemotron Super 49B v1.5 open source | NVIDIA | Free | Free | 131K | — | |
| usdcode budget | NVIDIA | Free | Free | 128K | — | |
| Nemotron 3 Nano Omni open source | NVIDIA | Free | Free | 256K | — | |
| cosmos-transfer1-7b open source | NVIDIA | Free | Free | 0 | — | |
| nemotron-voicechat open source | NVIDIA | Free | Free | 128K | — | |
| studiovoice open source | NVIDIA | Free | Free | 128K | — | |
| nemotron-3-content-safety open source | NVIDIA | Free | Free | 128K | — | |
| cosmos-transfer2.5-2b open source | NVIDIA | Free | Free | 0 | — | |
| bevformer open source | NVIDIA | Free | Free | 128K | — | |
| Llama 3.1 Nemotron Nano VL 8B v1 open source | NVIDIA | Free | Free | 33K | — | |
| llama-nemotron-embed-vl-1b-v2 open source | NVIDIA | Free | Free | 33K | — | |
| synthetic-video-detector open source | NVIDIA | Free | Free | 0 | — | |
| llama-nemotron-rerank-vl-1b-v2 open source | NVIDIA | Free | Free | 128K | — | |
| usdvalidate open source | NVIDIA | Free | Free | 0 | — | |
| Active Speaker Detection open source | NVIDIA | Free | Free | 0 | — | |
| Llama 3.1 Nemotron Ultra 253B open source | NVIDIA | Free | Free | 128K | — | |
| llama-3_2-nemoretriever-300m-embed-v1 open source | NVIDIA | Free | Free | 33K | — | |
| nv-embedcode-7b-v1 open source | NVIDIA | Free | Free | 33K | — | |
| llama-3.1-nemotron-safety-guard-8b-v3 open source | NVIDIA | Free | Free | 128K | — | |
| nemotron-mini-4b-instruct open source | NVIDIA | Free | Free | 128K | — | |
| cosmos-predict1-5b open source | NVIDIA | Free | Free | 0 | — | |
| nemotron-content-safety-reasoning-4b open source | NVIDIA | Free | Free | 128K | — | |
| riva-translate-4b-instruct-v1_1 open source | NVIDIA | Free | Free | 128K | — | |
| BGE M3 open source | NVIDIA | Free | Free | 8K | — | |
| sparsedrive open source | NVIDIA | Free | Free | 128K | — | |
| gliner-pii open source | NVIDIA | Free | Free | 128K | — | |
| Llama 3.1 Nemotron Nano 8B v1 open source | NVIDIA | Free | Free | 131K | — | |
| nv-embed-v1 open source | NVIDIA | Free | Free | 33K | — | |
| rerank-qa-mistral-4b open source | NVIDIA | Free | Free | 128K | — | |
| Nemotron 3.5 Lightning 30B A3B open source | NVIDIA | Free | Free | 262K | — | |
| paligemma open source | NVIDIA | Free | Free | 128K | — | |
| nvidia-nemotron-nano-9b-v2 open source | NVIDIA | Free | Free | 131K | — | |
| Cosmos Reason2 8B open source | NVIDIA | Free | Free | 131K | — | |
| Gemma 3 4B IT open source | NVIDIA | Free | Free | 131K | — | |
| Gemma 3n E2b It open source | NVIDIA | Free | Free | 128K | — | |
| Gemma 3n E4b It open source | NVIDIA | Free | Free | 128K | — | |
| Llama-3.2-90B-Vision-Instruct open source | NVIDIA | Free | Free | 128K | — | |
| esmfold open source | NVIDIA | Free | Free | 128K | — | |
| Llama 3.2 11b Vision Instruct open source | NVIDIA | Free | Free | 128K | — | |
| ByteDance-Seed/Seed-OSS-36B-Instruct budget | NVIDIA | Free | Free | 262K | — | |
| sarvam-m open source | NVIDIA | Free | Free | 128K | — | |
| Phi 4 Multimodal budget | NVIDIA | Free | Free | 128K | — | |
| Llama 3.1 Nemotron 70B Instruct open source | NVIDIA | Free | Free | 128K | — | |
| dracarys-llama-3.1-70b-instruct open source | NVIDIA | Free | Free | 128K | — | |
| Whisper Large v3 open source | NVIDIA | Free | Free | 0 | — | |
| solar-10.7b-instruct open source | NVIDIA | Free | Free | 128K | — | |
| FLUX.1-schnell open source | NVIDIA | Free | Free | 77 | — | |
| Gemma 3 12B IT open source | NVIDIA | Free | Free | 131K | — | |
| Llama 4 Maverick 17b 128e Instruct open source | NVIDIA | Free | Free | 128K | — | |
| esm2-650m open source | NVIDIA | Free | Free | 128K | — | |
| FLUX.2 Klein 4B open source | NVIDIA | Free | Free | 41K | — | |
| FLUX.1-dev budget | NVIDIA | Free | Free | 4K | — | |
| FLUX.1-Kontext-dev open source | NVIDIA | Free | Free | 41K | — | |
| mistral-nemotron open source | NVIDIA | Free | Free | 128K | — | |
| magpie-tts-zeroshot open source | NVIDIA | Free | Free | 0 | — | |
| Nemotron Nano 12B v2 VL open source | NVIDIA | Free | Free | 128K | — | |
| Llama 3.3 Nemotron Super 49B v1 open source | NVIDIA | Free | Free | 131K | — | |
| Mistral Nemo open source | Mistral | $0.02 | $0.03 | 131K | — | |
| text-embedding-3-small budget | OpenAI | $0.02 | Free | 8K | — | |
| Llama 3.2 1b Instruct open source | NVIDIA | $0.03 | $0.20 | 60K | — | |
| GPT-OSS 20B open source | OpenAI | $0.03 | $0.13 | 131K | 312 tok/s | |
| Qwen3-ASR Flash budget | Alibaba | $0.04 | $0.04 | 53K | — | |
| Nova Micro (US) budget | Amazon Bedrock | $0.04 | $0.14 | 128K | — | |
| DeepSeek V4 Flash open source | DeepSeek | $0.04 | $0.11 | 1.3M | — | |
| GPT-OSS 120B open source | OpenAI | $0.04 | $0.17 | 131K | 339 tok/s | |
| Command R7B Arabic open source | Cohere | $0.04 | $0.15 | 128K | — | |
| Command R7B open source | Cohere | $0.04 | $0.15 | 128K | — | |
| Ministral 3B (latest) open source | Mistral | $0.04 | $0.04 | 128K | — | |
| Mercury 2.5 budget | Inception | $0.04 | $0.15 | 260K | — | |
| Voxtral Mini 3B 2507 open source | Amazon Bedrock | $0.04 | $0.04 | 33K | — | |
| Gemma 4 E2B IT open source | Amazon Bedrock | $0.04 | $0.08 | 131K | — | |
| Gemma 3 12B open source | $0.05 | $0.15 | 131K | 90 tok/s | ||
| Gemma 3 4B open source | $0.05 | $0.10 | 131K | — | ||
| Qwen Flash budget | Alibaba | $0.05 | $0.40 | 1.0M | — | |
| Qwen Turbo budget | Alibaba | $0.05 | $0.20 | 1.0M | — | |
| nemotron-3-nano-30b-a3b open source | NVIDIA | $0.05 | $0.20 | 262K | — | |
| Llama 3.1 8B Instruct open source | NVIDIA | $0.05 | $0.08 | 131K | — | |
| Llama 3.2 3B Instruct open source | NVIDIA | $0.05 | $0.33 | 131K | — | |
| GPT-5 Nano budget | OpenAI | $0.05 | $0.40 | 400K | 250 tok/s | |
| Nova Lite budget | Amazon | $0.06 | $0.24 | 300K | 150 tok/s | |
| DeepSeek V4 Flash 0731 open source | Alibaba | $0.06 | $0.12 | 1.3M | — | |
| Laguna XS 2.1 open source | NVIDIA | $0.06 | $0.12 | 262K | — | |
| NVIDIA Nemotron Nano 3 30B open source | Amazon Bedrock | $0.06 | $0.24 | 262K | — | |
| GLM-4.7-Flash open source | Zhipu AI | $0.06 | $0.40 | 200K | — | |
| Qwen3-Coder 30B-A3B Instruct open source | Alibaba | $0.07 | $0.28 | 262K | — | |
| GLM-4.7-FlashX open source | Zhipu AI | $0.07 | $0.40 | 200K | — | |
| Qwen-Omni Turbo budget | Alibaba | $0.07 | $0.27 | 33K | — | |
| Phi-4 open source | Microsoft | $0.07 | $0.14 | 16K | 93 tok/s | |
| Mistral Small 3.2 budget | Mistral | $0.07 | $0.20 | 256K | 160 tok/s | |
| GPT OSS Safeguard 20B open source | Amazon Bedrock | $0.07 | $0.30 | 131K | — | |
| Phi-4-mini-reasoning open source | Azure | $0.07 | $0.30 | 128K | — | |
| Gemma 3 27B open source | $0.08 | $0.45 | 131K | 58 tok/s | ||
| Qwen 3 32B open source | Qwen | $0.08 | $0.28 | 131K | 120 tok/s | |
| Nemotron 3 Super open source | NVIDIA | $0.08 | $0.40 | 262K | — | |
| Qwen3 235B-A22B Instruct 2507 open source | Amazon Bedrock | $0.09 | $0.35 | 262K | — | |
| Qwen3-Next 80B-A3B Instruct open source | Alibaba | $0.09 | $1.1 | 262K | — | |
| Solar Pro 4 budget | Upstage | $0.09 | $0.36 | 524K | — | |
| Llama 4 Scout open source | Meta | $0.10 | $0.30 | 1.3M | 140 tok/s | |
| Reka Flash 3 mid | Reka AI | $0.10 | $0.20 | 66K | 136 tok/s | |
| Gemini 2.5 Flash Lite budget | $0.10 | $0.40 | 1.0M | 240 tok/s | ||
| Llama 3.3 70B open source | Meta | $0.10 | $0.32 | 131K | 90 tok/s | |
| GPT-4.1 Nano budget | OpenAI | $0.10 | $0.40 | 1.0M | 200 tok/s | |
| Qwen3.6 35B-A3B open source | Alibaba | $0.10 | $0.90 | 262K | — | |
| Muse Spark 1.2 Contributor budget | Meta | $0.10 | $0.20 | 1.0M | — | |
| Muse Spark 1.3 Contributor budget | Meta | $0.10 | $0.20 | 1.0M | — | |
| Qwen2.5 7B Instruct open source | Alibaba | $0.10 | $0.20 | 33K | — | |
| Step 3.5 Flash open source | StepFun | $0.10 | $0.30 | 262K | — | |
| Llama 3.3 70b Instruct open source | NVIDIA | $0.10 | $0.32 | 131K | — | |
| Voxtral Small 24B 2507 open source | Amazon Bedrock | $0.10 | $0.30 | 33K | — | |
| Gemini 2.0 Flash budget | $0.10 | $0.40 | 1.0M | 220 tok/s | ||
| Devstral Small open source | Mistral | $0.10 | $0.30 | 128K | — | |
| Mistral Embed budget | Mistral | $0.10 | Free | 8K | — | |
| Devstral Small 2505 open source | Mistral | $0.10 | $0.30 | 128K | — | |
| Voxtral Small (latest) open source | Mistral | $0.10 | $0.30 | 32K | — | |
| Ministral 8B (latest) open source | Mistral | $0.10 | $0.10 | 128K | — | |
| Qwen2.5-Omni 7B open source | Alibaba | $0.10 | $0.40 | 33K | — | |
| Step 3.5 Flash 2603 open source | StepFun | $0.10 | $0.30 | 256K | — | |
| Ministral 3 3B open source | Amazon Bedrock | $0.10 | $0.10 | 256K | — | |
| Mistral Small 3.1 budget | Azure | $0.10 | $0.30 | 128K | — | |
| Embed v3 English open source | Azure | $0.10 | Free | 512 | — | |
| Embed v3 Multilingual open source | Azure | $0.10 | Free | 512 | — | |
| text-embedding-ada-002 budget | OpenAI | $0.10 | Free | 8K | — | |
| Qwen3 8B open source | Alibaba | $0.12 | $0.46 | 131K | — | |
| Qwen3 14B open source | Alibaba | $0.12 | $0.24 | 131K | — | |
| Qwen3 Coder Next open source | Amazon Bedrock | $0.12 | $0.80 | 262K | — | |
| Embed v4 open source | Azure | $0.12 | Free | 128K | — | |
| Phi-4 Reasoning Plus open source | Microsoft | $0.13 | $0.50 | 32K | — | |
| Phi-4-reasoning open source | Azure | $0.13 | $0.50 | 32K | — | |
| text-embedding-3-large budget | OpenAI | $0.13 | Free | 8K | — | |
| GLM-4.5-Air open source | Zhipu AI | $0.13 | $0.85 | 131K | — | |
| Yi Lightning mid | 01.AI | $0.14 | $0.14 | 16K | — | |
| Model Router budget | Azure | $0.14 | Free | 200K | — | |
| Command R mid | Cohere | $0.15 | $0.60 | 128K | 90 tok/s | |
| GPT-4o Mini budget | OpenAI | $0.15 | $0.60 | 128K | 200 tok/s | |
| Gemini Embedding 001 budget | $0.15 | Free | 2K | — | ||
| Qwen3.8 Flash budget | Alibaba | $0.15 | $0.47 | 1.0M | — | |
| Pixtral 12B open source | Mistral | $0.15 | $0.15 | 128K | — | |
| Mistral Small (latest) open source | Mistral | $0.15 | $0.60 | 256K | — | |
| Open Mistral Nemo open source | Mistral | $0.15 | $0.15 | 128K | — | |
| Mistral Small 4 open source | Mistral | $0.15 | $0.60 | 262K | — | |
| GLM-5.3-Flash open source | Zhipu AI | $0.15 | $0.50 | 1.3M | — | |
| solar-mini budget | Upstage | $0.15 | $0.15 | 33K | — | |
| solar-pro3 budget | Upstage | $0.15 | $0.60 | 131K | — | |
| Ministral 3 8B open source | Mistral | $0.15 | $0.15 | 128K | 172 tok/s | |
| NVIDIA Nemotron 3 Super 120B A12B open source | Amazon Bedrock | $0.15 | $0.65 | 262K | — | |
| GPT OSS Safeguard 120B open source | Amazon Bedrock | $0.15 | $0.60 | 128K | — | |
| Qwen-MT Turbo budget | Alibaba | $0.16 | $0.49 | 16K | — | |
| Llama 4 Scout 17B Instruct (US) open source | Amazon Bedrock | $0.17 | $0.66 | 10.0M | — | |
| Llama Guard 4 12B open source | NVIDIA | $0.18 | $0.18 | 164K | — | |
| Qwen3.6 Flash budget | Alibaba | $0.19 | $1.1 | 1.0M | — | |
| Qwen3 Coder Flash budget | Alibaba | $0.20 | $0.97 | 1.0M | — | |
| Qwen3.5 27B open source | Alibaba | $0.20 | $1.6 | 262K | — | |
| Llama 4 Maverick open source | Meta | $0.20 | $0.70 | 1.0M | 100 tok/s | |
| Grok 4 Fast mid | xAI | $0.20 | $0.50 | 256K | 110 tok/s | |
| Jamba 1.5 Mini mid | AI21 Labs | $0.20 | $0.40 | 256K | 35 tok/s | |
| GPT-5.6 Luna budget | OpenAI | $0.20 | $1.2 | 1.1M | — | |
| GPT-5.4 nano budget | OpenAI | $0.20 | $1.3 | 400K | — | |
| Gemini Embedding 2 budget | $0.20 | Free | 8K | — | ||
| Qwen3-VL 30B-A3B open source | Alibaba | $0.20 | $0.80 | 131K | — | |
| Qwen3-VL Plus budget | Alibaba | $0.20 | $1.6 | 262K | — | |
| Grok 4.1 Fast mid | xAI | $0.20 | $0.50 | 256K | 120 tok/s | |
| NVIDIA Nemotron Nano 12B v2 VL BF16 open source | Amazon Bedrock | $0.20 | $0.60 | 128K | — | |
| Ministral 14B 3.0 open source | Amazon Bedrock | $0.20 | $0.20 | 128K | — | |
| Llama 4 Scout 17B 16E Instruct open source | Azure | $0.20 | $0.78 | 128K | — | |
| Step 3.7 Flash open source | StepFun | $0.20 | $1.1 | 262K | — | |
| Qwen-VL Plus budget | Alibaba | $0.21 | $0.63 | 131K | — | |
| Qwen3 VL 235B A22B Instruct open source | Amazon Bedrock | $0.21 | $1.9 | 262K | — | |
| DeepSeek V4 Flash Vision Exp open source | DeepSeek | $0.22 | $0.66 | 1.0M | — | |
| Qwen3 235B A22B Instruct open source | Vertex | $0.22 | $0.88 | 262K | — | |
| Gemma 3 27B IT open source | Amazon Bedrock | $0.23 | $0.38 | 203K | — | |
| Llama 4 Maverick 17B Instruct (US) open source | Amazon Bedrock | $0.24 | $0.97 | 1.0M | — | |
| GPT-5 Mini mid | OpenAI | $0.25 | $2.0 | 400K | 180 tok/s | |
| DeepSeek V3.1 open source | DeepSeek | $0.25 | $0.95 | 164K | 65 tok/s | |
| GPT-5.1 Codex Mini mid | OpenAI | $0.25 | $2.0 | 400K | 170 tok/s | |
| Gemini 3.1 Flash Lite budget | $0.25 | $1.5 | 1.0M | — | ||
| Nano Banana 2 Lite budget | $0.25 | $1.5 | 66K | — | ||
| Mistral 7B open source | Mistral | $0.25 | $0.25 | 8K | — | |
| Mercury Edit 2 budget | Inception | $0.25 | $0.75 | 128K | — | |
| Mercury 2 budget | Inception | $0.25 | $0.75 | 128K | — | |
| solar-pro2 budget | Upstage | $0.25 | $0.25 | 66K | — | |
| Llama 4 Maverick 17B 128E Instruct FP8 open source | Azure | $0.25 | $1.0 | 1.0M | — | |
| MiniMax-M2 open source | MiniMax | $0.26 | $1.0 | 205K | — | |
| Qwen Plus budget | Alibaba | $0.26 | $0.78 | 1.0M | — | |
| Qwen3.5 122B-A10B open source | Alibaba | $0.26 | $2.1 | 262K | — | |
| DeepSeek V3.2 open source | DeepSeek | $0.27 | $0.40 | 164K | 70 tok/s | |
| MiniMax M2.5 flagship | MiniMax | $0.27 | $1.1 | 205K | 59 tok/s | |
| Qwen-Omni Turbo Realtime budget | Alibaba | $0.27 | $1.1 | 33K | — | |
| Grok 3 Mini budget | xAI | $0.30 | $0.50 | 131K | 130 tok/s | |
| Codestral mid | Mistral | $0.30 | $0.90 | 256K | 90 tok/s | |
| Qwen 3 Coder open source | Qwen | $0.30 | $1.0 | 262K | 80 tok/s | |
| Gemini 2.5 Flash mid | $0.30 | $2.5 | 1.0M | 251 tok/s | ||
| Qwen3.6 27B open source | Alibaba | $0.30 | $2.0 | 262K | — | |
| Gemini Flash-Lite Latest budget | $0.30 | $2.5 | 1.0M | — | ||
| DeepSeek V4.1 Flash open source | DeepSeek | $0.30 | $1.2 | 1.0M | — | |
| GLM-4.6V mid | Zhipu AI | $0.30 | $0.90 | 131K | 68 tok/s | |
| MiniMax-M3 open source | MiniMax | $0.30 | $1.2 | 1.0M | — | |
| MiniMax-M2.7 open source | MiniMax | $0.30 | $1.2 | 205K | — | |
| Nova 2 Lite (EU) budget | Amazon Bedrock | $0.30 | $2.5 | 1.0M | — | |
| Codestral 25.01 budget | Azure | $0.30 | $0.90 | 256K | — | |
| Nano Banana budget | $0.30 | $2.5 | 33K | — | ||
| Gemini 3.5 Flash Lite budget | $0.30 | $2.5 | 1.0M | — | ||
| MiniMax-M2.1 open source | MiniMax | $0.30 | $1.2 | 205K | — | |
| Qwen3.5 35B-A3B open source | Alibaba | $0.31 | $1.3 | 262K | — | |
| Qwen3.7 Plus budget | Alibaba | $0.32 | $1.3 | 1.0M | — | |
| Qwen3.6 Plus budget | Alibaba | $0.33 | $1.9 | 1.0M | — | |
| Qwen2.5-VL 7B Instruct open source | Alibaba | $0.35 | $1.1 | 131K | — | |
| Qwen2.5 14B Instruct open source | Alibaba | $0.35 | $1.4 | 131K | — | |
| Muse Glimmer 30B open source | NVIDIA | $0.35 | $1.5 | 131K | — | |
| Qwen 2.5 72B open source | Qwen | $0.36 | $0.40 | 33K | 80 tok/s | |
| Qwen2.5 72B Instruct open source | Alibaba | $0.36 | $0.40 | 33K | — | |
| GPT-4.1 Mini budget | OpenAI | $0.40 | $1.6 | 1.0M | 160 tok/s | |
| Mistral Medium 3.1 mid | Mistral | $0.40 | $2.0 | 131K | 110 tok/s | |
| Devstral 2 open source | Mistral | $0.40 | $2.0 | 262K | — | |
| Mistral Medium 3 budget | Mistral | $0.40 | $2.0 | 131K | — | |
| Qwen3.5 Plus budget | Alibaba | $0.40 | $2.4 | 1.0M | — | |
| GLM-4.7 open source | Zhipu AI | $0.40 | $1.8 | 205K | — | |
| Llama 3.1 70b Instruct open source | NVIDIA | $0.40 | $0.40 | 131K | — | |
| Devstral 2 123B open source | Amazon Bedrock | $0.40 | $2.0 | 256K | — | |
| Devstral Medium open source | Mistral | $0.40 | $2.0 | 128K | — | |
| Qwen3-Omni Flash budget | Alibaba | $0.43 | $1.7 | 66K | — | |
| GLM-4.6 open source | Zhipu AI | $0.43 | $1.8 | 205K | — | |
| DeepSeek V4 Pro open source | DeepSeek | $0.43 | $0.87 | 1.0M | — | |
| Kimi K2.5 flagship | Moonshot AI | $0.45 | $2.3 | 262K | 45 tok/s | |
| Qwen 3 235B open source | Qwen | $0.46 | $1.8 | 131K | 60 tok/s | |
| Qwen3 235B-A22B open source | Alibaba | $0.46 | $1.8 | 131K | — | |
| Gemini 3 Flash mid | $0.50 | $3.0 | 1.0M | 200 tok/s | ||
| DeepSeek R1 0528 open source | DeepSeek | $0.50 | $2.1 | 164K | 40 tok/s | |
| Mistral Large 25.12 flagship | Mistral | $0.50 | $1.5 | 262K | 70 tok/s | |
| Nano Banana 2 budget | $0.50 | $3.0 | 131K | — | ||
| Qwen Plus Character (Japanese) budget | Alibaba | $0.50 | $1.4 | 8K | — | |
| Magistral Small open source | Mistral | $0.50 | $1.5 | 128K | — | |
| Mistral Large 3 open source | Mistral | $0.50 | $1.5 | 262K | — | |
| Qwen3-Next 80B-A3B (Thinking) open source | Alibaba | $0.50 | $6.0 | 131K | — | |
| Nemotron 3 Ultra 550B A55B open source | NVIDIA | $0.50 | $2.5 | 1.0M | — | |
| Gemini 2.5 Flash TTS budget | Vertex | $0.50 | $10.0 | 33K | — | |
| Magistral Small 1.2 open source | Amazon Bedrock | $0.50 | $1.5 | 128K | — | |
| GPT-3.5 Turbo 0125 budget | Azure | $0.50 | $1.5 | 16K | — | |
| Qwen3-Omni Flash Realtime mid | Alibaba | $0.52 | $2.0 | 66K | — | |
| Qwen 3.5 397B open source | Qwen | $0.55 | $3.5 | 262K | 45 tok/s | |
| Qwen3.5 397B-A17B open source | Alibaba | $0.55 | $3.5 | 262K | — | |
| DeepSeek-V3.2-Speciale open source | Azure | $0.58 | $1.7 | 128K | — | |
| GLM-5 flagship | Zhipu AI | $0.60 | $1.9 | 205K | 55 tok/s | |
| GLM-4.5V open source | Zhipu AI | $0.60 | $1.8 | 66K | — | |
| GLM-4.5 open source | Zhipu AI | $0.60 | $2.2 | 131K | — | |
| MiniMax-M2.7-highspeed open source | MiniMax | $0.60 | $2.4 | 205K | — | |
| MiniMax-M2.5-highspeed open source | MiniMax | $0.60 | $2.4 | 205K | — | |
| Kimi K2 Thinking open source | Vertex | $0.60 | $2.5 | 262K | — | |
| Kimi K2 0905 open source | NVIDIA | $0.60 | $2.5 | 262K | — | |
| Palmyra X5 (US) mid | Amazon Bedrock | $0.60 | $6.0 | 1.0M | — | |
| Qwen3 Coder Plus open source | Alibaba | $0.65 | $3.3 | 1.0M | — | |
| Qwen2.5 Coder 32b Instruct open source | NVIDIA | $0.66 | $1.0 | 33K | — | |
| GLM-5.2 open source | Mistral | $0.68 | $2.1 | 1.0M | — | |
| DeepSeek R1 open source | DeepSeek | $0.70 | $2.5 | 64K | 35 tok/s | |
| Mixtral 8x7B open source | Mistral | $0.70 | $0.70 | 32K | — | |
| Qwen2.5 32B Instruct open source | Alibaba | $0.70 | $2.8 | 131K | — | |
| Qwen3-VL 235B-A22B open source | Alibaba | $0.70 | $2.8 | 131K | — | |
| Kimi K2.7 Code open source | Moonshot AI | $0.71 | $3.5 | 262K | — | |
| Qwen-VL OCR mid | Alibaba | $0.72 | $0.72 | 34K | — | |
| GPT-5.4 mini mid | OpenAI | $0.75 | $4.5 | 400K | — | |
| Gemini 3.6 Flash mid | $0.75 | $3.8 | 1.0M | — | ||
| Gemini 3.1 Flash Live Preview mid | $0.75 | $4.5 | 131K | — | ||
| Gemini 3.8 Flash mid | $0.75 | $3.8 | 1.0M | — | ||
| Gemini 3.7 Flash mid | $0.75 | $3.8 | 1.0M | — | ||
| Gemini Flash Latest mid | $0.75 | $3.8 | 1.0M | — | ||
| Qwen 3 Max open source | Qwen | $0.78 | $3.9 | 262K | 55 tok/s | |
| Nova Pro mid | Amazon | $0.80 | $3.2 | 300K | 100 tok/s | |
| Qwen2.5-VL 72B Instruct open source | Alibaba | $0.80 | $1.0 | 128K | — | |
| Morph v3 Fast mid | Morph | $0.80 | $1.2 | 82K | — | |
| Claude 3.5 Haiku budget | Anthropic | $0.80 | $4.0 | 200K | 170 tok/s | |
| Qwen-VL Max mid | Alibaba | $0.80 | $3.2 | 131K | — | |
| QwQ Plus mid | Alibaba | $0.80 | $2.4 | 131K | — | |
| Auto mid | Morph | $0.85 | $1.6 | 32K | — | |
| Morph v3 Large mid | Morph | $0.90 | $1.9 | 262K | — | |
| Kimi K2.6 open source | Moonshot AI | $0.95 | $4.0 | 262K | — | |
| GLM-5.1 mid | Zhipu AI | $0.97 | $3.0 | 205K | — | |
| DeepSeek V4 Pro 0813 open source | NVIDIA | $0.98 | $3.0 | 1.0M | — | |
| Sonar mid | Perplexity | $1.0 | $1.0 | 127K | — | |
| Claude Haiku 4.5 budget | Anthropic | $1.0 | $5.0 | 200K | 180 tok/s | |
| GPT-3.5-turbo budget | OpenAI | $1.0 | $2.0 | 4K | — | |
| Gemini 3.1 Flash TTS Preview mid | $1.0 | $20.0 | 8K | — | ||
| Grok Build 0.1 mid | xAI | $1.0 | $2.0 | 256K | — | |
| Inkling open source | NVIDIA | $1.0 | $4.0 | 1.0M | — | |
| Gemini 2.5 Pro TTS mid | Vertex | $1.0 | $20.0 | 33K | — | |
| GPT-3.5 Turbo 1106 mid | Azure | $1.0 | $2.0 | 16K | — | |
| Qwen3.6 Max Preview mid | Alibaba | $1.0 | $6.2 | 262K | — | |
| o3 Mini mid | OpenAI | $1.1 | $4.4 | 200K | 100 tok/s | |
| o4 Mini mid | OpenAI | $1.1 | $4.4 | 200K | 120 tok/s | |
| QVQ Max mid | Alibaba | $1.2 | $4.8 | 131K | — | |
| GLM-5V-Turbo flagship | Zhipu AI | $1.2 | $4.0 | 203K | — | |
| Gemini 2.5 Pro flagship | $1.3 | $10.0 | 1.0M | 55 tok/s | ||
| GPT-5 flagship | OpenAI | $1.3 | $10.0 | 400K | 100 tok/s | |
| GPT-5.1 flagship | OpenAI | $1.3 | $10.0 | 400K | 95 tok/s | |
| Gemini 2.5 Computer Use Preview 10-2025 mid | $1.3 | $10.0 | 131K | — | ||
| Muse Spark 1.1 mid | Meta | $1.3 | $4.3 | 1.0M | — | |
| Muse Spark 1.2 mid | Meta | $1.3 | $4.3 | 1.0M | — | |
| Grok 4.3 mid | xAI | $1.3 | $2.5 | 1.0M | — | |
| Grok 4.20 (Reasoning) mid | xAI | $1.3 | $2.5 | 2.0M | — | |
| Grok 4.20 Multi-Agent mid | xAI | $1.3 | $2.5 | 2.0M | — | |
| GPT-5-Codex mid | Azure | $1.3 | $10.0 | 400K | — | |
| GPT-5.1 Codex Max mid | Azure | $1.3 | $10.0 | 400K | — | |
| GPT-5.1 Codex flagship | OpenAI | $1.3 | $10.0 | 400K | 85 tok/s | |
| Muse Spark 1.3 mid | Meta | $1.3 | $4.3 | 1.0M | — | |
| GLM-5.3 open source | Zhipu AI | $1.4 | $4.4 | 1.3M | — | |
| Qwen3.7 Max mid | Alibaba | $1.5 | $4.4 | 1.0M | — | |
| Gemini 3.5 Flash mid | $1.5 | $9.0 | 1.0M | — | ||
| Gemini Omni Flash Preview mid | $1.5 | $17.5 | 131K | — | ||
| Mistral Medium (latest) open source | Mistral | $1.5 | $7.5 | 262K | — | |
| Qwen3-Coder 480B-A35B Instruct open source | Alibaba | $1.5 | $7.5 | 262K | — | |
| Codex Mini mid | Azure | $1.5 | $6.0 | 200K | — | |
| GPT-3.5 Turbo Instruct mid | Azure | $1.5 | $2.0 | 4K | — | |
| Mistral Medium 3.5 open source | Mistral | $1.5 | $7.5 | 262K | — | |
| Qwen Max mid | Alibaba | $1.6 | $6.4 | 33K | — | |
| GPT-5.2 flagship | OpenAI | $1.8 | $14.0 | 400K | 90 tok/s | |
| GPT-5.3 Codex mid | OpenAI | $1.8 | $14.0 | 400K | — | |
| GPT-5.2 Chat mid | OpenAI | $1.8 | $14.0 | 128K | — | |
| GPT-5.3 Chat (latest) mid | OpenAI | $1.8 | $14.0 | 128K | — | |
| GPT-5.2 Codex mid | Azure | $1.8 | $14.0 | 400K | — | |
| GPT-5.3 Codex Spark mid | OpenAI | $1.8 | $14.0 | 128K | — | |
| Kimi K2.7 Code HighSpeed open source | Moonshot AI | $1.9 | $8.0 | 262K | — | |
| Pixtral Large flagship | Mistral | $2.0 | $6.0 | 131K | 60 tok/s | |
| Gemini 3.1 Pro flagship | $2.0 | $12.0 | 1.0M | 65 tok/s | ||
| o3 flagship | OpenAI | $2.0 | $8.0 | 200K | 40 tok/s | |
| Gemini 3 Pro flagship | $2.0 | $12.0 | 1.0M | 60 tok/s | ||
| Jamba 1.5 Large flagship | AI21 Labs | $2.0 | $8.0 | 256K | 19 tok/s | |
| GPT-4.1 mid | OpenAI | $2.0 | $8.0 | 1.0M | 70 tok/s | |
| Grok 2 mid | xAI | $2.0 | $10.0 | 131K | 80 tok/s | |
| Claude Sonnet 5 mid | Anthropic | $2.0 | $10.0 | 1.0M | — | |
| GPT-5.6 Sol mid | OpenAI | $2.0 | $10.0 | 1.1M | — | |
| Deep Research Max Preview (Apr-21-2026) mid | $2.0 | $12.0 | 131K | — | ||
| Nano Banana Pro mid | $2.0 | $12.0 | 131K | — | ||
| Deep Research Preview (Apr-21-2026) mid | $2.0 | $12.0 | 131K | — | ||
| GPT-5.6 Terra mid | OpenAI | $2.0 | $12.0 | 1.1M | — | |
| Qwen3.8 Max mid | Alibaba | $2.0 | $6.0 | 1.0M | — | |
| Magistral Medium (latest) open source | Mistral | $2.0 | $5.0 | 128K | — | |
| Mixtral 8x22B open source | Mistral | $2.0 | $6.0 | 64K | — | |
| Mistral Large (latest) open source | Mistral | $2.0 | $6.0 | 128K | — | |
| Mistral Large 2.1 open source | Mistral | $2.0 | $6.0 | 131K | — | |
| Grok 4.5 mid | xAI | $2.0 | $6.0 | 500K | — | |
| Grok 4.6 mid | xAI | $2.0 | $6.0 | 500K | — | |
| Mistral: Mixtral 8x22B Instruct open source | NVIDIA | $2.0 | $6.0 | 66K | — | |
| Sonar Reasoning Pro flagship | Perplexity | $2.0 | $8.0 | 128K | 22 tok/s | |
| Perplexity Sonar Deep Research mid | Perplexity | $2.0 | $8.0 | 128K | — | |
| Step 1 (32K) mid | StepFun | $2.0 | $9.6 | 33K | — | |
| Qwen-MT Plus mid | Alibaba | $2.5 | $7.4 | 16K | — | |
| GPT-4o mid | OpenAI | $2.5 | $10.0 | 128K | 143 tok/s | |
| Command R+ flagship | Cohere | $2.5 | $10.0 | 128K | 60 tok/s | |
| GPT-5.4 mid | OpenAI | $2.5 | $15.0 | 1.1M | — | |
| Command A Plus open source | Cohere | $2.5 | $10.0 | 128K | — | |
| Command A Reasoning open source | Cohere | $2.5 | $10.0 | 256K | — | |
| Command A Vision open source | Cohere | $2.5 | $10.0 | 128K | — | |
| Command A Translate open source | Cohere | $2.5 | $10.0 | 8K | — | |
| Palmyra X4 (US) mid | Amazon Bedrock | $2.5 | $10.0 | 123K | — | |
| Nova Premier (US) mid | Amazon Bedrock | $2.5 | $12.5 | 1.0M | — | |
| Command A flagship | Cohere | $2.5 | $10.0 | 256K | 70 tok/s | |
| Kimi K3 open source | Moonshot AI | $2.6 | $13.3 | 1.0M | — | |
| o1 Mini mid | OpenAI | $3.0 | $12.0 | 128K | 80 tok/s | |
| Claude 3.7 Sonnet mid | Anthropic | $3.0 | $15.0 | 200K | 70 tok/s | |
| Claude 3.5 Sonnet mid | Anthropic | $3.0 | $15.0 | 200K | 70 tok/s | |
| Grok 4 flagship | xAI | $3.0 | $15.0 | 256K | 55 tok/s | |
| Grok 3 mid | xAI | $3.0 | $15.0 | 1.0M | 65 tok/s | |
| Sonar Pro flagship | Perplexity | $3.0 | $15.0 | 200K | 50 tok/s | |
| Claude Sonnet 4.5 flagship | Anthropic | $3.0 | $15.0 | 1.0M | 67 tok/s | |
| Claude Sonnet 4 mid | Anthropic | $3.0 | $15.0 | 1.0M | 75 tok/s | |
| Claude Sonnet 4.6 flagship | Anthropic | $3.0 | $15.0 | 1.0M | 57 tok/s | |
| AU Anthropic Claude Sonnet 4.6 mid | Amazon Bedrock | $3.3 | $16.5 | 1.0M | — | |
| Gemini 3.5 Live Translate Preview mid | $3.5 | $21.0 | 16K | — | ||
| GPT-5.6 mid | OpenAI | $4.0 | $20.0 | 1.1M | — | |
| GPT-Realtime-2.1 mid | OpenAI | $4.0 | $24.0 | 128K | — | |
| Claude Opus 4.6 flagship | Anthropic | $5.0 | $25.0 | 1.0M | 68 tok/s | |
| Claude Opus 4.7 flagship | Anthropic | $5.0 | $25.0 | 1.0M | — | |
| Claude Opus 4.5 flagship | Anthropic | $5.0 | $25.0 | 200K | 50 tok/s | |
| Claude Opus 4.8 flagship | Anthropic | $5.0 | $25.0 | 1.0M | — | |
| GPT-5.5 flagship | OpenAI | $5.0 | $30.0 | 1.1M | — | |
| GPT Chat Latest flagship | Azure | $5.0 | $30.0 | 400K | — | |
| Claude Opus 5 flagship | Anthropic | $5.0 | $25.0 | 1.0M | — | |
| gpt-image-2 flagship | OpenAI | $5.0 | $30.0 | 0 | — | |
| Step 2 (16K) flagship | StepFun | $5.2 | $16.4 | 16K | — | |
| Claude Fable 5.1 flagship | Anthropic | $10.0 | $50.0 | 1.0M | — | |
| Claude Fable 5 flagship | Anthropic | $10.0 | $50.0 | 1.0M | 60 tok/s | |
| GPT-6 Astra flagship | OpenAI | $10.0 | $50.0 | 1.1M | — | |
| GPT-4 Turbo flagship | OpenAI | $10.0 | $30.0 | 128K | — | |
| Qwen3-LiveTranslate Flash Realtime flagship | Alibaba | $10.0 | $10.0 | 53K | — | |
| GPT-4 Turbo Vision flagship | Azure | $10.0 | $30.0 | 128K | — | |
| Claude Mythos 5 flagship | Azure | $10.0 | $50.0 | 1.0M | — | |
| Claude Opus 4 flagship | Anthropic | $15.0 | $75.0 | 200K | 50 tok/s | |
| o1 flagship | OpenAI | $15.0 | $60.0 | 200K | 35 tok/s | |
| Claude 3 Opus flagship | Anthropic | $15.0 | $75.0 | 200K | 25 tok/s | |
| GPT-5 Pro flagship | OpenAI | $15.0 | $120.0 | 400K | — | |
| Claude Opus 4.1 flagship | Vertex | $15.0 | $75.0 | 200K | — | |
| AU Anthropic Claude Opus 4.6 flagship | Amazon Bedrock | $16.5 | $82.5 | 1.0M | — | |
| o3 Pro flagship | OpenAI | $20.0 | $80.0 | 200K | 25 tok/s | |
| GPT-5.2 Pro flagship | OpenAI | $21.0 | $168.0 | 400K | — | |
| GPT-5.5 Pro flagship | OpenAI | $30.0 | $180.0 | 1.1M | — | |
| GPT-5.4 Pro flagship | OpenAI | $30.0 | $180.0 | 1.1M | — | |
| GPT-4 flagship | OpenAI | $30.0 | $60.0 | 8K | — | |
| GPT-4.5 flagship | OpenAI | $75.0 | $150.0 | 128K | 60 tok/s | |
| o1-pro flagship | OpenAI | $150.0 | $600.0 | 200K | — | |
| MiMo V2 Flash budget | Xiaomi | — | — | 256K | 155 tok/s | — |
| Doubao Seed 2.0 flagship | ByteDance | — | — | 128K | — | — |
| Nemotron 3 Nano open source | NVIDIA | — | — | 1.0M | 76 tok/s | — |
| Magistral Medium 1.2 mid | Mistral | — | — | 128K | 29 tok/s | — |
| Ministral 3 14B open source | Mistral | — | — | 256K | 83 tok/s | — |
| Qwen 3 Next 80B open source | Qwen | — | — | 262K | 138 tok/s | — |
| Qwen 3 Coder 480B open source | Qwen | — | — | 262K | 60 tok/s | — |
| Qwen 3 VL 235B open source | Qwen | — | — | 262K | 46 tok/s | — |
| Nova 2.0 Lite budget | Amazon | — | — | 1.0M | 221 tok/s | — |
| K-EXAONE flagship | LG AI Research | — | — | 256K | 62 tok/s | — |
| Ring Flash 2.0 open source | InclusionAI | — | — | 128K | 83 tok/s | — |
| Step 2.5 Flash mid | StepFun | — | — | 128K | 67 tok/s | — |
| Veo 3.1 flagship | — | — | 480 | — | — | |
| DALL-E 3 flagship | OpenAI | — | — | — | — | — |
| Sora 2 flagship | OpenAI | — | — | — | — | — |
| Veo 3 flagship | — | — | — | — | — | |
| Kling 2.5 Turbo flagship | Kuaishou | — | — | — | — | — |
| ERNIE 4.5 flagship | Baidu | — | — | 128K | — | — |
| ERNIE X1 flagship | Baidu | — | — | 128K | — | — |
| Hermes 4 70B open source | Nous Research | — | — | 128K | — | — |
| Imagen 4 flagship | — | — | — | — | — | |
| Luma Ray 3 flagship | Luma AI | — | — | — | — | — |
| Runway Gen-4 flagship | Runway | — | — | — | — | — |
| Midjourney v7 flagship | Midjourney | — | — | — | — | — |
| Midjourney v6.1 flagship | Midjourney | — | — | — | — | — |
| Stable Diffusion 3.5 open source | Stability AI | — | — | — | — | — |
| Flux 1.1 Pro flagship | Black Forest Labs | — | — | — | — | — |
| Flux 1.0 Dev open source | Black Forest Labs | — | — | — | — | — |
| Ideogram 3.0 flagship | Ideogram | — | — | — | — | — |
| Seedream 4.5 flagship | ByteDance | — | — | — | — | — |
| Pika 2.5 flagship | Pika | — | — | — | — | — |
| chatgpt-image-latest mid | OpenAI | — | — | 0 | — | — |
| gpt-image-1 mid | OpenAI | — | — | 0 | — | — |
| gpt-image-1-mini mid | OpenAI | — | — | 0 | — | — |
| gpt-image-1.5 mid | OpenAI | — | — | 0 | — | — |
| Veo 3.1 fast mid | — | — | 480 | — | — | |
| Gemma 4 26B A4B IT open source | — | — | 262K | — | — | |
| Veo 3.1 lite mid | — | — | 480 | — | — | |
| Gemma 4 31B IT open source | — | — | 262K | — | — | |
| Voxtral Mini TTS (latest) mid | Mistral | — | — | 0 | — | — |
| Voxtral Mini (latest) mid | Mistral | — | — | 0 | — | — |
| Grok Imagine Video 1.5 mid | xAI | — | — | 1K | — | — |
| Grok Imagine Image 2.0 mid | xAI | — | — | 64K | — | — |
| Grok Imagine Image Quality mid | xAI | — | — | 16K | — | — |
| Grok Imagine Video mid | xAI | — | — | 1K | — | — |
| Aya Expanse 32B open source | Cohere | — | — | 128K | — | — |
| Aya Expanse 8B open source | Cohere | — | — | 8K | — | — |
| Aya Vision 8B open source | Cohere | — | — | 16K | — | — |
| Aya Vision 32B open source | Cohere | — | — | 16K | — | — |
| Step TTS 2 mid | StepFun | — | — | 0 | — | — |
| StepAudio 2.5 ASR mid | StepFun | — | — | 0 | — | — |
| StepAudio 2.5 TTS mid | StepFun | — | — | 0 | — | — |
| Grok Imagine Image mid | xAI | — | — | 16K | — | — |
Pricing sourced from OpenRouter API. Prices may vary by provider and tier. Last updated daily.
AI Pricing FAQ
How much does the OpenAI API cost?
OpenAI API pricing varies by model. GPT-5.2 costs $1.75/1M input tokens and $14/1M output tokens. GPT-5 costs $1.25/$10. Budget options like GPT-5 Nano cost just $0.05/$0.40, and GPT-4.1 Nano costs $0.10/$0.40. Reasoning models like o3 cost $2.00/$8.00 per 1M tokens. Prices are current as of 2026.
Which AI API is cheapest?
The cheapest AI APIs by input token cost are: GPT-5 Nano ($0.05/1M), Nova Lite ($0.06/1M), GPT-4.1 Nano and Gemini 2.5 Flash Lite ($0.10/1M each), and DeepSeek V3.2 ($0.14/1M). For the best quality-to-price ratio, DeepSeek V3.2 and Qwen models offer exceptional value with near-flagship performance at budget prices.
How do AI model pricing tiers work?
AI model pricing is based on token usage — you pay per million tokens processed. Input tokens (your prompts) and output tokens (model responses) are priced separately, with output tokens typically costing 2-8x more. Flagship models (GPT-5.2, Claude Opus 4.6) cost $1-5/1M input, mid-tier models cost $0.20-1.00/1M, and budget models cost $0.05-0.15/1M input tokens.
What are input vs output tokens?
Input tokens are the text you send to the AI model (your prompts, context, system instructions). Output tokens are the text the model generates in response. A token is roughly 3/4 of a word in English. Output tokens are more expensive because they require more compute to generate. For example, GPT-5.2 charges $1.75/1M input tokens but $14/1M output tokens — 8x more for output.