AI Model Pricing Comparison — API Costs for 466 Models

Compare costs across all models. Calculate your monthly spend based on usage.

Estimate your cost

million
million
ModelProvider
Cost Visualization
Phi-4 Mini
open source
MicrosoftFreeFree131K150 tok/s
Lyria 3 Clip Preview
budget
GoogleFreeFree1.0M—
Lyria 3 Pro Preview
budget
GoogleFreeFree1.0M—
Devstral Small 2
open source
MistralFreeFree256K—
Gemma 2 2b It
open source
NVIDIAFreeFree128K—
GLM-4.5-Flash
open source
Zhipu AIFreeFree131K—
North Mini Code
open source
CohereFreeFree256K—
Qwen Image
budget
NVIDIAFreeFree0—
Qwen Image Edit
budget
NVIDIAFreeFree0—
Mistral Large 3 675B Instruct 2512
open source
NVIDIAFreeFree262K—
Ministral 3 14B Instruct 2512
open source
NVIDIAFreeFree262K—
mistral-small-4-119b-2603
open source
NVIDIAFreeFree128K—
Mistral: Mixtral 8x7B Instruct
open source
NVIDIAFreeFree33K—
Mistral-7B-Instruct-v0.3
open source
NVIDIAFreeFree66K—
Magistral Small 2506
budget
NVIDIAFreeFree33K—
streampetr
open source
NVIDIAFreeFree128K—
Llama 3.3 Nemotron Super 49B v1.5
open source
NVIDIAFreeFree131K—
usdcode
budget
NVIDIAFreeFree128K—
Nemotron 3 Nano Omni
open source
NVIDIAFreeFree256K—
cosmos-transfer1-7b
open source
NVIDIAFreeFree0—
nemotron-voicechat
open source
NVIDIAFreeFree128K—
studiovoice
open source
NVIDIAFreeFree128K—
nemotron-3-content-safety
open source
NVIDIAFreeFree128K—
cosmos-transfer2.5-2b
open source
NVIDIAFreeFree0—
bevformer
open source
NVIDIAFreeFree128K—
Llama 3.1 Nemotron Nano VL 8B v1
open source
NVIDIAFreeFree33K—
llama-nemotron-embed-vl-1b-v2
open source
NVIDIAFreeFree33K—
synthetic-video-detector
open source
NVIDIAFreeFree0—
llama-nemotron-rerank-vl-1b-v2
open source
NVIDIAFreeFree128K—
usdvalidate
open source
NVIDIAFreeFree0—
Active Speaker Detection
open source
NVIDIAFreeFree0—
Llama 3.1 Nemotron Ultra 253B
open source
NVIDIAFreeFree128K—
llama-3_2-nemoretriever-300m-embed-v1
open source
NVIDIAFreeFree33K—
nv-embedcode-7b-v1
open source
NVIDIAFreeFree33K—
llama-3.1-nemotron-safety-guard-8b-v3
open source
NVIDIAFreeFree128K—
nemotron-mini-4b-instruct
open source
NVIDIAFreeFree128K—
cosmos-predict1-5b
open source
NVIDIAFreeFree0—
nemotron-content-safety-reasoning-4b
open source
NVIDIAFreeFree128K—
riva-translate-4b-instruct-v1_1
open source
NVIDIAFreeFree128K—
BGE M3
open source
NVIDIAFreeFree8K—
sparsedrive
open source
NVIDIAFreeFree128K—
gliner-pii
open source
NVIDIAFreeFree128K—
Llama 3.1 Nemotron Nano 8B v1
open source
NVIDIAFreeFree131K—
nv-embed-v1
open source
NVIDIAFreeFree33K—
rerank-qa-mistral-4b
open source
NVIDIAFreeFree128K—
Nemotron 3.5 Lightning 30B A3B
open source
NVIDIAFreeFree262K—
paligemma
open source
NVIDIAFreeFree128K—
nvidia-nemotron-nano-9b-v2
open source
NVIDIAFreeFree131K—
Cosmos Reason2 8B
open source
NVIDIAFreeFree131K—
Gemma 3 4B IT
open source
NVIDIAFreeFree131K—
Gemma 3n E2b It
open source
NVIDIAFreeFree128K—
Gemma 3n E4b It
open source
NVIDIAFreeFree128K—
Llama-3.2-90B-Vision-Instruct
open source
NVIDIAFreeFree128K—
esmfold
open source
NVIDIAFreeFree128K—
Llama 3.2 11b Vision Instruct
open source
NVIDIAFreeFree128K—
ByteDance-Seed/Seed-OSS-36B-Instruct
budget
NVIDIAFreeFree262K—
sarvam-m
open source
NVIDIAFreeFree128K—
Phi 4 Multimodal
budget
NVIDIAFreeFree128K—
Llama 3.1 Nemotron 70B Instruct
open source
NVIDIAFreeFree128K—
dracarys-llama-3.1-70b-instruct
open source
NVIDIAFreeFree128K—
Whisper Large v3
open source
NVIDIAFreeFree0—
solar-10.7b-instruct
open source
NVIDIAFreeFree128K—
FLUX.1-schnell
open source
NVIDIAFreeFree77—
Gemma 3 12B IT
open source
NVIDIAFreeFree131K—
Llama 4 Maverick 17b 128e Instruct
open source
NVIDIAFreeFree128K—
esm2-650m
open source
NVIDIAFreeFree128K—
FLUX.2 Klein 4B
open source
NVIDIAFreeFree41K—
FLUX.1-dev
budget
NVIDIAFreeFree4K—
FLUX.1-Kontext-dev
open source
NVIDIAFreeFree41K—
mistral-nemotron
open source
NVIDIAFreeFree128K—
magpie-tts-zeroshot
open source
NVIDIAFreeFree0—
Nemotron Nano 12B v2 VL
open source
NVIDIAFreeFree128K—
Llama 3.3 Nemotron Super 49B v1
open source
NVIDIAFreeFree131K—
Mistral Nemo
open source
Mistral$0.02$0.03131K—
text-embedding-3-small
budget
OpenAI$0.02Free8K—
Llama 3.2 1b Instruct
open source
NVIDIA$0.03$0.2060K—
GPT-OSS 20B
open source
OpenAI$0.03$0.13131K312 tok/s
Qwen3-ASR Flash
budget
Alibaba$0.04$0.0453K—
Nova Micro (US)
budget
Amazon Bedrock$0.04$0.14128K—
DeepSeek V4 Flash
open source
DeepSeek$0.04$0.111.3M—
GPT-OSS 120B
open source
OpenAI$0.04$0.17131K339 tok/s
Command R7B Arabic
open source
Cohere$0.04$0.15128K—
Command R7B
open source
Cohere$0.04$0.15128K—
Ministral 3B (latest)
open source
Mistral$0.04$0.04128K—
Mercury 2.5
budget
Inception$0.04$0.15260K—
Voxtral Mini 3B 2507
open source
Amazon Bedrock$0.04$0.0433K—
Gemma 4 E2B IT
open source
Amazon Bedrock$0.04$0.08131K—
Gemma 3 12B
open source
Google$0.05$0.15131K90 tok/s
Gemma 3 4B
open source
Google$0.05$0.10131K—
Qwen Flash
budget
Alibaba$0.05$0.401.0M—
Qwen Turbo
budget
Alibaba$0.05$0.201.0M—
nemotron-3-nano-30b-a3b
open source
NVIDIA$0.05$0.20262K—
Llama 3.1 8B Instruct
open source
NVIDIA$0.05$0.08131K—
Llama 3.2 3B Instruct
open source
NVIDIA$0.05$0.33131K—
GPT-5 Nano
budget
OpenAI$0.05$0.40400K250 tok/s
Nova Lite
budget
Amazon$0.06$0.24300K150 tok/s
DeepSeek V4 Flash 0731
open source
Alibaba$0.06$0.121.3M—
Laguna XS 2.1
open source
NVIDIA$0.06$0.12262K—
NVIDIA Nemotron Nano 3 30B
open source
Amazon Bedrock$0.06$0.24262K—
GLM-4.7-Flash
open source
Zhipu AI$0.06$0.40200K—
Qwen3-Coder 30B-A3B Instruct
open source
Alibaba$0.07$0.28262K—
GLM-4.7-FlashX
open source
Zhipu AI$0.07$0.40200K—
Qwen-Omni Turbo
budget
Alibaba$0.07$0.2733K—
Phi-4
open source
Microsoft$0.07$0.1416K93 tok/s
Mistral Small 3.2
budget
Mistral$0.07$0.20256K160 tok/s
GPT OSS Safeguard 20B
open source
Amazon Bedrock$0.07$0.30131K—
Phi-4-mini-reasoning
open source
Azure$0.07$0.30128K—
Gemma 3 27B
open source
Google$0.08$0.45131K58 tok/s
Qwen 3 32B
open source
Qwen$0.08$0.28131K120 tok/s
Nemotron 3 Super
open source
NVIDIA$0.08$0.40262K—
Qwen3 235B-A22B Instruct 2507
open source
Amazon Bedrock$0.09$0.35262K—
Qwen3-Next 80B-A3B Instruct
open source
Alibaba$0.09$1.1262K—
Solar Pro 4
budget
Upstage$0.09$0.36524K—
Llama 4 Scout
open source
Meta$0.10$0.301.3M140 tok/s
Reka Flash 3
mid
Reka AI$0.10$0.2066K136 tok/s
Gemini 2.5 Flash Lite
budget
Google$0.10$0.401.0M240 tok/s
Llama 3.3 70B
open source
Meta$0.10$0.32131K90 tok/s
GPT-4.1 Nano
budget
OpenAI$0.10$0.401.0M200 tok/s
Qwen3.6 35B-A3B
open source
Alibaba$0.10$0.90262K—
Muse Spark 1.2 Contributor
budget
Meta$0.10$0.201.0M—
Muse Spark 1.3 Contributor
budget
Meta$0.10$0.201.0M—
Qwen2.5 7B Instruct
open source
Alibaba$0.10$0.2033K—
Step 3.5 Flash
open source
StepFun$0.10$0.30262K—
Llama 3.3 70b Instruct
open source
NVIDIA$0.10$0.32131K—
Voxtral Small 24B 2507
open source
Amazon Bedrock$0.10$0.3033K—
Gemini 2.0 Flash
budget
Google$0.10$0.401.0M220 tok/s
Devstral Small
open source
Mistral$0.10$0.30128K—
Mistral Embed
budget
Mistral$0.10Free8K—
Devstral Small 2505
open source
Mistral$0.10$0.30128K—
Voxtral Small (latest)
open source
Mistral$0.10$0.3032K—
Ministral 8B (latest)
open source
Mistral$0.10$0.10128K—
Qwen2.5-Omni 7B
open source
Alibaba$0.10$0.4033K—
Step 3.5 Flash 2603
open source
StepFun$0.10$0.30256K—
Ministral 3 3B
open source
Amazon Bedrock$0.10$0.10256K—
Mistral Small 3.1
budget
Azure$0.10$0.30128K—
Embed v3 English
open source
Azure$0.10Free512—
Embed v3 Multilingual
open source
Azure$0.10Free512—
text-embedding-ada-002
budget
OpenAI$0.10Free8K—
Qwen3 8B
open source
Alibaba$0.12$0.46131K—
Qwen3 14B
open source
Alibaba$0.12$0.24131K—
Qwen3 Coder Next
open source
Amazon Bedrock$0.12$0.80262K—
Embed v4
open source
Azure$0.12Free128K—
Phi-4 Reasoning Plus
open source
Microsoft$0.13$0.5032K—
Phi-4-reasoning
open source
Azure$0.13$0.5032K—
text-embedding-3-large
budget
OpenAI$0.13Free8K—
GLM-4.5-Air
open source
Zhipu AI$0.13$0.85131K—
Yi Lightning
mid
01.AI$0.14$0.1416K—
Model Router
budget
Azure$0.14Free200K—
Command R
mid
Cohere$0.15$0.60128K90 tok/s
GPT-4o Mini
budget
OpenAI$0.15$0.60128K200 tok/s
Gemini Embedding 001
budget
Google$0.15Free2K—
Qwen3.8 Flash
budget
Alibaba$0.15$0.471.0M—
Pixtral 12B
open source
Mistral$0.15$0.15128K—
Mistral Small (latest)
open source
Mistral$0.15$0.60256K—
Open Mistral Nemo
open source
Mistral$0.15$0.15128K—
Mistral Small 4
open source
Mistral$0.15$0.60262K—
GLM-5.3-Flash
open source
Zhipu AI$0.15$0.501.3M—
solar-mini
budget
Upstage$0.15$0.1533K—
solar-pro3
budget
Upstage$0.15$0.60131K—
Ministral 3 8B
open source
Mistral$0.15$0.15128K172 tok/s
NVIDIA Nemotron 3 Super 120B A12B
open source
Amazon Bedrock$0.15$0.65262K—
GPT OSS Safeguard 120B
open source
Amazon Bedrock$0.15$0.60128K—
Qwen-MT Turbo
budget
Alibaba$0.16$0.4916K—
Llama 4 Scout 17B Instruct (US)
open source
Amazon Bedrock$0.17$0.6610.0M—
Llama Guard 4 12B
open source
NVIDIA$0.18$0.18164K—
Qwen3.6 Flash
budget
Alibaba$0.19$1.11.0M—
Qwen3 Coder Flash
budget
Alibaba$0.20$0.971.0M—
Qwen3.5 27B
open source
Alibaba$0.20$1.6262K—
Llama 4 Maverick
open source
Meta$0.20$0.701.0M100 tok/s
Grok 4 Fast
mid
xAI$0.20$0.50256K110 tok/s
Jamba 1.5 Mini
mid
AI21 Labs$0.20$0.40256K35 tok/s
GPT-5.6 Luna
budget
OpenAI$0.20$1.21.1M—
GPT-5.4 nano
budget
OpenAI$0.20$1.3400K—
Gemini Embedding 2
budget
Google$0.20Free8K—
Qwen3-VL 30B-A3B
open source
Alibaba$0.20$0.80131K—
Qwen3-VL Plus
budget
Alibaba$0.20$1.6262K—
Grok 4.1 Fast
mid
xAI$0.20$0.50256K120 tok/s
NVIDIA Nemotron Nano 12B v2 VL BF16
open source
Amazon Bedrock$0.20$0.60128K—
Ministral 14B 3.0
open source
Amazon Bedrock$0.20$0.20128K—
Llama 4 Scout 17B 16E Instruct
open source
Azure$0.20$0.78128K—
Step 3.7 Flash
open source
StepFun$0.20$1.1262K—
Qwen-VL Plus
budget
Alibaba$0.21$0.63131K—
Qwen3 VL 235B A22B Instruct
open source
Amazon Bedrock$0.21$1.9262K—
DeepSeek V4 Flash Vision Exp
open source
DeepSeek$0.22$0.661.0M—
Qwen3 235B A22B Instruct
open source
Vertex$0.22$0.88262K—
Gemma 3 27B IT
open source
Amazon Bedrock$0.23$0.38203K—
Llama 4 Maverick 17B Instruct (US)
open source
Amazon Bedrock$0.24$0.971.0M—
GPT-5 Mini
mid
OpenAI$0.25$2.0400K180 tok/s
DeepSeek V3.1
open source
DeepSeek$0.25$0.95164K65 tok/s
GPT-5.1 Codex Mini
mid
OpenAI$0.25$2.0400K170 tok/s
Gemini 3.1 Flash Lite
budget
Google$0.25$1.51.0M—
Nano Banana 2 Lite
budget
Google$0.25$1.566K—
Mistral 7B
open source
Mistral$0.25$0.258K—
Mercury Edit 2
budget
Inception$0.25$0.75128K—
Mercury 2
budget
Inception$0.25$0.75128K—
solar-pro2
budget
Upstage$0.25$0.2566K—
Llama 4 Maverick 17B 128E Instruct FP8
open source
Azure$0.25$1.01.0M—
MiniMax-M2
open source
MiniMax$0.26$1.0205K—
Qwen Plus
budget
Alibaba$0.26$0.781.0M—
Qwen3.5 122B-A10B
open source
Alibaba$0.26$2.1262K—
DeepSeek V3.2
open source
DeepSeek$0.27$0.40164K70 tok/s
MiniMax M2.5
flagship
MiniMax$0.27$1.1205K59 tok/s
Qwen-Omni Turbo Realtime
budget
Alibaba$0.27$1.133K—
Grok 3 Mini
budget
xAI$0.30$0.50131K130 tok/s
Codestral
mid
Mistral$0.30$0.90256K90 tok/s
Qwen 3 Coder
open source
Qwen$0.30$1.0262K80 tok/s
Gemini 2.5 Flash
mid
Google$0.30$2.51.0M251 tok/s
Qwen3.6 27B
open source
Alibaba$0.30$2.0262K—
Gemini Flash-Lite Latest
budget
Google$0.30$2.51.0M—
DeepSeek V4.1 Flash
open source
DeepSeek$0.30$1.21.0M—
GLM-4.6V
mid
Zhipu AI$0.30$0.90131K68 tok/s
MiniMax-M3
open source
MiniMax$0.30$1.21.0M—
MiniMax-M2.7
open source
MiniMax$0.30$1.2205K—
Nova 2 Lite (EU)
budget
Amazon Bedrock$0.30$2.51.0M—
Codestral 25.01
budget
Azure$0.30$0.90256K—
Nano Banana
budget
Google$0.30$2.533K—
Gemini 3.5 Flash Lite
budget
Google$0.30$2.51.0M—
MiniMax-M2.1
open source
MiniMax$0.30$1.2205K—
Qwen3.5 35B-A3B
open source
Alibaba$0.31$1.3262K—
Qwen3.7 Plus
budget
Alibaba$0.32$1.31.0M—
Qwen3.6 Plus
budget
Alibaba$0.33$1.91.0M—
Qwen2.5-VL 7B Instruct
open source
Alibaba$0.35$1.1131K—
Qwen2.5 14B Instruct
open source
Alibaba$0.35$1.4131K—
Muse Glimmer 30B
open source
NVIDIA$0.35$1.5131K—
Qwen 2.5 72B
open source
Qwen$0.36$0.4033K80 tok/s
Qwen2.5 72B Instruct
open source
Alibaba$0.36$0.4033K—
GPT-4.1 Mini
budget
OpenAI$0.40$1.61.0M160 tok/s
Mistral Medium 3.1
mid
Mistral$0.40$2.0131K110 tok/s
Devstral 2
open source
Mistral$0.40$2.0262K—
Mistral Medium 3
budget
Mistral$0.40$2.0131K—
Qwen3.5 Plus
budget
Alibaba$0.40$2.41.0M—
GLM-4.7
open source
Zhipu AI$0.40$1.8205K—
Llama 3.1 70b Instruct
open source
NVIDIA$0.40$0.40131K—
Devstral 2 123B
open source
Amazon Bedrock$0.40$2.0256K—
Devstral Medium
open source
Mistral$0.40$2.0128K—
Qwen3-Omni Flash
budget
Alibaba$0.43$1.766K—
GLM-4.6
open source
Zhipu AI$0.43$1.8205K—
DeepSeek V4 Pro
open source
DeepSeek$0.43$0.871.0M—
Kimi K2.5
flagship
Moonshot AI$0.45$2.3262K45 tok/s
Qwen 3 235B
open source
Qwen$0.46$1.8131K60 tok/s
Qwen3 235B-A22B
open source
Alibaba$0.46$1.8131K—
Gemini 3 Flash
mid
Google$0.50$3.01.0M200 tok/s
DeepSeek R1 0528
open source
DeepSeek$0.50$2.1164K40 tok/s
Mistral Large 25.12
flagship
Mistral$0.50$1.5262K70 tok/s
Nano Banana 2
budget
Google$0.50$3.0131K—
Qwen Plus Character (Japanese)
budget
Alibaba$0.50$1.48K—
Magistral Small
open source
Mistral$0.50$1.5128K—
Mistral Large 3
open source
Mistral$0.50$1.5262K—
Qwen3-Next 80B-A3B (Thinking)
open source
Alibaba$0.50$6.0131K—
Nemotron 3 Ultra 550B A55B
open source
NVIDIA$0.50$2.51.0M—
Gemini 2.5 Flash TTS
budget
Vertex$0.50$10.033K—
Magistral Small 1.2
open source
Amazon Bedrock$0.50$1.5128K—
GPT-3.5 Turbo 0125
budget
Azure$0.50$1.516K—
Qwen3-Omni Flash Realtime
mid
Alibaba$0.52$2.066K—
Qwen 3.5 397B
open source
Qwen$0.55$3.5262K45 tok/s
Qwen3.5 397B-A17B
open source
Alibaba$0.55$3.5262K—
DeepSeek-V3.2-Speciale
open source
Azure$0.58$1.7128K—
GLM-5
flagship
Zhipu AI$0.60$1.9205K55 tok/s
GLM-4.5V
open source
Zhipu AI$0.60$1.866K—
GLM-4.5
open source
Zhipu AI$0.60$2.2131K—
MiniMax-M2.7-highspeed
open source
MiniMax$0.60$2.4205K—
MiniMax-M2.5-highspeed
open source
MiniMax$0.60$2.4205K—
Kimi K2 Thinking
open source
Vertex$0.60$2.5262K—
Kimi K2 0905
open source
NVIDIA$0.60$2.5262K—
Palmyra X5 (US)
mid
Amazon Bedrock$0.60$6.01.0M—
Qwen3 Coder Plus
open source
Alibaba$0.65$3.31.0M—
Qwen2.5 Coder 32b Instruct
open source
NVIDIA$0.66$1.033K—
GLM-5.2
open source
Mistral$0.68$2.11.0M—
DeepSeek R1
open source
DeepSeek$0.70$2.564K35 tok/s
Mixtral 8x7B
open source
Mistral$0.70$0.7032K—
Qwen2.5 32B Instruct
open source
Alibaba$0.70$2.8131K—
Qwen3-VL 235B-A22B
open source
Alibaba$0.70$2.8131K—
Kimi K2.7 Code
open source
Moonshot AI$0.71$3.5262K—
Qwen-VL OCR
mid
Alibaba$0.72$0.7234K—
GPT-5.4 mini
mid
OpenAI$0.75$4.5400K—
Gemini 3.6 Flash
mid
Google$0.75$3.81.0M—
Gemini 3.1 Flash Live Preview
mid
Google$0.75$4.5131K—
Gemini 3.8 Flash
mid
Google$0.75$3.81.0M—
Gemini 3.7 Flash
mid
Google$0.75$3.81.0M—
Gemini Flash Latest
mid
Google$0.75$3.81.0M—
Qwen 3 Max
open source
Qwen$0.78$3.9262K55 tok/s
Nova Pro
mid
Amazon$0.80$3.2300K100 tok/s
Qwen2.5-VL 72B Instruct
open source
Alibaba$0.80$1.0128K—
Morph v3 Fast
mid
Morph$0.80$1.282K—
Claude 3.5 Haiku
budget
Anthropic$0.80$4.0200K170 tok/s
Qwen-VL Max
mid
Alibaba$0.80$3.2131K—
QwQ Plus
mid
Alibaba$0.80$2.4131K—
Auto
mid
Morph$0.85$1.632K—
Morph v3 Large
mid
Morph$0.90$1.9262K—
Kimi K2.6
open source
Moonshot AI$0.95$4.0262K—
GLM-5.1
mid
Zhipu AI$0.97$3.0205K—
DeepSeek V4 Pro 0813
open source
NVIDIA$0.98$3.01.0M—
Sonar
mid
Perplexity$1.0$1.0127K—
Claude Haiku 4.5
budget
Anthropic$1.0$5.0200K180 tok/s
GPT-3.5-turbo
budget
OpenAI$1.0$2.04K—
Gemini 3.1 Flash TTS Preview
mid
Google$1.0$20.08K—
Grok Build 0.1
mid
xAI$1.0$2.0256K—
Inkling
open source
NVIDIA$1.0$4.01.0M—
Gemini 2.5 Pro TTS
mid
Vertex$1.0$20.033K—
GPT-3.5 Turbo 1106
mid
Azure$1.0$2.016K—
Qwen3.6 Max Preview
mid
Alibaba$1.0$6.2262K—
o3 Mini
mid
OpenAI$1.1$4.4200K100 tok/s
o4 Mini
mid
OpenAI$1.1$4.4200K120 tok/s
QVQ Max
mid
Alibaba$1.2$4.8131K—
GLM-5V-Turbo
flagship
Zhipu AI$1.2$4.0203K—
Gemini 2.5 Pro
flagship
Google$1.3$10.01.0M55 tok/s
GPT-5
flagship
OpenAI$1.3$10.0400K100 tok/s
GPT-5.1
flagship
OpenAI$1.3$10.0400K95 tok/s
Gemini 2.5 Computer Use Preview 10-2025
mid
Google$1.3$10.0131K—
Muse Spark 1.1
mid
Meta$1.3$4.31.0M—
Muse Spark 1.2
mid
Meta$1.3$4.31.0M—
Grok 4.3
mid
xAI$1.3$2.51.0M—
Grok 4.20 (Reasoning)
mid
xAI$1.3$2.52.0M—
Grok 4.20 Multi-Agent
mid
xAI$1.3$2.52.0M—
GPT-5-Codex
mid
Azure$1.3$10.0400K—
GPT-5.1 Codex Max
mid
Azure$1.3$10.0400K—
GPT-5.1 Codex
flagship
OpenAI$1.3$10.0400K85 tok/s
Muse Spark 1.3
mid
Meta$1.3$4.31.0M—
GLM-5.3
open source
Zhipu AI$1.4$4.41.3M—
Qwen3.7 Max
mid
Alibaba$1.5$4.41.0M—
Gemini 3.5 Flash
mid
Google$1.5$9.01.0M—
Gemini Omni Flash Preview
mid
Google$1.5$17.5131K—
Mistral Medium (latest)
open source
Mistral$1.5$7.5262K—
Qwen3-Coder 480B-A35B Instruct
open source
Alibaba$1.5$7.5262K—
Codex Mini
mid
Azure$1.5$6.0200K—
GPT-3.5 Turbo Instruct
mid
Azure$1.5$2.04K—
Mistral Medium 3.5
open source
Mistral$1.5$7.5262K—
Qwen Max
mid
Alibaba$1.6$6.433K—
GPT-5.2
flagship
OpenAI$1.8$14.0400K90 tok/s
GPT-5.3 Codex
mid
OpenAI$1.8$14.0400K—
GPT-5.2 Chat
mid
OpenAI$1.8$14.0128K—
GPT-5.3 Chat (latest)
mid
OpenAI$1.8$14.0128K—
GPT-5.2 Codex
mid
Azure$1.8$14.0400K—
GPT-5.3 Codex Spark
mid
OpenAI$1.8$14.0128K—
Kimi K2.7 Code HighSpeed
open source
Moonshot AI$1.9$8.0262K—
Pixtral Large
flagship
Mistral$2.0$6.0131K60 tok/s
Gemini 3.1 Pro
flagship
Google$2.0$12.01.0M65 tok/s
o3
flagship
OpenAI$2.0$8.0200K40 tok/s
Gemini 3 Pro
flagship
Google$2.0$12.01.0M60 tok/s
Jamba 1.5 Large
flagship
AI21 Labs$2.0$8.0256K19 tok/s
GPT-4.1
mid
OpenAI$2.0$8.01.0M70 tok/s
Grok 2
mid
xAI$2.0$10.0131K80 tok/s
Claude Sonnet 5
mid
Anthropic$2.0$10.01.0M—
GPT-5.6 Sol
mid
OpenAI$2.0$10.01.1M—
Deep Research Max Preview (Apr-21-2026)
mid
Google$2.0$12.0131K—
Nano Banana Pro
mid
Google$2.0$12.0131K—
Deep Research Preview (Apr-21-2026)
mid
Google$2.0$12.0131K—
GPT-5.6 Terra
mid
OpenAI$2.0$12.01.1M—
Qwen3.8 Max
mid
Alibaba$2.0$6.01.0M—
Magistral Medium (latest)
open source
Mistral$2.0$5.0128K—
Mixtral 8x22B
open source
Mistral$2.0$6.064K—
Mistral Large (latest)
open source
Mistral$2.0$6.0128K—
Mistral Large 2.1
open source
Mistral$2.0$6.0131K—
Grok 4.5
mid
xAI$2.0$6.0500K—
Grok 4.6
mid
xAI$2.0$6.0500K—
Mistral: Mixtral 8x22B Instruct
open source
NVIDIA$2.0$6.066K—
Sonar Reasoning Pro
flagship
Perplexity$2.0$8.0128K22 tok/s
Perplexity Sonar Deep Research
mid
Perplexity$2.0$8.0128K—
Step 1 (32K)
mid
StepFun$2.0$9.633K—
Qwen-MT Plus
mid
Alibaba$2.5$7.416K—
GPT-4o
mid
OpenAI$2.5$10.0128K143 tok/s
Command R+
flagship
Cohere$2.5$10.0128K60 tok/s
GPT-5.4
mid
OpenAI$2.5$15.01.1M—
Command A Plus
open source
Cohere$2.5$10.0128K—
Command A Reasoning
open source
Cohere$2.5$10.0256K—
Command A Vision
open source
Cohere$2.5$10.0128K—
Command A Translate
open source
Cohere$2.5$10.08K—
Palmyra X4 (US)
mid
Amazon Bedrock$2.5$10.0123K—
Nova Premier (US)
mid
Amazon Bedrock$2.5$12.51.0M—
Command A
flagship
Cohere$2.5$10.0256K70 tok/s
Kimi K3
open source
Moonshot AI$2.6$13.31.0M—
o1 Mini
mid
OpenAI$3.0$12.0128K80 tok/s
Claude 3.7 Sonnet
mid
Anthropic$3.0$15.0200K70 tok/s
Claude 3.5 Sonnet
mid
Anthropic$3.0$15.0200K70 tok/s
Grok 4
flagship
xAI$3.0$15.0256K55 tok/s
Grok 3
mid
xAI$3.0$15.01.0M65 tok/s
Sonar Pro
flagship
Perplexity$3.0$15.0200K50 tok/s
Claude Sonnet 4.5
flagship
Anthropic$3.0$15.01.0M67 tok/s
Claude Sonnet 4
mid
Anthropic$3.0$15.01.0M75 tok/s
Claude Sonnet 4.6
flagship
Anthropic$3.0$15.01.0M57 tok/s
AU Anthropic Claude Sonnet 4.6
mid
Amazon Bedrock$3.3$16.51.0M—
Gemini 3.5 Live Translate Preview
mid
Google$3.5$21.016K—
GPT-5.6
mid
OpenAI$4.0$20.01.1M—
GPT-Realtime-2.1
mid
OpenAI$4.0$24.0128K—
Claude Opus 4.6
flagship
Anthropic$5.0$25.01.0M68 tok/s
Claude Opus 4.7
flagship
Anthropic$5.0$25.01.0M—
Claude Opus 4.5
flagship
Anthropic$5.0$25.0200K50 tok/s
Claude Opus 4.8
flagship
Anthropic$5.0$25.01.0M—
GPT-5.5
flagship
OpenAI$5.0$30.01.1M—
GPT Chat Latest
flagship
Azure$5.0$30.0400K—
Claude Opus 5
flagship
Anthropic$5.0$25.01.0M—
gpt-image-2
flagship
OpenAI$5.0$30.00—
Step 2 (16K)
flagship
StepFun$5.2$16.416K—
Claude Fable 5.1
flagship
Anthropic$10.0$50.01.0M—
Claude Fable 5
flagship
Anthropic$10.0$50.01.0M60 tok/s
GPT-6 Astra
flagship
OpenAI$10.0$50.01.1M—
GPT-4 Turbo
flagship
OpenAI$10.0$30.0128K—
Qwen3-LiveTranslate Flash Realtime
flagship
Alibaba$10.0$10.053K—
GPT-4 Turbo Vision
flagship
Azure$10.0$30.0128K—
Claude Mythos 5
flagship
Azure$10.0$50.01.0M—
Claude Opus 4
flagship
Anthropic$15.0$75.0200K50 tok/s
o1
flagship
OpenAI$15.0$60.0200K35 tok/s
Claude 3 Opus
flagship
Anthropic$15.0$75.0200K25 tok/s
GPT-5 Pro
flagship
OpenAI$15.0$120.0400K—
Claude Opus 4.1
flagship
Vertex$15.0$75.0200K—
AU Anthropic Claude Opus 4.6
flagship
Amazon Bedrock$16.5$82.51.0M—
o3 Pro
flagship
OpenAI$20.0$80.0200K25 tok/s
GPT-5.2 Pro
flagship
OpenAI$21.0$168.0400K—
GPT-5.5 Pro
flagship
OpenAI$30.0$180.01.1M—
GPT-5.4 Pro
flagship
OpenAI$30.0$180.01.1M—
GPT-4
flagship
OpenAI$30.0$60.08K—
GPT-4.5
flagship
OpenAI$75.0$150.0128K60 tok/s
o1-pro
flagship
OpenAI$150.0$600.0200K—
MiMo V2 Flash
budget
Xiaomi——256K155 tok/s—
Doubao Seed 2.0
flagship
ByteDance——128K——
Nemotron 3 Nano
open source
NVIDIA——1.0M76 tok/s—
Magistral Medium 1.2
mid
Mistral——128K29 tok/s—
Ministral 3 14B
open source
Mistral——256K83 tok/s—
Qwen 3 Next 80B
open source
Qwen——262K138 tok/s—
Qwen 3 Coder 480B
open source
Qwen——262K60 tok/s—
Qwen 3 VL 235B
open source
Qwen——262K46 tok/s—
Nova 2.0 Lite
budget
Amazon——1.0M221 tok/s—
K-EXAONE
flagship
LG AI Research——256K62 tok/s—
Ring Flash 2.0
open source
InclusionAI——128K83 tok/s—
Step 2.5 Flash
mid
StepFun——128K67 tok/s—
Veo 3.1
flagship
Google——480——
DALL-E 3
flagship
OpenAI—————
Sora 2
flagship
OpenAI—————
Veo 3
flagship
Google—————
Kling 2.5 Turbo
flagship
Kuaishou—————
ERNIE 4.5
flagship
Baidu——128K——
ERNIE X1
flagship
Baidu——128K——
Hermes 4 70B
open source
Nous Research——128K——
Imagen 4
flagship
Google—————
Luma Ray 3
flagship
Luma AI—————
Runway Gen-4
flagship
Runway—————
Midjourney v7
flagship
Midjourney—————
Midjourney v6.1
flagship
Midjourney—————
Stable Diffusion 3.5
open source
Stability AI—————
Flux 1.1 Pro
flagship
Black Forest Labs—————
Flux 1.0 Dev
open source
Black Forest Labs—————
Ideogram 3.0
flagship
Ideogram—————
Seedream 4.5
flagship
ByteDance—————
Pika 2.5
flagship
Pika—————
chatgpt-image-latest
mid
OpenAI——0——
gpt-image-1
mid
OpenAI——0——
gpt-image-1-mini
mid
OpenAI——0——
gpt-image-1.5
mid
OpenAI——0——
Veo 3.1 fast
mid
Google——480——
Gemma 4 26B A4B IT
open source
Google——262K——
Veo 3.1 lite
mid
Google——480——
Gemma 4 31B IT
open source
Google——262K——
Voxtral Mini TTS (latest)
mid
Mistral——0——
Voxtral Mini (latest)
mid
Mistral——0——
Grok Imagine Video 1.5
mid
xAI——1K——
Grok Imagine Image 2.0
mid
xAI——64K——
Grok Imagine Image Quality
mid
xAI——16K——
Grok Imagine Video
mid
xAI——1K——
Aya Expanse 32B
open source
Cohere——128K——
Aya Expanse 8B
open source
Cohere——8K——
Aya Vision 8B
open source
Cohere——16K——
Aya Vision 32B
open source
Cohere——16K——
Step TTS 2
mid
StepFun——0——
StepAudio 2.5 ASR
mid
StepFun——0——
StepAudio 2.5 TTS
mid
StepFun——0——
Grok Imagine Image
mid
xAI——16K——
Input costOutput cost

Pricing sourced from OpenRouter API. Prices may vary by provider and tier. Last updated daily.

AI Pricing FAQ

How much does the OpenAI API cost?

OpenAI API pricing varies by model. GPT-5.2 costs $1.75/1M input tokens and $14/1M output tokens. GPT-5 costs $1.25/$10. Budget options like GPT-5 Nano cost just $0.05/$0.40, and GPT-4.1 Nano costs $0.10/$0.40. Reasoning models like o3 cost $2.00/$8.00 per 1M tokens. Prices are current as of 2026.

Which AI API is cheapest?

The cheapest AI APIs by input token cost are: GPT-5 Nano ($0.05/1M), Nova Lite ($0.06/1M), GPT-4.1 Nano and Gemini 2.5 Flash Lite ($0.10/1M each), and DeepSeek V3.2 ($0.14/1M). For the best quality-to-price ratio, DeepSeek V3.2 and Qwen models offer exceptional value with near-flagship performance at budget prices.

How do AI model pricing tiers work?

AI model pricing is based on token usage — you pay per million tokens processed. Input tokens (your prompts) and output tokens (model responses) are priced separately, with output tokens typically costing 2-8x more. Flagship models (GPT-5.2, Claude Opus 4.6) cost $1-5/1M input, mid-tier models cost $0.20-1.00/1M, and budget models cost $0.05-0.15/1M input tokens.

What are input vs output tokens?

Input tokens are the text you send to the AI model (your prompts, context, system instructions). Output tokens are the text the model generates in response. A token is roughly 3/4 of a word in English. Output tokens are more expensive because they require more compute to generate. For example, GPT-5.2 charges $1.75/1M input tokens but $14/1M output tokens — 8x more for output.