LLM API prices

175 models · USD per 1M tokens

last refresh 15 Sept 2026, 06:37 UTC
Estimate your monthly bill
175 / 219
Tags
ModelBlendedCtx
cheapestgpt-oss-20breasoningprompt cachetools$0.04131K
Qwen3.7 Flashopen weightsreasoningvision$0.061M
Mistral Small 3open weights$0.0633K
DeepSeek V4 Flash 0731open weightsreasoningprompt cache$0.061M
Command R7B (12-2024)$0.07128K
gpt-oss-120breasoningtools$0.07131K
GPT-5 Nanoreasoningvisionprompt cache$0.07400K
Qwen3 30B A3B Instruct 2507open weightstools200k+ context$0.08262K
Phi 4open weights$0.0916K
Qwen3.5-9Bopen weightsreasoningvision$0.09262K
Gemma 4 26B A4Bopen weightsreasoningvision$0.09262K
Gemini 2.5 Flash Litereasoningvisionprompt cache$0.091M
Gemma 3 27Bopen weightsvisionprompt cache$0.10131K
Nova Lite 1.0visiontools200k+ context$0.11300K
Mistral Small 3.2 24Bopen weightsvisiontools$0.11256K
Granite 4.2 8Bopen weightsreasoningprompt cache$0.11131K
Qwen3.5-Flashopen weightsreasoningvision$0.111M
Qwen3 Coder 30B A3B Instructopen weightscodingtools$0.12262K
GLM 5.3 Flashopen weightsreasoningvision$0.121M
Qwen3 32Bopen weightsreasoningtools$0.13131K
gpt-oss-safeguard-20breasoningprompt cachetools$0.13131K
Qwen3 14Bopen weightsreasoningtools$0.13131K
GLM 4.7 Flashopen weightsreasoningtools$0.15200K
Llama 4 Scoutopen weightsvisiontools$0.151M
Gemma 4 31Bopen weightsreasoningvision$0.15262K
Qwen3 235B A22B Instruct 2507open weightsprompt cachetools$0.15262K
Llama 3.3 70B Instructopen weightstools$0.16131K
GPT-4.1 Nanovisionprompt cachetools$0.181M
Qwen3 VL 32B Instructopen weightsvisiontools$0.18131K
Qwen3 8Bopen weightsreasoningtools$0.20131K
Qwen3 VL 8B Instructopen weightsvisiontools$0.20262K
Qwen3.6 35B A3Bopen weightsreasoningvision$0.21262K
Qwen3 30B A3Bopen weightsreasoningtools$0.22131K
Qwen3.8 Flashopen weightsreasoningvision$0.231M
Qwen3 VL 30B A3B Instructopen weightsvisiontools$0.23262K
DeepSeek V3.2open weightsreasoningprompt cache$0.23164K
GPT-5.6 Lunareasoningvisionprompt cache$0.231M
GPT-5.6 Luna Proreasoningvisionprompt cache$0.231M
GPT-5.4 Nanoreasoningvisionprompt cache$0.23400K
Qwen3.5-35B-A3Bopen weightsreasoningvision$0.25262K
Mistral Small 4open weightsreasoningvision$0.26262K
GPT-4o-minivisionprompt cachetools$0.26128K
DeepSeek V4.1 Flashopen weightsreasoningvision$0.261M
Qwen3 Next 80B A3B Instructopen weightstools200k+ context$0.27262K
Gemini 3.1 Flash Litereasoningvisionprompt cache$0.281M
Qwen3 Coder Nextopen weightscodingprompt cache$0.29262K
Sabaopen weightsprompt cachetools$0.3033K
Llama 4 Maverickopen weightsvisiontools$0.301M
DeepSeek V3.2 Expopen weightsreasoningtools$0.31164K
DeepSeek V4 Flash Vision Expopen weightsreasoningvision$0.321M
GPT-5 Minireasoningvisionprompt cache$0.34400K
Qwen3 VL 235B A22B Instructopen weightsvisionprompt cache$0.37262K
Qwen-Plusopen weightsprompt cachetools$0.391M
Qwen3 Coder Flashopen weightscodingprompt cache$0.391M
Mistral Small 3.1 24Bopen weightsvision$0.40128K
Qwen3 Next 80B A3B Thinkingopen weightsreasoningtools$0.41262K
DeepSeek V3 0324open weightstools$0.41164K
Qwen3.6 Flashopen weightsreasoningvision$0.421M
DeepSeek V3.1open weightsreasoningprompt cache$0.43164K
Gemini 2.5 Flashreasoningvisionprompt cache$0.431M

click a row to compare (up to 3) · cheapest provider shown - open a model for every route · blended = 3×in + out, /4 · colour = price band in view - OpenRouter API (live) + routes d'accès par modèle (219 modèles)

Concepts on this page