LLM API pricing, compared

Per-million-token prices for 73 current models from 6 providers, refreshed every day. Click a column to sort. Want a monthly total for your workload? Use the cost calculator, or see savings from batch APIs and prompt caching.

More tools: agent cost per task · long-context surcharges · embedding prices · token counter.

ModelProviderInput /1MOutput /1MCached input /1MContext
Claude Fable 5Anthropic$10.00$50.00$1.001000K
Claude Fable 5.1Anthropic$10.00$50.00$0.251000K
Claude Haiku 4.5Anthropic$1.00$5.00$0.10200K
Claude Mythos 5Anthropic$10.00$50.00$1.001000K
Claude Mythos 5.1Anthropic$10.00$50.00$0.251000K
Claude Opus 4.5Anthropic$5.00$25.00$0.50200K
Claude Opus 4.6Anthropic$5.00$25.00$0.501000K
Claude Opus 4.7Anthropic$5.00$25.00$0.501000K
Claude Opus 4.8Anthropic$5.00$25.00$0.501000K
Claude Opus 5Anthropic$5.00$25.00$0.501000K
Claude Opus 5.5Anthropic$4.00$20.00$0.201000K
Claude Sonnet 4.5Anthropic$3.00$15.00$0.301000K
Claude Sonnet 4.6Anthropic$3.00$15.00$0.301000K
Claude Sonnet 5Anthropic$2.00$10.00$0.201000K
Claude Sonnet 5.5Anthropic$2.00$10.00$0.201000K
DeepSeek V4 FlashDeepSeek$0.30$1.20$0.0061000K
DeepSeek V4 ProDeepSeek$1.32$3.96$0.0441000K
Gemini 2.5 FlashGoogle$0.30$2.50$0.031048K
Gemini 2.5 Flash LiteGoogle$0.10$0.40$0.011048K
Gemini 2.5 ProGoogle$1.25$10.00$0.1251048K
Gemini 3 Flash PreviewGoogle$0.50$3.00$0.051048K
Gemini 3.1 Flash LiteGoogle$0.25$1.50$0.0251048K
Gemini 3.1 Pro PreviewGoogle$2.00$12.00$0.201048K
Gemini 3.5 FlashGoogle$1.50$9.00$0.151048K
Gemini 3.5 Flash LiteGoogle$0.30$2.50$0.031048K
Gemini 3.6 FlashGoogle$0.75$3.75$0.0751048K
Gemini 3.7 FlashGoogle$0.75$3.75$0.0751048K
Gemini 3.8 FlashGoogle$0.75$3.75$0.0751048K
Gemini Flash (latest)Google$0.75$3.75$0.0751048K
Gemini Flash Lite (latest)Google$0.30$2.50$0.031048K
Gemini Pro (latest)Google$2.00$12.00$0.201048K
Codestral (latest)Mistral$0.30$0.90$0.03128K
Devstral Medium (latest)Mistral$0.40$2.00$0.04256K
Devstral Small (latest)Mistral$0.10$0.30$0.01256K
Magistral Medium (latest)Mistral$1.50$7.50$0.15262K
Magistral Small (latest)Mistral$0.15$0.60$0.015262K
Ministral 14b (latest)Mistral$0.20$0.20$0.02262K
Ministral 3b (latest)Mistral$0.10$0.10$0.01131K
Ministral 8b (latest)Mistral$0.15$0.15$0.015262K
Mistral Large (latest)Mistral$0.50$1.50$0.05262K
Mistral Large 4Mistral$0.68$2.09$0.068524K
Mistral Medium 3Mistral$1.50$7.50$0.15262K
Mistral Medium 3.5Mistral$1.50$7.50$0.15262K
Mistral Small (latest)Mistral$0.15$0.60$0.015262K
GPT-4.1OpenAI$2.00$8.00$0.501047K
GPT-4.1 miniOpenAI$0.40$1.60$0.101047K
GPT-4oOpenAI$2.50$10.00$1.25128K
GPT-4o miniOpenAI$0.15$0.60$0.075128K
GPT-5OpenAI$1.25$10.00$0.125272K
GPT-5 miniOpenAI$0.25$2.00$0.025272K
GPT-5 nanoOpenAI$0.05$0.40$0.005272K
GPT-5.1OpenAI$1.25$10.00$0.125272K
GPT-5.2OpenAI$1.75$14.00$0.175272K
GPT-5.4OpenAI$2.50$15.00$0.251050K
GPT-5.4 miniOpenAI$0.75$4.50$0.075272K
GPT-5.4 nanoOpenAI$0.20$1.25$0.02272K
GPT-5.5OpenAI$5.00$30.00$0.501050K
GPT-5.6 LunaOpenAI$0.20$1.20$0.02922K
GPT-5.6 SolOpenAI$4.00$20.00$0.40922K
GPT-5.6 TerraOpenAI$2.00$12.00$0.20922K
GPT-6 AstraOpenAI$10.00$50.00$1.00922K
GPT-6 LunaOpenAI$0.10$0.50$0.01922K
GPT-6 SolOpenAI$2.00$10.00$0.20922K
GPT-6.1 SolOpenAI$2.00$10.00$0.10922K
o3OpenAI$2.00$8.00$0.50200K
Grok 4.20 Non ReasoningxAI$1.25$2.50$0.201000K
Grok 4.20 ReasoningxAI$1.25$2.50$0.201000K
Grok 4.3xAI$1.25$2.50$0.201000K
Grok 4.5xAI$2.00$6.00$0.30500K
Grok 4.6xAI$2.00$6.00$0.50500K
Grok 4.7xAI$2.00$6.00$0.50500K
Grok Build 0.1xAI$1.00$2.00$0.20256K
Grok Code Fast 1xAI$1.00$2.00$0.20256K

How to read this table

Input tokens are what you send (prompt, history, documents); output tokens are what the model writes and usually cost 4–8× more. Cached input applies when a provider reuses a repeated prompt prefix, which cuts the input price sharply for chatbots and agents.