Skip to content
S/T

Model prices

Every price the analyser uses, in one table. USD per million tokens, first-party API, default routing. Transcribed by hand from published pricing pages and last verified 2026-08-10.

Cache-write columns are what a provider charges to place content in the prompt cache; cache-read is what it charges to reuse it. Where a provider publishes no write surcharge, writes are billed at the base input rate.

Anthropic

ModelInputOutputCache readCache writeContext
Claude Opus 5$5$25$0.50$6.251,000k
Claude Sonnet 5$2$10$0.20$2.501,000k
Claude Fable 5$10$50$1$12.501,000k
Claude Opus 4.8$5$25$0.50$6.251,000k
Claude Opus 4.7$5$25$0.50$6.251,000k
Claude Opus 4.6$5$25$0.50$6.251,000k
Claude Opus 4.5$5$25$0.50$6.25200k
Claude Sonnet 4.6$3$15$0.30$3.751,000k
Claude Sonnet 4.5$3$15$0.30$3.75200k
Claude Haiku 4.5$1$5$0.10$1.25200k
Claude Opus 4.1superseded$15$75$1.50$18.75200k
Claude Haiku 3.5superseded$0.80$4$0.080$1200k

OpenAI

ModelInputOutputCache readCache writeContext
GPT-5.6 Sol$5$30$0.50$6.251,050k
GPT-5.6 Terra$2$12$0.20$2.501,050k
GPT-5.6 Luna$0.20$1.20$0.020$0.251,050k
GPT-5.5$5$30$0.50
GPT-5.5 Pro$30$180
GPT-5.4$2.50$15$0.25
GPT-5.4 mini$0.75$4.50$0.075
GPT-5.4 nano$0.20$1.25$0.020
GPT-5.2$1.75$14$0.17
GPT-5.1$1.25$10$0.13
GPT-5$1.25$10$0.13
GPT-5 mini$0.25$2$0.025
GPT-5 nano$0.050$0.40$0.005
GPT-4.1superseded$2$8$0.501,047.576k
GPT-4.1 minisuperseded$0.40$1.60$0.101,047.576k
GPT-4osuperseded$2.50$10$1.25128k
GPT-4o minisuperseded$0.15$0.60$0.075128k

Google

ModelInputOutputCache readCache writeContext
Gemini 3.6 Flash$1.50$7.50$0.15
Gemini 3.5 Flash$1.50$9$0.15
Gemini 3.5 Flash-Lite$0.30$2.50$0.030
Gemini 3.1 Pro Preview$2$12$0.20
Gemini 3.1 Flash-Lite$0.25$1.50$0.025
Gemini 3 Flash Preview$0.50$3$0.050
Gemini 2.5 Prosuperseded$1.25$10$0.131,048.576k
Gemini 2.5 Flashsuperseded$0.30$2.50$0.0301,048.576k
Gemini 2.5 Flash-Litesuperseded$0.10$0.40$0.0101,048.576k

Two models can look the same price and cost you differently

Models count tokens differently. Claude models from Opus 4.7 onward produce roughly 30% more tokens for identical text than earlier ones, so two models at the same headline rate can differ meaningfully on the same prompt. To compare what you will actually pay, price your own prompt.

Compare on your prompt