AI Models and API Pricing

Compare current pricing, availability, and compatible endpoints across multiple providers through one CostRouter API key with usage-based billing.

Available AI API Models

Showing 73 of 73 models
73Models10Providers13GroupsUSD · 1M tokens · Calculated with the selected group price multiplier
OpenAI
gpt-6-astra
Dynamic pricing
OpenAIToken-based
Input
$2/ 1M tokens$10/ 1M tokens
Output
$10/ 1M tokens$50/ 1M tokens
Cache read
$0.2/ 1M tokens$1/ 1M tokens
Cache write
$2.5/ 1M tokens$12.5/ 1M tokens
OpenAI ValuedefaultChatResponse
Claude
claude-fable-5-1
AnthropicToken-based
Input
$3/ 1M tokens$10/ 1M tokens
Output
$15/ 1M tokens$50/ 1M tokens
Cache read
$0.3/ 1M tokens$1/ 1M tokens
Cache write
$3.75/ 1M tokens$12.5/ 1M tokens
Claude ValuedefaultAnthropicChat
Claude
claude-fable-5-1-thinking
AnthropicToken-based
Input
$3/ 1M tokens$10/ 1M tokens
Output
$15/ 1M tokens$50/ 1M tokens
Cache read
$0.3/ 1M tokens$1/ 1M tokens
Cache write
$3.75/ 1M tokens$12.5/ 1M tokens
ClaudeClaude ValueAnthropicChat
Claude
claude-opus-5
AnthropicToken-based
Input
$1.5/ 1M tokens$5/ 1M tokens
Output
$7.5/ 1M tokens$25/ 1M tokens
Cache read
$0.15/ 1M tokens$0.5/ 1M tokens
Cache write
$1.875/ 1M tokens$6.25/ 1M tokens
Claude ValuedefaultAnthropicChat
Gemini
gemini-3.8-flash
GoogleToken-based
Input
$0.15/ 1M tokens$0.75/ 1M tokens
Output
$0.75/ 1M tokens$3.75/ 1M tokens
Cache read
$0.015/ 1M tokens$0.075/ 1M tokens
Gemini ValuedefaultGeminiChat
MoonshotAI
kimi-k3
MoonshotToken-based
Input
$3/ 1M tokens
Output
$15/ 1M tokens
Cache read
$0.3/ 1M tokens
KimidefaultChat
Claude
claude-opus-4-8
AnthropicToken-based
Input
$1.5/ 1M tokens$5/ 1M tokens
Output
$7.5/ 1M tokens$25/ 1M tokens
Cache read
$0.15/ 1M tokens$0.5/ 1M tokens
Cache write
$1.875/ 1M tokens$6.25/ 1M tokens
Claude ValuedefaultAnthropicChat
Gemini
gemini-3-pro-image-preview
GooglePer request
Request
$0.24/ request
defaultImageGeminiChat
Gemini
gemini-3.7-flash
GoogleToken-based
Input
$0.15/ 1M tokens$0.75/ 1M tokens
Output
$0.75/ 1M tokens$3.75/ 1M tokens
Cache read
$0.015/ 1M tokens$0.075/ 1M tokens
Gemini ValuedefaultGeminiChat
Zhipu
glm-5.3-flash
Zhipu AIToken-based
Input
$0.075/ 1M tokens
Output
$0.25/ 1M tokens
Cache read
$0.015/ 1M tokens
ZhipudefaultChat
OpenAI
gpt-5.6-sol
Dynamic pricing
OpenAIToken-based
Input
$1/ 1M tokens$5/ 1M tokens
Output
$6/ 1M tokens$30/ 1M tokens
Cache read
$0.1/ 1M tokens$0.5/ 1M tokens
Cache write
$1.25/ 1M tokens$6.25/ 1M tokens
OpenAIOpenAI ValueChatResponse
OpenAI
gpt-5.6-terra
Dynamic pricing
OpenAIToken-based
Input
$0.5/ 1M tokens$2.5/ 1M tokens
Output
$3/ 1M tokens$15/ 1M tokens
Cache read
$0.05/ 1M tokens$0.25/ 1M tokens
Cache write
$0.625/ 1M tokens$3.125/ 1M tokens
OpenAI ValuedefaultChatResponse
OpenAI
gpt-image-2.5-flare
OpenAIPer request
Request
$0.05/ request
defaultImageChat
OpenAI
gpt-image-2.5-sunburst
OpenAIPer request
Request
$0.05/ request
defaultImageChat
Claude
claude-fable-5
AnthropicToken-based
Input
$3/ 1M tokens$10/ 1M tokens
Output
$15/ 1M tokens$50/ 1M tokens
Cache read
$0.3/ 1M tokens$1/ 1M tokens
Cache write
$3.75/ 1M tokens$12.5/ 1M tokens
Claude ValuedefaultAnthropicChat
Claude
claude-fable-5-thinking
AnthropicToken-based
Input
$3/ 1M tokens$10/ 1M tokens
Output
$15/ 1M tokens$50/ 1M tokens
Cache read
$0.3/ 1M tokens$1/ 1M tokens
Cache write
$3.75/ 1M tokens$12.5/ 1M tokens
Claude ValuedefaultAnthropicChat
Claude
claude-opus-4-6
AnthropicToken-based
Input
$1.5/ 1M tokens$5/ 1M tokens
Output
$7.5/ 1M tokens$25/ 1M tokens
Cache read
$0.15/ 1M tokens$0.5/ 1M tokens
Cache write
$1.875/ 1M tokens$6.25/ 1M tokens
defaultClaudeAnthropicChat
Claude
claude-opus-4-6-thinking
AnthropicToken-based
Input
$1.5/ 1M tokens$5/ 1M tokens
Output
$7.5/ 1M tokens$25/ 1M tokens
Cache read
$0.15/ 1M tokens$0.5/ 1M tokens
Cache write
$1.875/ 1M tokens$6.25/ 1M tokens
Claude ValuedefaultAnthropicChat
Claude
claude-opus-4-7
AnthropicToken-based
Input
$1.5/ 1M tokens$5/ 1M tokens
Output
$7.5/ 1M tokens$25/ 1M tokens
Cache read
$0.15/ 1M tokens$0.5/ 1M tokens
Cache write
$1.875/ 1M tokens$6.25/ 1M tokens
defaultClaudeAnthropicChat
Claude
claude-opus-4-7-thinking
AnthropicToken-based
Input
$1.5/ 1M tokens$5/ 1M tokens
Output
$7.5/ 1M tokens$25/ 1M tokens
Cache read
$0.15/ 1M tokens$0.5/ 1M tokens
Cache write
$1.875/ 1M tokens$6.25/ 1M tokens
Claude ValuedefaultAnthropicChat
Claude
claude-opus-4-8-thinking
AnthropicToken-based
Input
$1.5/ 1M tokens$5/ 1M tokens
Output
$7.5/ 1M tokens$25/ 1M tokens
Cache read
$0.15/ 1M tokens$0.5/ 1M tokens
Cache write
$1.875/ 1M tokens$6.25/ 1M tokens
Claude ValuedefaultAnthropicChat
Claude
claude-opus-5-thinking
AnthropicToken-based
Input
$1.5/ 1M tokens$5/ 1M tokens
Output
$7.5/ 1M tokens$25/ 1M tokens
Cache read
$0.15/ 1M tokens$0.5/ 1M tokens
Cache write
$1.875/ 1M tokens$6.25/ 1M tokens
Claude ValuedefaultAnthropicChat
Claude
claude-sonnet-4-5
AnthropicToken-based
Input
$0.9/ 1M tokens$3/ 1M tokens
Output
$4.5/ 1M tokens$15/ 1M tokens
Cache read
$0.09/ 1M tokens$0.3/ 1M tokens
Cache write
$1.125/ 1M tokens$3.75/ 1M tokens
Claude ValueAnthropicChat
Claude
claude-sonnet-4-5-thinking
AnthropicToken-based
Input
$0.9/ 1M tokens$3/ 1M tokens
Output
$4.5/ 1M tokens$15/ 1M tokens
Cache read
$0.09/ 1M tokens$0.3/ 1M tokens
Cache write
$1.125/ 1M tokens$3.75/ 1M tokens
Claude ValueAnthropicChat
Claude
claude-sonnet-4-6
AnthropicToken-based
Input
$0.9/ 1M tokens$3/ 1M tokens
Output
$4.5/ 1M tokens$15/ 1M tokens
Cache read
$0.09/ 1M tokens$0.3/ 1M tokens
Cache write
$1.125/ 1M tokens$3.75/ 1M tokens
defaultClaudeAnthropicChat
Claude
claude-sonnet-4-6-thinking
AnthropicToken-based
Input
$0.9/ 1M tokens$3/ 1M tokens
Output
$4.5/ 1M tokens$15/ 1M tokens
Cache read
$0.09/ 1M tokens$0.3/ 1M tokens
Cache write
$1.125/ 1M tokens$3.75/ 1M tokens
Claude ValuedefaultAnthropicChat
DeepSeek
deepseek-v4-flash
DeepSeekToken-based
Input
$0.45/ 1M tokens
Output
$1.25/ 1M tokens
Cache read
$0.015/ 1M tokens
DeepSeekChat
DeepSeek
deepseek-v4-pro
DeepSeekToken-based
Input
$1.3/ 1M tokens
Output
$3.9/ 1M tokens
Cache read
$0.045/ 1M tokens
DeepSeekChat
Gemini
gemini-2.5-flash-image-preview
GooglePer request
Request
$0.04/ request
defaultImageGeminiChat
Gemini
gemini-2.5-flash-lite
GoogleToken-based
Input
$0.06/ 1M tokens$0.3/ 1M tokens
Output
$0.24/ 1M tokens$1.2/ 1M tokens
Cache read
$0.002/ 1M tokens$0.01/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-2.5-flash-nothinking
GoogleToken-based
Input
$0.06/ 1M tokens$0.3/ 1M tokens
Output
$0.5/ 1M tokens$2.5/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-2.5-pro
GoogleToken-based
Input
$0.25/ 1M tokens$1.25/ 1M tokens
Output
$2/ 1M tokens$10/ 1M tokens
Cache read
$0.025/ 1M tokens$0.125/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-2.5-pro-nothinking
GoogleToken-based
Input
$0.25/ 1M tokens$1.25/ 1M tokens
Output
$2/ 1M tokens$10/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-2.5-pro-thinking
GoogleToken-based
Input
$0.25/ 1M tokens$1.25/ 1M tokens
Output
$2/ 1M tokens$10/ 1M tokens
GeminiGemini ValueGeminiChat
Gemini
gemini-2.5-pro-thinking-128
GoogleToken-based
Input
$0.25/ 1M tokens$1.25/ 1M tokens
Output
$2/ 1M tokens$10/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-2.5-pro-thinking-2048
GoogleToken-based
Input
$0.25/ 1M tokens$1.25/ 1M tokens
Output
$2/ 1M tokens$10/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-2.5-pro-thinking-512
GoogleToken-based
Input
$0.25/ 1M tokens$1.25/ 1M tokens
Output
$2/ 1M tokens$10/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3-flash-preview
GoogleToken-based
Input
$0.014/ 1M tokens$0.07/ 1M tokens
Output
$0.086/ 1M tokens$0.43/ 1M tokens
Cache read
$0.0014/ 1M tokens$0.007/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3-flash-preview-thinking
GoogleToken-based
Input
$0.1/ 1M tokens$0.5/ 1M tokens
Output
$0.6/ 1M tokens$3/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3-flash-preview-thinking-high
GoogleToken-based
Input
$0.1/ 1M tokens$0.5/ 1M tokens
Output
$0.6/ 1M tokens$3/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3-flash-preview-thinking-low
GoogleToken-based
Input
$0.1/ 1M tokens$0.5/ 1M tokens
Output
$0.6/ 1M tokens$3/ 1M tokens
GeminiGemini ValueGeminiChat
Gemini
gemini-3-pro-image-preview-2k
GooglePer request
Request
$0.24/ request
defaultImageGeminiChat
Gemini
gemini-3-pro-image-preview-4k
GooglePer request
Request
$0.24/ request
defaultImageGeminiChat
Gemini
gemini-3-pro-preview
GoogleToken-based
Input
$0.114/ 1M tokens$0.57/ 1M tokens
Output
$0.686/ 1M tokens$3.43/ 1M tokens
Cache read
$0.0114/ 1M tokens$0.057/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3-pro-preview-thinking-128
GoogleToken-based
Input
$1.6/ 1M tokens$2/ 1M tokens
Output
$9.6/ 1M tokens$12/ 1M tokens
defaultGeminiGeminiChat
Gemini
gemini-3-pro-preview-thinking-high
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3-pro-preview-thinking-low
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3.1-flash-image-preview
GooglePer request
Request
$0.151/ request
defaultImageGeminiChat
Gemini
gemini-3.1-pro
Dynamic pricing
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Cache read
$0.04/ 1M tokens$0.2/ 1M tokens
Gemini ValueGeminiChat
Gemini
gemini-3.1-pro-high
Dynamic pricing
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Cache read
$0.04/ 1M tokens$0.2/ 1M tokens
Gemini ValueGeminiChat
Gemini
gemini-3.1-pro-low
Dynamic pricing
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Cache read
$0.04/ 1M tokens$0.2/ 1M tokens
Gemini ValueGeminiChat
Gemini
gemini-3.1-pro-preview
Dynamic pricing
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Cache read
$0.04/ 1M tokens$0.2/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3.1-pro-preview-high
Dynamic pricing
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Cache read
$0.04/ 1M tokens$0.2/ 1M tokens
Gemini ValueGeminiChat
Gemini
gemini-3.1-pro-preview-low
Dynamic pricing
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Cache read
$0.04/ 1M tokens$0.2/ 1M tokens
Gemini ValueGeminiChat
Gemini
gemini-3.1-pro-preview-thinking-high
Dynamic pricing
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Cache read
$0.04/ 1M tokens$0.2/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3.1-pro-preview-thinking-low
Dynamic pricing
GoogleToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$2.4/ 1M tokens$12/ 1M tokens
Cache read
$0.04/ 1M tokens$0.2/ 1M tokens
Gemini ValuedefaultGeminiChat
Gemini
gemini-3.5-flash
GoogleToken-based
Input
$0.3/ 1M tokens$1.5/ 1M tokens
Output
$1.8/ 1M tokens$9/ 1M tokens
Cache read
$0.03/ 1M tokens$0.15/ 1M tokens
GeminiGemini ValueGeminiChat
Gemini
gemini-3.6-flash
GoogleToken-based
Input
$0.3/ 1M tokens$1.5/ 1M tokens
Output
$1.5/ 1M tokens$7.5/ 1M tokens
Cache read
$0.03/ 1M tokens$0.15/ 1M tokens
Gemini ValuedefaultGeminiChat
Zhipu
glm-5.1
Zhipu AIToken-based
Input
$1.4/ 1M tokens
Output
$4.4/ 1M tokens
Cache read
$0.26/ 1M tokens
ZhipudefaultChat
Zhipu
glm-5.2
Zhipu AIToken-based
Input
$1.4/ 1M tokens
Output
$4.4/ 1M tokens
Cache read
$0.26/ 1M tokens
defaultZhipuChat
Zhipu
glm-5.3
Zhipu AIToken-based
Input
$1.4/ 1M tokens
Output
$4.4/ 1M tokens
Cache read
$0.26/ 1M tokens
ZhipudefaultChat
OpenAI
gpt-5.4
OpenAIToken-based
Input
$0.5/ 1M tokens$2.5/ 1M tokens
Output
$3/ 1M tokens$15/ 1M tokens
Cache read
$0.05/ 1M tokens$0.25/ 1M tokens
defaultOpenAIChatResponse
OpenAI
gpt-5.4-mini
OpenAIToken-based
Input
$0.15/ 1M tokens$0.75/ 1M tokens
Output
$0.9/ 1M tokens$4.5/ 1M tokens
Cache read
$0.015/ 1M tokens$0.075/ 1M tokens
defaultOpenAIChatResponse
OpenAI
gpt-5.5
OpenAIToken-based
Input
$1/ 1M tokens$5/ 1M tokens
Output
$6/ 1M tokens$30/ 1M tokens
Cache read
$0.1/ 1M tokens$0.5/ 1M tokens
defaultOpenAIChatResponse
OpenAI
gpt-5.6-luna
Dynamic pricing
OpenAIToken-based
Input
$0.2/ 1M tokens$1/ 1M tokens
Output
$1.2/ 1M tokens$6/ 1M tokens
Cache read
$0.02/ 1M tokens$0.1/ 1M tokens
Cache write
$0.25/ 1M tokens$1.25/ 1M tokens
defaultOpenAIChatResponse
OpenAI
gpt-image-2
OpenAIPer request
Request
$0.05/ request
defaultImageChat
OpenAI
gpt-image-2-pro
OpenAIPer request
Request
$0.11/ request
defaultImageChat
OpenAI
gpt-image-2-vip
OpenAIPer request
Request
$0.11/ request
defaultImageChat
Grok
grok-4.5
xAIToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$1.2/ 1M tokens$6/ 1M tokens
Cache read
$0.1/ 1M tokens$0.5/ 1M tokens
GrokdefaultChatResponse
Grok
grok-4.6
xAIToken-based
Input
$0.4/ 1M tokens$2/ 1M tokens
Output
$1.2/ 1M tokens$6/ 1M tokens
Cache read
$0.1/ 1M tokens$0.5/ 1M tokens
GrokdefaultChatResponse
Qwen
qwen-max
AlibabaToken-based
Input
$1.6/ 1M tokens
Output
$6.4/ 1M tokens
Cache read
$0.35/ 1M tokens
Cache write
$2/ 1M tokens
QwendefaultChat
Qwen
qwen-plus
AlibabaToken-based
Input
$0.4/ 1M tokens
Output
$1.5/ 1M tokens
Cache read
$0.08/ 1M tokens
Cache write
$0.5/ 1M tokens
QwendefaultChat
Qwen
qwen3.8-max
AlibabaToken-based
Input
$2/ 1M tokens
Output
$6/ 1M tokens
Cache read
$0.25/ 1M tokens
Cache write
$2.5/ 1M tokens
QwendefaultChat
How to read CostRouter pricing

Prices are shown in USD and use the lowest available price multiplier in the selected routing and pricing group. Token models show input and output prices per 1M tokens; per-request models bill per call; dynamic pricing varies with request parameters such as image size, audio duration, cache usage, or pricing tier.

Group price multiplier
Selecting a group shows its available routes and applies its price multiplier to displayed prices.
Model ID
Copy the exact model ID into your SDK or HTTP request body; CostRouter routes the request through one API Key.
Billing type
Compare token-based, per-request, and dynamic pricing before sending production requests.

GPT and Claude API FAQ

Can I access GPT and Claude APIs with one API key?

Yes. One CostRouter API key can access the available GPT, Claude, and other AI models listed in this catalog. Select the required model ID and a compatible endpoint for each request.

How is GPT API and Claude API pricing displayed?

Token-based models show input and output prices per million tokens. Request-based models show a price per request. The final charge depends on the selected model and billing group.

Which API endpoint should I use?

Use one of the compatible endpoints listed for the selected model. The integration documentation provides the CostRouter Base URL and request formats for supported SDKs.

API model index

A concise reference for flagship GPT and Claude model families available through CostRouter. Use the live catalog above to verify model IDs, endpoint compatibility, route availability, and current pricing.

OpenAIgpt-5.5

GPT-5.5 API

Before integration, verify the available GPT-5.5 route, compatible endpoint, and token billing terms in the live catalog above.

OpenAIgpt-5.6

GPT-5.6 API

Confirm the production model ID, supported request format, and current billing details before routing GPT-5.6 traffic.

Anthropicclaude-opus-4-8

Claude Opus 4.8 API

For Anthropic-compatible integrations, verify route availability, endpoint support, and current token pricing in the catalog above.

Anthropicclaude-fable-5

Claude Fable 5 API

Confirm the model ID, compatible endpoint, and current availability before sending Claude Fable 5 production requests.

Contact us

Choose the channel that best matches your request.

Contact us
AI API Models & Pricing: GPT, Claude, Gemini and More | CostRouter