API pricing

Databricks Pricing

Databricks charges between — and $30.00 per 1 million output tokens, depending on the model. Databricks Mpt 7B Instruct is the cheapest at —/1M output and $0.500/1M input; GPT-5.6 Sol is the most expensive at $30.00/1M output. The largest context window is 1.1M tokens (GPT-5.4). Prices are USD, current as of July 20, 2026.

Last updated · synced weekly from the upstream model catalog

Cheapest input

$0.050/1M

Databricks GPT 5 Nano

Cheapest output

—/1M

Databricks Mpt 7B Instruct

Longest context

1.1M

GPT-5.4

Models priced

55

Avg $12.26/1M output

Pricing by model

All prices in USD per 1 million tokens. All 55 priced models, cheapest first.

ModelInput / 1MOutput / 1MContext
Databricks Mpt 7B Instruct$0.5008K
GPT OSS 20B
ReasoningTools
$0.050$0.200131K
GPT OSS 120B
ReasoningTools
$0.072$0.280131K
Databricks GPT Oss 20B$0.070$0.300131K
Databricks GPT 5 Nano$0.050$0.400272K
GPT-5 Nano
VisionReasoningToolsCache
$0.050$0.400400K
Databricks Meta Llama 3.1 8B Instruct$0.150$0.450200K
Databricks Gemma 3 12B$0.150$0.500128K
Databricks GPT Oss 120B$0.150$0.600131K
Databricks Mixtral 8X7B Instruct$0.500$1.004K
Databricks Mpt 30B Instruct$1.00$1.008K
GPT-5.4 nano
VisionReasoningToolsCache
$0.200$1.25400K
Gemini 3.1 Flash Lite Preview
VisionReasoningToolsCache
$0.250$1.501.0M
Databricks Llama 2 70B Chat$0.500$1.504K
Databricks Llama 4 Maverick$0.500$1.50128K
Databricks Meta Llama 3.3 70B Instruct$0.500$1.50128K
Databricks GPT 5 Mini$0.250$2.00272K
GPT-5 Mini
VisionReasoningToolsCache
$0.250$2.00400K
Databricks Gemini 2.5 Flash$0.300$2.501.0M
Gemini 2.5 Flash
VisionReasoningToolsCache
$0.300$2.501.0M
Databricks Meta Llama 3 70B Instruct$1.00$3.00128K
Gemini 3 Flash Preview
VisionReasoningToolsCache
$0.500$3.001.0M
Kimi K2.7 Code
VisionReasoningToolsCache
$0.950$4.00262K
GLM-5.2
ReasoningToolsCache
$1.40$4.401.0M
GPT-5.4 mini
VisionReasoningToolsCache
$0.750$4.50400K
Claude Haiku 4.5
VisionReasoningToolsCache
$1.00$5.00200K
Databricks Claude Haiku 4.5$1.00$5.00200K
GPT-5.6 Luna
VisionReasoningToolsCache
$1.00$6.00400K
Databricks Gemini 2.5 Pro$1.25$10.001.0M
Databricks GPT 5$1.25$10.00272K
Databricks GPT 5.1$1.25$10.00272K
Gemini 2.5 Pro
VisionReasoningToolsCache
$1.25$10.001.0M
GPT-5
VisionReasoningToolsCache
$1.25$10.00400K
GPT-5.1
VisionReasoningToolsCache
$1.25$10.00400K
Gemini 3 Pro Preview
VisionReasoningToolsCache
$2.00$12.001.0M
Gemini 3.1 Pro Preview Custom Tools
VisionReasoningToolsCache
$2.00$12.001.0M
GPT-5.2
VisionReasoningToolsCache
$1.75$14.00400K
Claude Sonnet 4.5
VisionReasoningToolsCache
$3.00$15.00200K
Claude Sonnet 4.6
VisionReasoningToolsCache
$3.00$15.001.0M
GPT-5.4
VisionReasoningToolsCache
$2.50$15.001.1M
GPT-5.6 Terra
VisionReasoningToolsCache
$2.50$15.001.1M
Databricks Claude 3.7 Sonnet$3.00$15.00200K
Databricks Claude Sonnet 4$3.00$15.00200K
Databricks Claude Sonnet 4.1$3.00$15.00200K
Databricks Claude Sonnet 4.5$3.00$15.00200K
Databricks Meta Llama 3.1 405B Instruct$5.00$15.00128K
Claude Opus 4.5
VisionReasoningToolsCache
$5.00$25.00200K
Claude Opus 4.6
VisionReasoningToolsCache
$5.00$25.001.0M
Claude Opus 4.7
VisionReasoningToolsCache
$5.00$25.001.0M
Databricks Claude Opus 4.5$5.00$25.00200K
GPT-5.5
VisionReasoningToolsCache
$5.00$30.001.1M
GPT-5.6 Sol
VisionReasoningToolsCache
$5.00$30.001.1M
Claude Opus 4.1
VisionReasoningToolsCache
$15.00$75.00200K
Databricks Claude Opus 4$15.00$75.00200K
Databricks Claude Opus 4.1$15.00$75.00200K

Frequently asked questions

How much does Databricks cost per 1M tokens?

Databricks pricing ranges from — to $30.00 per 1 million output tokens across 55 models. Input tokens are cheaper than output on every model. Rates current as of July 20, 2026.

What is the cheapest Databricks model?

Databricks Mpt 7B Instruct is the cheapest Databricks model on output tokens at — per 1M, while Databricks GPT 5 Nano is cheapest on input at $0.050 per 1M. Which wins for you depends on your input-to-output ratio.

What is the largest Databricks context window?

GPT-5.4 has the largest context window in the Databricks catalog at 1.1M input tokens, with up to 128K output tokens per response.

Does Databricks support prompt caching?

Yes. GPT-5 Nano reads cached input at $0.0050 per 1M tokens, against $0.050 per 1M uncached. Caching pays off when a long system prompt or document is reused across many requests.

Which Databricks models support reasoning or vision?

The Databricks catalog includes 29 reasoning models, 26 vision models, 29 with tool calling. Reasoning models bill their internal thinking as output tokens, so they cost more per visible response than the headline rate suggests.

How do I calculate my actual Databricks bill?

Multiply your input tokens by the input rate and your output tokens by the output rate, both per million, then add retries and any conversation history resent on each turn. Calcaas does this against your real usage pattern and shows the margin left at your price point.

Other providers

What will this actually cost you?

Per-token rates only tell you half the story. Calcaas multiplies them by your real usage — prompt size, response length, retries and conversation history — then shows the margin left at your price point.

Open the free cost calculator