← Back to all pricing

Codestral API Pricing: Dedicated Code Intelligence & FIM Completion

Explore Mistral Codestral API pricing ($0.30/M input, $0.90/M output), Fill-in-the-Middle (FIM) code completion, 256K context, and developer ROI.

Full specs, context window and API limits →

How much does Codestral cost per million tokens?

Codestral costs $0.30 per million input tokens and $0.90 per million output tokens ($0.45/M blended at 3:1). Specialized for coding with 256K context, native FIM support, and 80+ programming languages. Verified 2026-09-08.

Verified 2026-09-08 source
Input
$0.30/M
Output
$0.90/M
Blended
$0.45/M
Provider
Verified 2026-06-14source

How much does Codestral cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; output is adjusted by this model's measured 0.79× verbosity factor.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.0656
Medium1,000500$0.6555
Long4,0002,000$2.6220

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Verbosity run: 2026-06-16T20:31:30.728Z.

Three model-specific pricing decisions

Codestral owns code-completion economics: general Mistral selection and coding-task recommendations remain elsewhere.

1. Autocomplete, fill-in-the-middle, and repository-edit bills

WorkloadPrompt / completion100K requestsShape boundary
Autocomplete300 / 80$16.20Prompt and completion both text
Fill-in-middle1,500 / 300$72.00Code context is input tokens
Repository edit8,000 / 1,200$348.00Retry rate not assumed

2. Cost-per-accepted-completion threshold versus Mistral Small

Fixed input / outputCodestralMistral Small 3.1Narrow decision boundary
Autocomplete · 300 / 80$16.20$9.3010% accepted-result uplift required
Repository edit · 8,000 / 1,200$348.00$192.0020% accepted-result uplift required

Formula: requests × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. The uplift is a planning threshold, not a measured quality claim.

Eligible coding-test coverage for this exact owner: Unavailable. Passing-run quality is not inferred from a neighboring model.

3. Developer wait-time frontier

Shape100K billTTFT / throughputRetry and mechanics
Autocomplete$16.20118 tokens/sec; TTFT 270 ms; 5 measured samplesRetry rate unavailable
Repository edit$348.00118 tokens/sec; TTFT 270 ms; 5 measured samplesCache, batch, SLA unavailable

Verified 2026-06-14. Luna is the data owner. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this Batch 5 scenario.

All three Batch 5 decisions are server-rendered for Codestral; fixed inputs, formulas, dated sources, speed sample state, and unavailable mechanics are visible.

Batch 68 · exact model pricing decision contributions · verified 2026-09-08

Exact model boundary: Mistral codestral (slug codestral). First-party provider pricing and API documentation remain fact owners.

Dedicated coding token pricing and monthly spend matrix

Frozen Batch 68 scenario board. Formula / deterministic rule: monthly_spend = devs * daily_completions * 22 * ((in * 0.30 + out * 0.90) / 1M) Boundary: Owns Codestral developer seat and IDE completion expenditure modeling.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch68-codestral-m1-r1
10-developer engineering team (5K completions/day)
model=codestral; slug=codestral; provider=Mistral; scenario=10-developer engineering team (5K completions/day); developer count; daily completions; monthly input tokens; monthly output tokens; total spend; cost per dev/mo; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 10-developer engineering team (5K completions/day) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m1-r2
50-developer product team (25K completions/day)
model=codestral; slug=codestral; provider=Mistral; scenario=50-developer product team (25K completions/day); developer count; daily completions; monthly input tokens; monthly output tokens; total spend; cost per dev/mo; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 50-developer product team (25K completions/day) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m1-r3
250-developer enterprise organization
model=codestral; slug=codestral; provider=Mistral; scenario=250-developer enterprise organization; developer count; daily completions; monthly input tokens; monthly output tokens; total spend; cost per dev/mo; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 250-developer enterprise organization is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m1-r4
batch unit test generation run
model=codestral; slug=codestral; provider=Mistral; scenario=batch unit test generation run; developer count; daily completions; monthly input tokens; monthly output tokens; total spend; cost per dev/mo; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — batch unit test generation run is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m1-r5
offline repository vulnerability scan
model=codestral; slug=codestral; provider=Mistral; scenario=offline repository vulnerability scan; developer count; daily completions; monthly input tokens; monthly output tokens; total spend; cost per dev/mo; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — offline repository vulnerability scan is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m1-r6
unresolved billing currency
model=codestral; slug=codestral; provider=Mistral; scenario=unresolved billing currency; developer count; daily completions; monthly input tokens; monthly output tokens; total spend; cost per dev/mo; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unresolved billing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Mistral AI model pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.

Fill-in-the-Middle (FIM) completion latency and accuracy gate

Frozen Batch 68 scenario board. Formula / deterministic rule: roi = developer_minutes_saved * hourly_rate - completion_cost Boundary: Owns FIM code synthesis quality and sub-200ms IDE inline completion.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch68-codestral-m2-r1
single-line function autocomplete (<150ms)
model=codestral; slug=codestral; provider=Mistral; scenario=single-line function autocomplete (<150ms); completion type; token length; latency; developer acceptance rate; productivity ROI; tool verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — single-line function autocomplete (<150ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m2-r2
multi-line algorithmic block completion
model=codestral; slug=codestral; provider=Mistral; scenario=multi-line algorithmic block completion; completion type; token length; latency; developer acceptance rate; productivity ROI; tool verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — multi-line algorithmic block completion is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m2-r3
docstring and type hint generation
model=codestral; slug=codestral; provider=Mistral; scenario=docstring and type hint generation; completion type; token length; latency; developer acceptance rate; productivity ROI; tool verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — docstring and type hint generation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m2-r4
cross-file context code refactoring
model=codestral; slug=codestral; provider=Mistral; scenario=cross-file context code refactoring; completion type; token length; latency; developer acceptance rate; productivity ROI; tool verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — cross-file context code refactoring is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m2-r5
syntax error hallucination penalty
model=codestral; slug=codestral; provider=Mistral; scenario=syntax error hallucination penalty; completion type; token length; latency; developer acceptance rate; productivity ROI; tool verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — syntax error hallucination penalty is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m2-r6
unsupported programming language
model=codestral; slug=codestral; provider=Mistral; scenario=unsupported programming language; completion type; token length; latency; developer acceptance rate; productivity ROI; tool verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unsupported programming language has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Mistral AI documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

256K repository-level context analysis and caching break-even

Frozen Batch 68 scenario board. Formula / deterministic rule: cache_cost = (tokens * 0.15) / 1M + storage_fee; un-cached = (tokens * 0.30) / 1M Boundary: Owns multi-file repository indexing and prompt cache economics.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch68-codestral-m3-r1
small library codebase (32K tokens)
model=codestral; slug=codestral; provider=Mistral; scenario=small library codebase (32K tokens); codebase size; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — small library codebase (32K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m3-r2
microservice repository (96K tokens)
model=codestral; slug=codestral; provider=Mistral; scenario=microservice repository (96K tokens); codebase size; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — microservice repository (96K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m3-r3
monorepo full context audit (256K tokens)
model=codestral; slug=codestral; provider=Mistral; scenario=monorepo full context audit (256K tokens); codebase size; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — monorepo full context audit (256K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m3-r4
multi-turn code review agent loop
model=codestral; slug=codestral; provider=Mistral; scenario=multi-turn code review agent loop; codebase size; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — multi-turn code review agent loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m3-r5
cache eviction before 5-minute TTL
model=codestral; slug=codestral; provider=Mistral; scenario=cache eviction before 5-minute TTL; codebase size; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — cache eviction before 5-minute TTL is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-codestral-m3-r6
unresolved context window overflow
model=codestral; slug=codestral; provider=Mistral; scenario=unresolved context window overflow; codebase size; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unresolved context window overflow has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Mistral AI model pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the codestral Batch 68 scenario →

How fast is Codestral?

Tokens / sec
118
TTFT
270 ms
Rank
#13 of 31
$ / M ÷ t/s
$0.0038
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Codestral cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.04
1,000,000$0.45
10,000,000$4.50
100,000,000$45.00

How does Codestral compare with other models?

Ministral 8B$0.15/MMistral Small 3.1$0.26/MMistral Large 3$0.75/MMistral Medium 3$3.00/MGPT-OSS 120B (Cerebras)$0.45/MGPT-5.4 Nano$0.46/MGemini 3.1 Flash Lite$0.56/M
See all Mistral models →

What is Codestral best for?

#7 for Structured Data Extraction#10 for Coding#10 for Writing & Content
Looking for a cheaper option?
Ministral 8B is 66.7% cheaper — a drop-in migration. See all 8 alternatives to Codestral

What are common questions about Codestral?

Is Codestral cheaper than GPT-OSS 120B (Cerebras)?

Codestral costs $0.45/M blended tokens, GPT-OSS 120B (Cerebras) costs $0.45/M — GPT-OSS 120B (Cerebras) is cheaper.

How much does 1 million tokens cost with Codestral?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $0.45. Pure input costs $0.30/M; pure output costs $0.90/M.

What does Codestral cost at high volume?

At 100 million blended tokens a month, Codestral costs approximately $45.00. See the cost-at-scale table below for other volumes.

Try Codestral for free

Run real prompts against Codestral and every other model on this page in one workspace.

Try Codestral Free