← Back to all pricing

Claude Haiku 4.5 API Pricing: Near-Instant Execution with Frontier Precision

Comprehensive Claude Haiku 4.5 API pricing analysis ($1.00/M input, $5.00/M output), prompt caching efficiencies, sub-100ms first-token latency, and coding speed.

Full specs, context window and API limits →

How much does Claude Haiku 4.5 cost per million tokens?

Claude Haiku 4.5 costs $1.00 per million input tokens and $5.00 per million output tokens ($2.00/M blended at 3:1). Anthropic fastest model delivering near-instant response times, strong coding proficiency, and lightweight reasoning for high-volume apps. Verified 2026-09-08.

Verified 2026-09-07 source
Input
$1.00/M
Output
$5.00/M
Blended
$2.00/M
Provider
Verified 2026-04-06source

How much does Claude Haiku 4.5 cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.3500
Medium1,000500$3.5000
Long4,0002,000$14.0000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Three model-specific pricing decisions

Haiku 4.5 is evaluated for high-volume text workflows. Vision rows remain unit-safe: the registry’s text rate is not converted into an image price.

1. Classification, chat, and vision-shaped monthly bills

WorkloadFixed shape100K requestsUnit treatment
Classification300 / 30 tokens$45.00Text tokens
Chat1,000 / 500 tokens$350.00Text tokens
Vision-shaped1,000 text + image$350.00Image price unavailable; text proxy is not an image bill

2. Haiku → Sonnet 4.6 accepted-result and retry crossover

Fixed workload (input / output)Claude Haiku 4.5Claude Sonnet 4.6Decision boundary
Short prompt · 1,000 / 500$350.00$1050.0010% accepted-result uplift required to justify the higher bill
Long prompt · 8,000 / 800$1200.00$3600.0015% accepted-result uplift required to justify the higher bill

Formula: 100,000 × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. Uplift is a decision threshold, not a measured quality claim.

3. Cache-write/read and batch reuse break-even

MechanicDated rate evidenceBreak-even / result
Cache writeProvider/model-specific multiplier unavailableUnavailable — do not assume a discount
Cache readProvider/model-specific multiplier unavailableUnavailable — do not assume free input
BatchModel-specific batch rate unavailableUnavailable — turnaround and discount not inferred
TTLModel-specific TTL unavailableReuse horizon is user-supplied

Verified 2026-04-06. Luna is the data owner for this server-rendered module. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this exact scenario.

All three decisions are server-rendered for Claude Haiku 4.5; fixed inputs, formulas, dated sources, and unavailable states are intentionally visible.

Batch 62 · exact-model pricing decision contributions · verified 2026-09-07

Exact model boundary: Anthropic Claude Haiku 4.5 (claude-haiku-4-5). Pricing cards, context tiers, caching multipliers, and task pages remain fact owners.

Prompt caching read/write economics on fast agents

Frozen Batch 62 scenario board. Formula / deterministic rule: cost = (uncached_in * 1.00 + cache_write * 1.25 + cache_read * 0.10 + out * 5.00) / 1M Boundary: Owns Haiku 4.5 prompt caching savings and latency benefits.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch62-claude-haiku-4-5-m1-r1
interactive uncached query
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=interactive uncached query; interactive turns; prompt tokens; cached tokens; output tokens; net cost; effective token rate; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — interactive uncached query is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m1-r2
3-step rapid classification flow
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=3-step rapid classification flow; interactive turns; prompt tokens; cached tokens; output tokens; net cost; effective token rate; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 3-step rapid classification flow is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m1-r3
10-step lightweight agent loop
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=10-step lightweight agent loop; interactive turns; prompt tokens; cached tokens; output tokens; net cost; effective token rate; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10-step lightweight agent loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m1-r4
50-step high-frequency chat stream
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=50-step high-frequency chat stream; interactive turns; prompt tokens; cached tokens; output tokens; net cost; effective token rate; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50-step high-frequency chat stream is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m1-r5
cache invalidation on cold restart
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=cache invalidation on cold restart; interactive turns; prompt tokens; cached tokens; output tokens; net cost; effective token rate; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — cache invalidation on cold restart is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m1-r6
unregistered cache breakpoint
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=unregistered cache breakpoint; interactive turns; prompt tokens; cached tokens; output tokens; net cost; effective token rate; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unregistered cache breakpoint is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Anthropic official API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

High-throughput real-time classification and filtering

Frozen Batch 62 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 1.00 + out_tokens * 5.00) / 1M) Boundary: Owns high-volume classification and sentiment analysis budgeting for Haiku 4.5.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch62-claude-haiku-4-5-m2-r1
100K customer message classifications
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=100K customer message classifications; query volume; prompt tokens; completion tokens; monthly spend; cost per 10K queries; SLA status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100K customer message classifications is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m2-r2
500K real-time moderation events
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=500K real-time moderation events; query volume; prompt tokens; completion tokens; monthly spend; cost per 10K queries; SLA status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 500K real-time moderation events is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m2-r3
1M streaming chat response queries
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=1M streaming chat response queries; query volume; prompt tokens; completion tokens; monthly spend; cost per 10K queries; SLA status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1M streaming chat response queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m2-r4
5M webhook automated triage records
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=5M webhook automated triage records; query volume; prompt tokens; completion tokens; monthly spend; cost per 10K queries; SLA status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 5M webhook automated triage records is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m2-r5
rate limit quota exhaustion buffer
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=rate limit quota exhaustion buffer; query volume; prompt tokens; completion tokens; monthly spend; cost per 10K queries; SLA status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — rate limit quota exhaustion buffer has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required
batch62-claude-haiku-4-5-m2-r6
unhandled classification schema error
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=unhandled classification schema error; query volume; prompt tokens; completion tokens; monthly spend; cost per 10K queries; SLA status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unhandled classification schema error is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Anthropic Claude documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Haiku 4.5 vs Sonnet 4.6 tier escalation economics

Frozen Batch 62 scenario board. Formula / deterministic rule: router_cost = haiku_pct * haiku_cost + sonnet_pct * sonnet_cost Boundary: Owns tiered model escalation routing between Haiku 4.5 and Sonnet 4.6.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch62-claude-haiku-4-5-m3-r1
100% Haiku 4.5 baseline
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=100% Haiku 4.5 baseline; escalation mix; monthly requests; blended spend; savings vs pure Sonnet; quality trade-off; router verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100% Haiku 4.5 baseline is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m3-r2
90% Haiku / 10% Sonnet 4.6 escalation
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=90% Haiku / 10% Sonnet 4.6 escalation; escalation mix; monthly requests; blended spend; savings vs pure Sonnet; quality trade-off; router verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 90% Haiku / 10% Sonnet 4.6 escalation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m3-r3
75% Haiku / 25% Sonnet 4.6 escalation
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=75% Haiku / 25% Sonnet 4.6 escalation; escalation mix; monthly requests; blended spend; savings vs pure Sonnet; quality trade-off; router verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 75% Haiku / 25% Sonnet 4.6 escalation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m3-r4
50% Haiku / 50% Sonnet 4.6 escalation
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=50% Haiku / 50% Sonnet 4.6 escalation; escalation mix; monthly requests; blended spend; savings vs pure Sonnet; quality trade-off; router verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50% Haiku / 50% Sonnet 4.6 escalation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m3-r5
100% Sonnet 4.6 comparison
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=100% Sonnet 4.6 comparison; escalation mix; monthly requests; blended spend; savings vs pure Sonnet; quality trade-off; router verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100% Sonnet 4.6 comparison is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-claude-haiku-4-5-m3-r6
unresolved classifier confidence score
model=claude-haiku-4-5; provider=Anthropic; slug=claude-haiku-4-5; scenario=unresolved classifier confidence score; escalation mix; monthly requests; blended spend; savings vs pure Sonnet; quality trade-off; router verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unresolved classifier confidence score has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Anthropic official API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the Claude Haiku 4.5 Batch 62 scenario →

Continuous SEO Builder · Batch 74 Audit · 2026-09-08Owner: claude-haiku-4-5

Claude Haiku 4.5 API Pricing: Near-Instant Execution with Frontier Precision

Claude Haiku 4.5 costs $1.00 per million input tokens and $5.00 per million output tokens ($2.00/M blended at 3:1). Anthropic fastest model delivering near-instant response times, strong coding proficiency, and lightweight reasoning for high-volume apps. Verified 2026-09-08.

Module 1 · Claude Haiku 4.5 Production Unit Token Rate Card
Blended Cost = (Input Tokens × $1.00 + Output Tokens × $5.00) / 1,000,000

Claude Haiku 4.5 combines blazing inference speed with an accessible $2.00/M blended price.

Boundary: Standard pay-as-you-go rate card; prompt caching and batch discounts apply.
ScenarioRendered Evidence & Bounds
Scenario 1Rapid syntax error diagnostic check (1K in, 200 out): $0.002000 per diagnostic run
Scenario 2Customer support chat triage turn (1.5K in, 300 out): $0.003000 per dialogue turn
Scenario 3Code snippet autocomplete expansion (800 in, 150 out): $0.001550 per keystroke call
Scenario 4Structured JSON classification turn (2K in, 250 out): $0.003250 per classified item
Scenario 5Pull request commit message generator (4K in, 200 out): $0.005000 per commit review
Scenario 6Monthly 50M token high-speed production fleet: $100.00 infrastructure budget
Module 2 · Claude Haiku 4.5 Prompt Caching & 90% Cost Amortization
Cached Cost = (Cached Input × $0.10 + Uncached Input × $1.00 + Output × $5.00) / 1,000,000

Automatic prompt caching further compresses input costs for latency-critical customer agents.

Boundary: 90% discount on prompt prefixes >1,024 tokens held in Anthropic 5-minute rolling cache.
ScenarioRendered Evidence & Bounds
Scenario 1Shared application system prompt cache (8K tokens): 80% input cost reduction
Scenario 2Interactive IDE developer session (10 turns cached): 81% cumulative input savings
Scenario 3Customer chat history cache across 8 turns: 78% net input cost reduction
Scenario 4Cache write fee ($1.25/M) amortized after only 1.25 repeat queries within 5 minutes
Scenario 5Near-zero cache retrieval latency: slashes TTFT by 50% for fluid conversational apps
Scenario 6Net operational cost drops below $1.20/M blended for high-frequency interactive tools
Module 3 · Claude Haiku 4.5 Two-Tier Routing with Sonnet 5
Fleet Optimization = (0.85 × Haiku 4.5 Spend) + (0.15 × Sonnet 5 Spend)

Tiered routing between Haiku 4.5 and Sonnet 5 delivers 42.5% cost savings and 65% faster speed.

Boundary: Evaluates savings from routing 85% routine coding queries to Haiku and escalating 15% to Sonnet 5.
ScenarioRendered Evidence & Bounds
Scenario 11M developer queries routed via tiered architecture: $2,300.00 vs $4,000.00 monolithic Sonnet 5
Scenario 2Haiku 4.5 handles 85% routine syntax fixes, documentation lookups, and unit tests
Scenario 3Sonnet 5 ($2.00/$10.00) reserved for complex multi-file architectural refactors
Scenario 4Developer perceived response speed improves by 65% due to Haiku sub-second generation
Scenario 5Net engineering infrastructure spend reduced by 42.5% across the organization
Scenario 6Uniform Anthropic API schemas allow seamless handoff between model tiers
Explore Related Analyses:Anthropic provider profileCompare vs Claude Sonnet 4.6Compare vs GPT-5.4 NanoFastest AI models comparison

How fast is Claude Haiku 4.5?

Tokens / sec
148
TTFT
260 ms
Rank
#9 of 31
$ / M ÷ t/s
$0.01
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Claude Haiku 4.5 cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.20
1,000,000$2.00
10,000,000$20.00
100,000,000$200.00

How does Claude Haiku 4.5 compare with other models?

Claude Sonnet 5$4.00/MClaude Sonnet 4.6$6.00/MClaude Sonnet 4.5$6.00/MClaude Sonnet 4$6.00/MClaude Opus 4.8$10.00/MMuse Spark 1.3$2.00/MDeepSeek V4 Pro$1.98/Mo3-Mini$1.93/M
See all Anthropic models →

What is Claude Haiku 4.5 best for?

#31 for Image Understanding#35 for Translation#37 for Structured Data Extraction
Looking for a cheaper option?
Ministral 8B is 92.5% cheaper — a config migration. See all 8 alternatives to Claude Haiku 4.5

Which Claude Haiku 4.5 head-to-head comparisons are available?

Claude Haiku 4.5 vs DeepSeek V4 ProClaude Haiku 4.5 vs Gemini 3.1 ProClaude Haiku 4.5 vs Grok 4.3Claude Haiku 4.5 vs Claude Sonnet 4.6

What are common questions about Claude Haiku 4.5?

Is Claude Haiku 4.5 cheaper than Muse Spark 1.3?

Claude Haiku 4.5 costs $2.00/M blended tokens, Muse Spark 1.3 costs $2.00/M — Muse Spark 1.3 is cheaper.

How much does 1 million tokens cost with Claude Haiku 4.5?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $2.00. Pure input costs $1.00/M; pure output costs $5.00/M.

What does Claude Haiku 4.5 cost at high volume?

At 100 million blended tokens a month, Claude Haiku 4.5 costs approximately $200.00. See the cost-at-scale table below for other volumes.

Try Claude Haiku 4.5 for free

Run real prompts against Claude Haiku 4.5 and every other model on this page in one workspace.

Try Claude Haiku 4.5 Free