← Back to all pricing

xAI Grok 4.3 API Pricing: Real-Time Intelligence & Streaming Speed

Examine xAI Grok 4.3 API pricing ($1.25/M input, $2.50/M output), 1M context token costs, real-time X search integration, and high-speed streaming.

Full specs, context window and API limits →

How much does Grok 4.3 cost per million tokens?

xAI Grok 4.3 charges $1.25 per million input tokens and $2.50 per million output tokens ($1.5625/M blended at 3:1). Features 1M context window, high-speed streaming, and live X real-time grounding. Verified 2026-09-08.

Verified 2026-09-08 source
Input
$1.25/M
Output
$2.50/M
Blended
$1.56/M
Provider
Verified 2026-05-19source

How much does Grok 4.3 cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; output is adjusted by this model's measured 1.41× verbosity factor.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.3012
Medium1,000500$3.0125
Long4,0002,000$12.0500

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Verbosity run: 2026-06-16T20:31:30.728Z.

Three model-specific pricing decisions

Grok 4.3 owns its lower-rate exact-model bill. The 4.20 reasoning route is a calculation input only, and its output expansion is visible rather than hidden.

1. Chat, long-document, and agent monthly bills

WorkloadFixed input / output100K requestsUnit note
Chat1,000 / 300$200.00Text tokens
Long document32,000 / 2,000$4500.00Text tokens
Agent8,000 / 1,200$1300.00Retry rate not assumed

2. Required uplift for Grok 4.20 Reasoning

Fixed input / outputGrok 4.3Grok-4.20 ReasoningNarrow decision boundary
Coding reasoning · 4,000 / 1,000$750.00$1400.0015% accepted-result uplift required
Long agent · 16,000 / 2,000$2500.00$4400.0020% accepted-result uplift required

Formula: requests × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. The uplift is a planning threshold, not a measured quality claim.

3. Price / latency / retry frontier and evidence matrix

DimensionDated evidenceSafe treatment
Price$1.25 input / $2.50 output per MSourced registry rate
Latency98 tokens/sec; TTFT 320 ms; 5 measured samplesMeasured/estimated state stays visible
RetryUnavailableAdjusted cost = base ÷ (1 − retry rate)
Context / cache / batch / rate limits / SLAUnavailableNo zero or free default

Verified 2026-05-19. Luna is the data owner. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this Batch 5 scenario.

All three Batch 5 decisions are server-rendered for Grok 4.3; fixed inputs, formulas, dated sources, speed sample state, and unavailable mechanics are visible.

Batch 68 · exact model pricing decision contributions · verified 2026-09-08

Exact model boundary: xAI grok-4.3 (slug grok-4-3). First-party provider pricing and API documentation remain fact owners.

Frontier speed token pricing and monthly spend matrix

Frozen Batch 68 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 1.25 + out_tokens * 2.50) / 1M) Boundary: Owns Grok 4.3 standard generation token tariffs and monthly volume modeling.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch68-grok-4-3-m1-r1
25K real-time breaking news queries
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=25K real-time breaking news queries; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 25K real-time breaking news queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m1-r2
100K customer interaction sessions
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=100K customer interaction sessions; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 100K customer interaction sessions is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m1-r3
500K automated live-data monitoring passes
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=500K automated live-data monitoring passes; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 500K automated live-data monitoring passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m1-r4
prompt caching reuse (50% input discount)
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=prompt caching reuse (50% input discount); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — prompt caching reuse (50% input discount) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m1-r5
batch processing API queue
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=batch processing API queue; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — batch processing API queue is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m1-r6
unresolved billing currency
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=unresolved billing currency; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unresolved billing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok developer pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.

Live X search retrieval grounding and latency audit

Frozen Batch 68 scenario board. Formula / deterministic rule: total_latency = search_fetch_time + ttft + (tokens_out / tps) Boundary: Owns live data search integration economics and retrieval overhead.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch68-grok-4-3-m2-r1
real-time social trend analysis
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=real-time social trend analysis; query type; live search units; grounding latency; output tokens; retrieval accuracy; grounding verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — real-time social trend analysis is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m2-r2
financial market breaking event query
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=financial market breaking event query; query type; live search units; grounding latency; output tokens; retrieval accuracy; grounding verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — financial market breaking event query is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m2-r3
historical public sentiment research
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=historical public sentiment research; query type; live search units; grounding latency; output tokens; retrieval accuracy; grounding verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — historical public sentiment research is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m2-r4
high-concurrency live monitoring loop
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=high-concurrency live monitoring loop; query type; live search units; grounding latency; output tokens; retrieval accuracy; grounding verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — high-concurrency live monitoring loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m2-r5
rate-limited search provider fallback
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=rate-limited search provider fallback; query type; live search units; grounding latency; output tokens; retrieval accuracy; grounding verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — rate-limited search provider fallback is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m2-r6
unsupported query syntax
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=unsupported query syntax; query type; live search units; grounding latency; output tokens; retrieval accuracy; grounding verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unsupported query syntax has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

Context window scaling and 1M token cache break-even

Frozen Batch 68 scenario board. Formula / deterministic rule: cache_cost = (tokens * 0.625) / 1M + storage_fee; un-cached = (tokens * 1.25) / 1M Boundary: Owns long-context economics and prompt cache amortization for Grok 4.3.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch68-grok-4-3-m3-r1
128K document context pass
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=128K document context pass; context depth; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 128K document context pass is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m3-r2
500K codebase exploration session
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=500K codebase exploration session; context depth; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 500K codebase exploration session is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m3-r3
1M maximum context window analysis
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=1M maximum context window analysis; context depth; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 1M maximum context window analysis is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m3-r4
multi-turn live monitoring workspace
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=multi-turn live monitoring workspace; context depth; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — multi-turn live monitoring workspace is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m3-r5
cache eviction before 5-minute TTL
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=cache eviction before 5-minute TTL; context depth; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — cache eviction before 5-minute TTL is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch68-grok-4-3-m3-r6
unresolved cache storage retention
model=grok-4.3; slug=grok-4-3; provider=xAI; scenario=unresolved cache storage retention; context depth; base input cost; cached input cost; minimum reuse break-even; caching recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unresolved cache storage retention has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok developer pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the grok-4-3 Batch 68 scenario →

How fast is Grok 4.3?

Tokens / sec
98
TTFT
320 ms
Rank
#17 of 31
$ / M ÷ t/s
$0.02
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Grok 4.3 cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.16
1,000,000$1.56
10,000,000$15.63
100,000,000$156.25

How does Grok 4.3 compare with other models?

Grok-3 Mini$0.26/MGrok-3$2.50/MGrok-4.20 Reasoning$3.00/MGrok-4.20$3.00/MGrok 4.6$3.00/MGemini 3.7 Flash$1.50/MGPT-5.4 Mini$1.69/MGemini 3.1 Flash$1.69/M
See all xAI models →

What is Grok 4.3 best for?

#7 for Image Understanding#8 for Math & Reasoning#12 for Long Documents & RAG
Looking for a cheaper option?
Muse Spark 1.3 Contributor is 92% cheaper — a config migration. See all 8 alternatives to Grok 4.3

Which Grok 4.3 head-to-head comparisons are available?

Grok 4.3 vs Grok-3Grok 4.3 vs Claude Opus 4.8Grok 4.3 vs Claude Sonnet 5Grok 4.3 vs DeepSeek V4 Pro

What are common questions about Grok 4.3?

Is Grok 4.3 cheaper than Gemini 3.7 Flash?

Grok 4.3 costs $1.56/M blended tokens, Gemini 3.7 Flash costs $1.50/M — Gemini 3.7 Flash is cheaper.

How much does 1 million tokens cost with Grok 4.3?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $1.56. Pure input costs $1.25/M; pure output costs $2.50/M.

What does Grok 4.3 cost at high volume?

At 100 million blended tokens a month, Grok 4.3 costs approximately $156.25. See the cost-at-scale table below for other volumes.

Try Grok 4.3 for free

Run real prompts against Grok 4.3 and every other model on this page in one workspace.

Try Grok 4.3 Free