← Back to all pricing

Grok 4.20 Non-Reasoning API Pricing: High-Throughput 2M Execution

Explore xAI Grok 4.20 Non-Reasoning API pricing ($2.00/M input, $6.00/M output), fast streaming throughput, 2M context scale, and live search integration.

Full specs, context window and API limits →

How much does Grok-4.20 cost per million tokens?

xAI Grok 4.20 Non-Reasoning charges $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). Provides high generation speed without reasoning token overhead. Verified 2026-09-08.

Verified 2026-09-07 source
Input
$2.00/M
Output
$6.00/M
Blended
$3.00/M
Provider
Verified 2026-04-06source

How much does Grok-4.20 cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.5000
Medium1,000500$5.0000
Long4,0002,000$20.0000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Three model-specific pricing decisions

This page owns the fast non-reasoning workload surface. The paired reasoning route owns hidden/output expansion; equal listed rates do not erase that different output assumption.

1. Chat, document, and multimodal-shaped bills

WorkloadInput / output assumptionNon-reasoning / 100KPaired reasoning / 100K
Chat1,000 / 300$380.00$560.00
Document8,000 / 800$2080.00$2560.00
Multimodal-shaped4,000 text / 500 output$1100.00Image unit unavailable; output expansion proxy only

2. Latency/retry-adjusted cost per accepted response

ShapeBase / 100KSpeed evidenceAccepted-response cost
Chat$380.00104 tokens/secRetry rate unavailable — no adjusted result
Document$2080.00104 tokens/secUnavailable — use base ÷ (1 − retry rate)

3. Mechanics evidence matrix

DimensionSourced valueSafe boundary
ContextUnavailableDo not infer a tier
Image unitUnavailableDo not convert text tokens
Cache / batchUnavailableNot free by default
Rate limitUnavailableProvider policy remains elsewhere

Verified 2026-04-06. Luna is the data owner for this server-rendered module. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this exact scenario.

All three decisions are server-rendered for Grok-4.20; fixed inputs, formulas, dated sources, and unavailable states are intentionally visible.

Batch 67 · exact model pricing decision contributions · verified 2026-09-07

Exact model boundary: xAI grok-4.20-0309-non-reasoning (slug grok-4-20-0309-non-reasoning). First-party provider pricing and API documentation remain fact owners.

Token pricing and high-throughput workload monthly spend board

Frozen Batch 67 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 2.00 + out_tokens * 6.00) / 1M) Boundary: Owns base token tariff comparisons and workload expenditure modeling.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-grok-4-20-0309-non-reasoning-m1-r1
20K interactive customer queries
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=20K interactive customer queries; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 20K interactive customer queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m1-r2
50K automated text generations
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=50K automated text generations; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50K automated text generations is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m1-r3
100K data classification passes
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=100K data classification passes; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100K data classification passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m1-r4
prompt caching active (75% read discount)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=prompt caching active (75% read discount); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — prompt caching active (75% read discount) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m1-r5
batch processing active (50% both)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=batch processing active (50% both); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — batch processing active (50% both) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m1-r6
unresolved pricing currency
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=unresolved pricing currency; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unresolved pricing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok developer pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Turnaround time latency and interactive UX SLA audit

Frozen Batch 67 scenario board. Formula / deterministic rule: turnaround = ttft + (tokens_out / tps); optimized for immediate response streaming Boundary: Owns turnaround time benchmarks and user experience responsiveness.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-grok-4-20-0309-non-reasoning-m2-r1
real-time conversational streaming (<150ms)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=real-time conversational streaming (<150ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — real-time conversational streaming (<150ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m2-r2
customer support intent routing (<300ms)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=customer support intent routing (<300ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — customer support intent routing (<300ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m2-r3
automated article drafting
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=automated article drafting; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — automated article drafting is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m2-r4
batch document parsing queue
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=batch document parsing queue; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — batch document parsing queue is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m2-r5
concurrency contention latency spike
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=concurrency contention latency spike; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — concurrency contention latency spike is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m2-r6
unmeasured speed fixture
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=unmeasured speed fixture; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unmeasured speed fixture is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: xAI Grok documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Context window saturation (2M scale) capability gate

Frozen Batch 67 scenario board. Formula / deterministic rule: eligible = (context <= 2M ? Eligible : Excluded); massive context ingestion Boundary: Owns context scaling and capability gating for large inputs.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-grok-4-20-0309-non-reasoning-m3-r1
short text query (5K tokens)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=short text query (5K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — short text query (5K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m3-r2
large legal contract (100K tokens)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=large legal contract (100K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — large legal contract (100K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m3-r3
monolithic application codebase (500K tokens)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=monolithic application codebase (500K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — monolithic application codebase (500K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m3-r4
full system archive (1.5M tokens)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=full system archive (1.5M tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — full system archive (1.5M tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m3-r5
2M full context saturation test
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=2M full context saturation test; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 2M full context saturation test is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-grok-4-20-0309-non-reasoning-m3-r6
unsupported media payload format
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=unsupported media payload format; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported media payload format has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the grok-4-20-0309-non-reasoning Batch 67 scenario →

Batch 75 Verified Model Pricing IntelligenceModel owner: grok-4-20-0309-non-reasoning (xAI)Audit date: 2026-09-08

Grok 4.20 Non-Reasoning API Pricing: High-Throughput 2M Execution

xAI Grok 4.20 Non-Reasoning charges $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). Provides high generation speed without reasoning token overhead. Verified 2026-09-08.

Token pricing and high-throughput workload monthly spend board

Frozen Batch 75 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 2.00 + out_tokens * 6.00) / 1M) Boundary: Owns base token tariff comparisons and workload expenditure modeling.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-grok-4-20-0309-non-reasoning-m1-r1
20K interactive customer queries
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=20K interactive customer queries; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 20K interactive customer queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m1-r2
50K automated text generations
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=50K automated text generations; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 50K automated text generations is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m1-r3
100K data classification passes
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=100K data classification passes; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 100K data classification passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m1-r4
prompt caching active (75% read discount)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=prompt caching active (75% read discount); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — prompt caching active (75% read discount) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m1-r5
batch processing active (50% both)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=batch processing active (50% both); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — batch processing active (50% both) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m1-r6
unresolved pricing currency
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=unresolved pricing currency; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unresolved pricing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok developer pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.

Turnaround time latency and interactive UX SLA audit

Frozen Batch 75 scenario board. Formula / deterministic rule: turnaround = ttft + (tokens_out / tps); optimized for immediate response streaming Boundary: Owns turnaround time benchmarks and user experience responsiveness.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-grok-4-20-0309-non-reasoning-m2-r1
real-time conversational streaming (<150ms)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=real-time conversational streaming (<150ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — real-time conversational streaming (<150ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m2-r2
customer support intent routing (<300ms)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=customer support intent routing (<300ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — customer support intent routing (<300ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m2-r3
automated article drafting
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=automated article drafting; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — automated article drafting is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m2-r4
batch document parsing queue
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=batch document parsing queue; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — batch document parsing queue is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m2-r5
concurrency contention latency spike
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=concurrency contention latency spike; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — concurrency contention latency spike is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m2-r6
unmeasured speed fixture
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=unmeasured speed fixture; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unmeasured speed fixture is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: xAI Grok documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

Context window saturation (2M scale) capability gate

Frozen Batch 75 scenario board. Formula / deterministic rule: eligible = (context <= 2M ? Eligible : Excluded); massive context ingestion Boundary: Owns context scaling and capability gating for large inputs.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-grok-4-20-0309-non-reasoning-m3-r1
short text query (5K tokens)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=short text query (5K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — short text query (5K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m3-r2
large legal contract (100K tokens)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=large legal contract (100K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — large legal contract (100K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m3-r3
monolithic application codebase (500K tokens)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=monolithic application codebase (500K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — monolithic application codebase (500K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m3-r4
full system archive (1.5M tokens)
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=full system archive (1.5M tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — full system archive (1.5M tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m3-r5
2M full context saturation test
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=2M full context saturation test; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 2M full context saturation test is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-grok-4-20-0309-non-reasoning-m3-r6
unsupported media payload format
model=grok-4.20-0309-non-reasoning; slug=grok-4-20-0309-non-reasoning; provider=xAI; scenario=unsupported media payload format; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unsupported media payload format has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

How fast is Grok-4.20?

Tokens / sec
104
TTFT
290 ms
Rank
#16 of 31
$ / M ÷ t/s
$0.03
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Grok-4.20 cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.30
1,000,000$3.00
10,000,000$30.00
100,000,000$300.00

How does Grok-4.20 compare with other models?

Grok-3 Mini$0.26/MGrok 4.3$1.56/MGrok-3$2.50/MGrok-4.20 Reasoning$3.00/MGrok 4.6$3.00/MGrok-4.20 Reasoning$3.00/MGrok 4.6$3.00/MGrok 4.5$3.00/M
See all xAI models →

What is Grok-4.20 best for?

#11 for Image Understanding#15 for Long Documents & RAG#16 for Summarization
Looking for a cheaper option?
Ministral 8B is 95% cheaper — a config migration. See all 8 alternatives to Grok-4.20

What are common questions about Grok-4.20?

Is Grok-4.20 cheaper than Grok-4.20 Reasoning?

Grok-4.20 costs $3.00/M blended tokens, Grok-4.20 Reasoning costs $3.00/M — Grok-4.20 Reasoning is cheaper.

How much does 1 million tokens cost with Grok-4.20?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $3.00. Pure input costs $2.00/M; pure output costs $6.00/M.

What does Grok-4.20 cost at high volume?

At 100 million blended tokens a month, Grok-4.20 costs approximately $300.00. See the cost-at-scale table below for other volumes.

Try Grok-4.20 for free

Run real prompts against Grok-4.20 and every other model on this page in one workspace.

Try Grok-4.20 Free