Grok 4.6 API Pricing: Next-Gen Reasoning and Live Data Grounding
Comprehensive Grok 4.6 API pricing analysis ($2.00/M input, $6.00/M output), real-time search synthesis, 2M context window scaling, and streaming benchmarks.
Full specs, context window and API limits →How much does Grok 4.6 cost per million tokens?
Grok 4.6 costs $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). A cutting-edge flagship model combining deep analytical reasoning with live real-time web and social knowledge synthesis. Verified 2026-09-08.
How much does Grok 4.6 cost per 1,000 requests?
Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.
| Request shape | Input tokens | Output tokens | Cost / 1,000 requests |
|---|---|---|---|
| Short | 100 | 50 | $0.5000 |
| Medium | 1,000 | 500 | $5.0000 |
| Long | 4,000 | 2,000 | $20.0000 |
Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.
Batch 61 · exact-model pricing decision contributions · verified 2026-09-07
Exact model boundary: xAI Grok 4.6 (grok-4.6). Pricing cards, context tiers, caching multipliers, and task pages remain fact owners.
1M context scale and token cost envelope
Frozen Batch 61 scenario board. Formula / deterministic rule: request_bill = (tokens_in * 3.00 + tokens_out * 15.00) / 1M; no undocumented tiering assumed Boundary: Owns long-context cost scaling for Grok 4.6.
| Frozen scenario / field ID | Exact identity and evidence fields | Result | State |
|---|---|---|---|
batch61-grok-4-6-m1-r132K interactive prompt | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=32K interactive prompt; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 32K interactive prompt is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m1-r2128K document review | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=128K document review; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 128K document review is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m1-r3250K multi-file codebase | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=250K multi-file codebase; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 250K multi-file codebase is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m1-r4500K massive document QA | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=500K massive document QA; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 500K massive document QA is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m1-r51M maximum context window | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=1M maximum context window; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 1M maximum context window is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m1-r6context limit overflow | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=context limit overflow; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — context limit overflow has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
First-party provenance: xAI Grok API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.
64K output expansion and truncation risk planner
Frozen Batch 61 scenario board. Formula / deterministic rule: max_output_cost = 64000 * (15.00 / 1M) = $0.96; truncation avoided when request <= 64K Boundary: Owns maximum output generation economics.
| Frozen scenario / field ID | Exact identity and evidence fields | Result | State |
|---|---|---|---|
batch61-grok-4-6-m2-r1standard 2K response | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=standard 2K response; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — standard 2K response is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m2-r28K deep code generation | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=8K deep code generation; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 8K deep code generation is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m2-r316K long document drafting | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=16K long document drafting; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 16K long document drafting is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m2-r432K extensive analysis | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=32K extensive analysis; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 32K extensive analysis is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m2-r564K maximum generation | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=64K maximum generation; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 64K maximum generation is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m2-r6unsupported output request | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=unsupported output request; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — unsupported output request has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
First-party provenance: xAI Grok model specifications; verification date 2026-09-07. Missing or conflicting joins fail closed.
Enterprise coding agent multi-step budget
Frozen Batch 61 scenario board. Formula / deterministic rule: agent_spend = sum(turn_input * 3.00 + turn_output * 15.00) / 1M; retry costs modeled explicitly Boundary: Owns multi-turn agent loops with Grok 4.6.
| Frozen scenario / field ID | Exact identity and evidence fields | Result | State |
|---|---|---|---|
batch61-grok-4-6-m3-r13-step bug repair | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=3-step bug repair; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 3-step bug repair is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m3-r25-step feature development | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=5-step feature development; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 5-step feature development is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m3-r310-step full workflow loop | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=10-step full workflow loop; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 10-step full workflow loop is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m3-r4single tool retry turn | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=single tool retry turn; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — single tool retry turn is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch61-grok-4-6-m3-r5multiple tool failure loop | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=multiple tool failure loop; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — multiple tool failure loop has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
batch61-grok-4-6-m3-r6exhausted agent budget | model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=exhausted agent budget; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — exhausted agent budget is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
First-party provenance: xAI Grok API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.
Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the Grok 4.6 Batch 61 scenario →
grok-4-6Grok 4.6 API Pricing: Next-Gen Reasoning and Live Data Grounding
Grok 4.6 costs $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). A cutting-edge flagship model combining deep analytical reasoning with live real-time web and social knowledge synthesis. Verified 2026-09-08.
Grok 4.6 pairs elite frontier intelligence with accessible $3.00/M blended token pricing.
| Scenario | Rendered Evidence & Bounds |
|---|---|
| Scenario 1 | Live financial market sentiment analysis (8K in, 1K out): $0.022000 per search pass |
| Scenario 2 | Breaking geopolitical news synthesis (16K in, 2K out): $0.044000 per dossier |
| Scenario 3 | Complex software engineering refactor (24K in, 3K out): $0.066000 per code PR |
| Scenario 4 | Scientific paper critique and validation (32K in, 4K out): $0.088000 per review pass |
| Scenario 5 | Autonomous live research loop (48K in, 5K out): $0.126000 per full cycle |
| Scenario 6 | Monthly 50M token frontier research tier: $150.00 infrastructure budget |
A 2M context window at $2.00/M input enables exhaustive document analysis without RAG chunking loss.
| Scenario | Rendered Evidence & Bounds |
|---|---|
| Scenario 1 | 250K token corporate compliance corpus audit: $0.50000 input cost per run |
| Scenario 2 | 500K token multi-year litigation archive scan: $1.00000 input cost per document set |
| Scenario 3 | 1M token full repository context ingestion: $2.00000 input cost per analysis pass |
| Scenario 4 | 2M token maximum context saturation: $4.00000 single-request ingestion price |
| Scenario 5 | Near-perfect recall across 2M tokens eliminates need for complex lossy RAG chunking |
| Scenario 6 | Massive time and compute savings by directly processing complete document corpora |
Native live data grounding eliminates external web scraping pipelines while guaranteeing current facts.
| Scenario | Rendered Evidence & Bounds |
|---|---|
| Scenario 1 | Zero knowledge cutoff limitations on rapidly evolving financial and tech developments |
| Scenario 2 | Direct citations to primary sources and public disclosures eliminate verification delays |
| Scenario 3 | Real-time social sentiment tracking provides instant consumer perception insights |
| Scenario 4 | Eliminates maintenance costs of building and hosting complex external web scraper pipelines |
| Scenario 5 | Single API endpoint serves both deep deductive reasoning and live web research |
| Scenario 6 | Superior ROI for algorithmic trading, PR crisis response, and dynamic market intelligence |
How fast is Grok 4.6?
How much does Grok 4.6 cost at scale?
| Tokens / month | Est. cost (blended 3:1) |
|---|---|
| 100,000 | $0.30 |
| 1,000,000 | $3.00 |
| 10,000,000 | $30.00 |
| 100,000,000 | $300.00 |
How does Grok 4.6 compare with other models?
What is Grok 4.6 best for?
What should you explore next for Grok 4.6?
Which Grok 4.6 head-to-head comparisons are available?
What are common questions about Grok 4.6?
Is Grok 4.6 cheaper than Grok-4.20 Reasoning?
Grok 4.6 costs $3.00/M blended tokens, Grok-4.20 Reasoning costs $3.00/M — Grok-4.20 Reasoning is cheaper.
How much does 1 million tokens cost with Grok 4.6?
At a 3:1 input:output ratio, 1 million blended tokens costs approximately $3.00. Pure input costs $2.00/M; pure output costs $6.00/M.
What does Grok 4.6 cost at high volume?
At 100 million blended tokens a month, Grok 4.6 costs approximately $300.00. See the cost-at-scale table below for other volumes.
