← Back to all pricing

Grok 4.6 API Pricing: Next-Gen Reasoning and Live Data Grounding

Comprehensive Grok 4.6 API pricing analysis ($2.00/M input, $6.00/M output), real-time search synthesis, 2M context window scaling, and streaming benchmarks.

Full specs, context window and API limits →

How much does Grok 4.6 cost per million tokens?

Grok 4.6 costs $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). A cutting-edge flagship model combining deep analytical reasoning with live real-time web and social knowledge synthesis. Verified 2026-09-08.

Verified 2026-09-07 source
Input
$2.00/M
Output
$6.00/M
Blended
$3.00/M
Provider
Verified 2026-08-14source

How much does Grok 4.6 cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.5000
Medium1,000500$5.0000
Long4,0002,000$20.0000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Batch 61 · exact-model pricing decision contributions · verified 2026-09-07

Exact model boundary: xAI Grok 4.6 (grok-4.6). Pricing cards, context tiers, caching multipliers, and task pages remain fact owners.

1M context scale and token cost envelope

Frozen Batch 61 scenario board. Formula / deterministic rule: request_bill = (tokens_in * 3.00 + tokens_out * 15.00) / 1M; no undocumented tiering assumed Boundary: Owns long-context cost scaling for Grok 4.6.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch61-grok-4-6-m1-r1
32K interactive prompt
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=32K interactive prompt; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 32K interactive prompt is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m1-r2
128K document review
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=128K document review; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 128K document review is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m1-r3
250K multi-file codebase
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=250K multi-file codebase; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 250K multi-file codebase is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m1-r4
500K massive document QA
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=500K massive document QA; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 500K massive document QA is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m1-r5
1M maximum context window
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=1M maximum context window; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1M maximum context window is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m1-r6
context limit overflow
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=context limit overflow; workload shape; input tokens; output tokens; calculated request cost; cost per 1K calls; status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — context limit overflow has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

64K output expansion and truncation risk planner

Frozen Batch 61 scenario board. Formula / deterministic rule: max_output_cost = 64000 * (15.00 / 1M) = $0.96; truncation avoided when request <= 64K Boundary: Owns maximum output generation economics.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch61-grok-4-6-m2-r1
standard 2K response
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=standard 2K response; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — standard 2K response is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m2-r2
8K deep code generation
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=8K deep code generation; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 8K deep code generation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m2-r3
16K long document drafting
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=16K long document drafting; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 16K long document drafting is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m2-r4
32K extensive analysis
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=32K extensive analysis; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 32K extensive analysis is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m2-r5
64K maximum generation
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=64K maximum generation; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 64K maximum generation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m2-r6
unsupported output request
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=unsupported output request; generation target; output tokens; output cost; truncation risk; buffer status; economic limit; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported output request has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: xAI Grok model specifications; verification date 2026-09-07. Missing or conflicting joins fail closed.

Enterprise coding agent multi-step budget

Frozen Batch 61 scenario board. Formula / deterministic rule: agent_spend = sum(turn_input * 3.00 + turn_output * 15.00) / 1M; retry costs modeled explicitly Boundary: Owns multi-turn agent loops with Grok 4.6.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch61-grok-4-6-m3-r1
3-step bug repair
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=3-step bug repair; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 3-step bug repair is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m3-r2
5-step feature development
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=5-step feature development; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 5-step feature development is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m3-r3
10-step full workflow loop
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=10-step full workflow loop; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10-step full workflow loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m3-r4
single tool retry turn
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=single tool retry turn; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — single tool retry turn is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch61-grok-4-6-m3-r5
multiple tool failure loop
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=multiple tool failure loop; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — multiple tool failure loop has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required
batch61-grok-4-6-m3-r6
exhausted agent budget
model=grok-4.6; provider=xAI; slug=grok-4-6; scenario=exhausted agent budget; turn count; total prompt tokens; total output tokens; cumulative cost; retry penalty; budget status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — exhausted agent budget is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: xAI Grok API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the Grok 4.6 Batch 61 scenario →

Continuous SEO Builder · Batch 73 Audit · 2026-09-08Owner: grok-4-6

Grok 4.6 API Pricing: Next-Gen Reasoning and Live Data Grounding

Grok 4.6 costs $2.00 per million input tokens and $6.00 per million output tokens ($3.00/M blended at 3:1). A cutting-edge flagship model combining deep analytical reasoning with live real-time web and social knowledge synthesis. Verified 2026-09-08.

Module 1 · Grok 4.6 Frontier Flagship Token Rate Card
Blended Cost = (Input Tokens × $2.00 + Output Tokens × $6.00) / 1,000,000

Grok 4.6 pairs elite frontier intelligence with accessible $3.00/M blended token pricing.

Boundary: Standard pay-as-you-go rate card on xAI platform; live data grounding calls priced per request.
ScenarioRendered Evidence & Bounds
Scenario 1Live financial market sentiment analysis (8K in, 1K out): $0.022000 per search pass
Scenario 2Breaking geopolitical news synthesis (16K in, 2K out): $0.044000 per dossier
Scenario 3Complex software engineering refactor (24K in, 3K out): $0.066000 per code PR
Scenario 4Scientific paper critique and validation (32K in, 4K out): $0.088000 per review pass
Scenario 5Autonomous live research loop (48K in, 5K out): $0.126000 per full cycle
Scenario 6Monthly 50M token frontier research tier: $150.00 infrastructure budget
Module 2 · Grok 4.6 2M Context Scaling & Information Retrieval ROI
Context Spend = (Large Context Input × $2.00 + Output × $6.00) / 1,000,000

A 2M context window at $2.00/M input enables exhaustive document analysis without RAG chunking loss.

Boundary: Evaluates cost scaling across deep repository analysis and massive multi-document search.
ScenarioRendered Evidence & Bounds
Scenario 1250K token corporate compliance corpus audit: $0.50000 input cost per run
Scenario 2500K token multi-year litigation archive scan: $1.00000 input cost per document set
Scenario 31M token full repository context ingestion: $2.00000 input cost per analysis pass
Scenario 42M token maximum context saturation: $4.00000 single-request ingestion price
Scenario 5Near-perfect recall across 2M tokens eliminates need for complex lossy RAG chunking
Scenario 6Massive time and compute savings by directly processing complete document corpora
Module 3 · Grok 4.6 Real-Time Live Grounding Value vs Static Models
Real-Time Intelligence Value = (Eliminated Hallucination Risk + Up-to-the-Minute Data) - API Cost

Native live data grounding eliminates external web scraping pipelines while guaranteeing current facts.

Boundary: Quantifies the business advantage of native real-time knowledge synthesis over static models.
ScenarioRendered Evidence & Bounds
Scenario 1Zero knowledge cutoff limitations on rapidly evolving financial and tech developments
Scenario 2Direct citations to primary sources and public disclosures eliminate verification delays
Scenario 3Real-time social sentiment tracking provides instant consumer perception insights
Scenario 4Eliminates maintenance costs of building and hosting complex external web scraper pipelines
Scenario 5Single API endpoint serves both deep deductive reasoning and live web research
Scenario 6Superior ROI for algorithmic trading, PR crisis response, and dynamic market intelligence
Explore Related Analyses:xAI provider profileCompare vs Grok 4.5Compare vs GPT-5.6 SolFastest AI models comparison

How fast is Grok 4.6?

Not yet measured — see the speed benchmark leaderboard for models we do track.

How much does Grok 4.6 cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.30
1,000,000$3.00
10,000,000$30.00
100,000,000$300.00

How does Grok 4.6 compare with other models?

Grok-3 Mini$0.26/MGrok 4.3$1.56/MGrok-3$2.50/MGrok-4.20 Reasoning$3.00/MGrok-4.20$3.00/MGrok-4.20 Reasoning$3.00/MGrok-4.20$3.00/MGrok 4.5$3.00/M
See all xAI models →

What is Grok 4.6 best for?

#10 for Agents & Tool Use#13 for Math & Reasoning#17 for Chatbots & Support
Looking for a cheaper option?
Gemini 3.5 Flash Lite is 71.7% cheaper — a code-change migration. See all 8 alternatives to Grok 4.6

Which Grok 4.6 head-to-head comparisons are available?

Grok 4.6 vs Claude Opus 4.8Grok 4.6 vs DeepSeek V4 ProGrok 4.6 vs Gemini 3.1 Pro

What are common questions about Grok 4.6?

Is Grok 4.6 cheaper than Grok-4.20 Reasoning?

Grok 4.6 costs $3.00/M blended tokens, Grok-4.20 Reasoning costs $3.00/M — Grok-4.20 Reasoning is cheaper.

How much does 1 million tokens cost with Grok 4.6?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $3.00. Pure input costs $2.00/M; pure output costs $6.00/M.

What does Grok 4.6 cost at high volume?

At 100 million blended tokens a month, Grok 4.6 costs approximately $300.00. See the cost-at-scale table below for other volumes.

Try Grok 4.6 for free

Run real prompts against Grok 4.6 and every other model on this page in one workspace.

Try Grok 4.6 Free