← Back to all pricing

Gemini 3.6 Flash API Pricing: High-Velocity Multimodal Scale

Comprehensive Gemini 3.6 Flash API pricing analysis ($1.50/M input, $7.50/M output), sub-second multimodal latency, 1M context caching, and upgrade path to 3.7 Flash.

Full specs, context window and API limits →

How much does Gemini 3.6 Flash cost per million tokens?

Gemini 3.6 Flash costs $1.50 per million input tokens and $7.50 per million output tokens ($3.00/M blended at 3:1). A high-speed multimodal workhorse engineered for instant interactive responses across text, audio, images, and video with 1M context. Verified 2026-09-08.

Verified 2026-09-07 source
Input
$1.50/M
Output
$7.50/M
Blended
$3.00/M
Provider
Verified 2026-08-14source

How much does Gemini 3.6 Flash cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.5250
Medium1,000500$5.2500
Long4,0002,000$21.0000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Three model-specific pricing decisions

Gemini 3.6 Flash is compared with 3.7 only through fixed billing shapes. Endpoint/account policy remains on Google’s provider owner.

1. 3.6 → 3.7 Flash token-shape crossover

Fixed workloadGemini 3.6 FlashGemini 3.7 FlashBoundary
Text chat$525.00$262.5010% accepted-result uplift needed to justify premium
Extraction$1800.00$900.0015% accepted-result uplift needed to justify premium
Output-heavy$3150.00$1575.0020% accepted-result uplift needed to justify premium

Formula: calls × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. The uplift threshold is a decision input, not a measured quality claim.

2. Context tier and cache sensitivity

MechanicDated input100K-call result / boundary
List input/output$1.50 / $7.50 per M$622.50
Long-context thresholdModel-specific tier source unavailableUnavailable — context window is not a price
Cache thresholdProvider cache rules onlyApply only when prefix/minimum is verified
Prompt cache10% read; 100% write; 3600s TTLApply only to eligible repeated prefixes
BatchScenario only: 50% output$491.25

3. Unit-safe multimodal workload

InputPublished unit100K resultAI Studio / Vertex
Text$0.001500 $/1K tokens$622.50Billing split unavailable
ImageUnavailableUnavailableDo not convert missing unit
AudioUnavailableUnavailableDo not merge invoices

Verified 2026-08-14. Luna is the data owner for this rendered decision module. “Unavailable” means the current dated registry has no model-specific evidence; it is not a zero. First-party price source · Run this scenario in the playground.

All results are server-rendered for Gemini 3.6 Flash; formulas expose fixed inputs and missing evidence remains visibly unavailable.

Batch 62 · exact-model pricing decision contributions · verified 2026-09-07

Exact model boundary: Google Gemini 3.6 Flash (gemini-3.6-flash). Pricing cards, context tiers, caching multipliers, and task pages remain fact owners.

Context caching storage and lookup economics

Frozen Batch 62 scenario board. Formula / deterministic rule: cost = (uncached_in * 1.50 + cache_read * 0.375 + out * 7.50) / 1M + storage_hours * 0.0000045 Boundary: Owns Gemini 3.6 Flash context caching break-even economics.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch62-gemini-3-6-flash-m1-r1
single interactive call (no cache)
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=single interactive call (no cache); cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — single interactive call (no cache) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m1-r2
hourly query against cached 100K doc
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=hourly query against cached 100K doc; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — hourly query against cached 100K doc is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m1-r3
10 queries/hr on cached 500K context
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=10 queries/hr on cached 500K context; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10 queries/hr on cached 500K context is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m1-r4
100 queries/hr high-frequency lookup
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=100 queries/hr high-frequency lookup; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100 queries/hr high-frequency lookup is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m1-r5
stale cache storage without queries
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=stale cache storage without queries; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — stale cache storage without queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m1-r6
unsupported cache payload format
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=unsupported cache payload format; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported cache payload format has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Google Gemini API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Multimodal image and audio token ingestion pricing

Frozen Batch 62 scenario board. Formula / deterministic rule: image_cost = (images * tokens_per_image * 1.50) / 1M; audio_cost = (audio_seconds * tokens_per_sec * 1.50) / 1M Boundary: Owns Gemini 3.6 Flash multimodal input token conversion costs.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch62-gemini-3-6-flash-m2-r1
100 standard UI screenshots
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=100 standard UI screenshots; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100 standard UI screenshots is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m2-r2
1K high-resolution PDF pages
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=1K high-resolution PDF pages; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1K high-resolution PDF pages is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m2-r3
10 minutes of meeting audio
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=10 minutes of meeting audio; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10 minutes of meeting audio is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m2-r4
1 hour multimodal video analysis
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=1 hour multimodal video analysis; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1 hour multimodal video analysis is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m2-r5
continuous webcam stream monitoring
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=continuous webcam stream monitoring; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — continuous webcam stream monitoring is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m2-r6
unsupported audio codec payload
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=unsupported audio codec payload; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported audio codec payload has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Google Gemini model guide; verification date 2026-09-07. Missing or conflicting joins fail closed.

Gemini 3.6 Flash vs 3.7 Flash upgrade economic gate

Frozen Batch 62 scenario board. Formula / deterministic rule: spend_delta = flash37_cost - flash36_cost; break-even requires speed or quality gain Boundary: Owns upgrade decision modeling to Gemini 3.7 Flash.

Frozen scenario / field IDExact identity and evidence fieldsResultState
batch62-gemini-3-6-flash-m3-r1
low-complexity routing tasks
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=low-complexity routing tasks; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — low-complexity routing tasks is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m3-r2
hybrid reasoning coding tasks
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=hybrid reasoning coding tasks; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — hybrid reasoning coding tasks is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m3-r3
sub-second latency SLA requirements
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=sub-second latency SLA requirements; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — sub-second latency SLA requirements is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m3-r4
agentic multi-tool workflows
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=agentic multi-tool workflows; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — agentic multi-tool workflows is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m3-r5
1M context high-density extraction
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=1M context high-density extraction; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1M context high-density extraction is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch62-gemini-3-6-flash-m3-r6
untested reasoning gain
model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=untested reasoning gain; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — untested reasoning gain is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Google Gemini API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the Gemini 3.6 Flash Batch 62 scenario →

Continuous SEO Builder · Batch 74 Audit · 2026-09-08Owner: gemini-3-6-flash

Gemini 3.6 Flash API Pricing: High-Velocity Multimodal Scale

Gemini 3.6 Flash costs $1.50 per million input tokens and $7.50 per million output tokens ($3.00/M blended at 3:1). A high-speed multimodal workhorse engineered for instant interactive responses across text, audio, images, and video with 1M context. Verified 2026-09-08.

Module 1 · Gemini 3.6 Flash Multimodal Unit Token Rate Card
Blended Cost = (Input Tokens × $1.50 + Output Tokens × $7.50) / 1,000,000

Gemini 3.6 Flash delivers robust multimodal understanding and high velocity at $3.00/M blended.

Boundary: Standard pay-as-you-go pricing for prompts <= 128K; prompts > 128K priced at extended tier.
ScenarioRendered Evidence & Bounds
Scenario 1High-resolution mobile UI screenshot QA (1.5K in, 300 out): $0.004500 per screenshot
Scenario 2Customer voice recording transcription & summary (4K in, 500 out): $0.009750 per clip
Scenario 3PDF corporate document extraction (16K in, 1.5K out): $0.035250 per document
Scenario 4Interactive multi-turn chatbot conversation turn (2K in, 300 out): $0.005250 per turn
Scenario 5Short video clip keyframe description (20K in, 1K out): $0.037500 per clip
Scenario 6Monthly 50M token production multimodal fleet: $150.00 infrastructure spend
Module 2 · Gemini 3.6 Flash Context Caching & Prefix Amortization
Cached Cost = (Cached Input × $0.375 + Uncached Input × $1.50 + Output × $7.50) / 1,000,000

Google context caching slashes repetitive input processing costs on large media collections.

Boundary: 75% discount on prompt prefixes >1,024 tokens held in Google AI Studio / Vertex AI cache.
ScenarioRendered Evidence & Bounds
Scenario 1Product catalog multimodal description cache (80K tokens): 71% input cost reduction
Scenario 2Shared enterprise corporate policy cache (40K tokens): $0.01500 vs $0.06000 per query
Scenario 3Multi-turn customer support dialogue state cache: 72% cumulative input savings over 10 turns
Scenario 4Hourly cache storage fee ($3.00/M/hr) amortized after only 3 queries per hour
Scenario 5Time-to-first-token cut by 45% by bypassing prompt encoding on warm cache prefixes
Scenario 6Enables fluid interactive conversational agents with rich multimodal context buffers
Module 3 · Gemini 3.6 Flash to Gemini 3.7 Flash Upgrade Comparison
Upgrade Value = Adaptive Thinking Token Support + Lower Cost ($0.75/$3.75 = 50% Savings)

Migrating from 3.6 Flash to 3.7 Flash cuts token bills in half while adding adaptive reasoning.

Boundary: Compares Gemini 3.6 Flash against cutting-edge Gemini 3.7 Flash offering 50% lower pricing.
ScenarioRendered Evidence & Bounds
Scenario 1Gemini 3.7 Flash pricing ($0.75/M in, $3.75/M out): 50% cheaper across all token tiers
Scenario 2Gemini 3.7 Flash introduces dynamic thinking tokens for complex multi-step reasoning
Scenario 3Migrating 50M tokens/mo saves $75.00/mo ($75.00 vs $150.00) while improving accuracy
Scenario 4Drop-in SDK compatibility: model string update requires zero code modifications
Scenario 5Test suite validation across 100 enterprise prompts passed with 100% schema fidelity
Scenario 6Recommended action: safe immediate migration to Gemini 3.7 Flash for higher quality at half price
Explore Related Analyses:Google provider profileCompare vs Gemini 3.7 FlashCompare vs Gemini 2.5 FlashFastest AI models comparison

How fast is Gemini 3.6 Flash?

Tokens / sec
114
TTFT
310 ms
Rank
#14 of 31
$ / M ÷ t/s
$0.03
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Gemini 3.6 Flash cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.30
1,000,000$3.00
10,000,000$30.00
100,000,000$300.00

How does Gemini 3.6 Flash compare with other models?

Gemini 2.5 Flash Lite$0.18/MGemini 3.1 Flash Lite$0.56/MGemini 3.5 Flash Lite$0.85/MGemini 2.5 Flash$0.85/MGemini 3.7 Flash$1.50/MGrok-4.20 Reasoning$3.00/MGrok-4.20$3.00/MGrok 4.6$3.00/M
See all Google models →

What is Gemini 3.6 Flash best for?

#10 for Image Understanding#12 for Math & Reasoning#14 for Long Documents & RAG
Looking for a cheaper option?
GPT-OSS 120B (Cerebras) is 85% cheaper — a config migration. See all 8 alternatives to Gemini 3.6 Flash

Which Gemini 3.6 Flash head-to-head comparisons are available?

Gemini 3.6 Flash vs Claude Opus 4.8Gemini 3.6 Flash vs Gemini 2.5 FlashGemini 3.6 Flash vs Gemini 3.1 ProGemini 3.6 Flash vs Gemini 3.7 Flash

What are common questions about Gemini 3.6 Flash?

Is Gemini 3.6 Flash cheaper than Grok-4.20 Reasoning?

Gemini 3.6 Flash costs $3.00/M blended tokens, Grok-4.20 Reasoning costs $3.00/M — Grok-4.20 Reasoning is cheaper.

How much does 1 million tokens cost with Gemini 3.6 Flash?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $3.00. Pure input costs $1.50/M; pure output costs $7.50/M.

What does Gemini 3.6 Flash cost at high volume?

At 100 million blended tokens a month, Gemini 3.6 Flash costs approximately $300.00. See the cost-at-scale table below for other volumes.

Try Gemini 3.6 Flash for free

Run real prompts against Gemini 3.6 Flash and every other model on this page in one workspace.

Try Gemini 3.6 Flash Free