← Back to all pricing

Amazon Nova Micro API Pricing: Industry-Lowest Cloud Token Economics

Comprehensive Amazon Nova Micro API pricing analysis ($0.035/M input, $0.14/M output), AWS Bedrock serverless speed, sub-100ms classification, and batch extraction ROI.

Full specs, context window and API limits →

How much does Amazon Nova Micro cost per million tokens?

Amazon Nova Micro costs $0.035 per million input tokens and $0.14 per million output tokens ($0.06125/M blended at 3:1). The most economical text model available on AWS Bedrock, engineered for ultra-fast classification, routing, and high-volume data normalization. Verified 2026-09-08.

Verified 2026-09-07 source
Input
$0.03/M
Output
$0.14/M
Blended
$0.06/M
Provider
Verified 2026-06-14source

How much does Amazon Nova Micro cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; output is adjusted by this model's measured 0.76× verbosity factor.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.0088
Medium1,000500$0.0882
Long4,0002,000$0.3528

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Verbosity run: 2026-06-16T20:31:30.728Z.

Three model-specific pricing decisions

Nova Micro owns text-only Bedrock economics. Vision-shaped work is ineligible for this unit-safe bill, not priced at zero.

1. Classification, routing, and short-generation ladder

WorkloadInput / output100K1M10M
Classification300 / 30$1.47$14.70$147.00
Routing500 / 80$2.87$28.70$287.00
Short generation1,000 / 500$10.50$105.00$1050.00

2. Micro-to-Lite accepted-result threshold

Fixed input / outputAmazon Nova MicroAmazon Nova LiteNarrow decision boundary
Text classification · 300 / 30$1.47$2.5210% accepted-result uplift required
Text generation · 1,000 / 500$10.50$18.0015% accepted-result uplift required

Formula: requests × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. The uplift is a planning threshold, not a measured quality claim.

Vision-shaped work: Ineligible — image units are not compatible with this text-only comparison and are not assigned a zero price.

3. Price / speed / AWS deployment matrix

DimensionDated evidenceSafe boundary
Price2026-06-14 · $0.03 / $0.14 per MOn-demand listed text units
Speed168 tokens/sec; TTFT 220 ms; 5 measured samplesMeasured/estimated state is visible
Region / quota / batch / cache / provisioned throughput / IAMUnavailableDo not infer a rate or adoption cost

Verified 2026-06-14. Luna is the data owner. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this Batch 5 scenario.

All three Batch 5 decisions are server-rendered for Amazon Nova Micro; fixed inputs, formulas, dated sources, speed sample state, and unavailable mechanics are visible.

Batch 67 · exact model pricing decision contributions · verified 2026-09-07

Exact model boundary: Amazon nova-micro (slug nova-micro). First-party provider pricing and API documentation remain fact owners.

Ultra-budget token pricing and high-volume spend matrix

Frozen Batch 67 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 0.03 + out_tokens * 0.14) / 1M) Boundary: Owns Nova Micro unit token economics and high-volume classification spend.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-nova-micro-m1-r1
100K intent routing classifications
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=100K intent routing classifications; workload; prompt tokens; completion tokens; standard spend; batch spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100K intent routing classifications is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m1-r2
500K customer inquiry triage calls
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=500K customer inquiry triage calls; workload; prompt tokens; completion tokens; standard spend; batch spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 500K customer inquiry triage calls is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m1-r3
2M high-volume automated filter events
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=2M high-volume automated filter events; workload; prompt tokens; completion tokens; standard spend; batch spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 2M high-volume automated filter events is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m1-r4
batch API queue (50% discount)
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=batch API queue (50% discount); workload; prompt tokens; completion tokens; standard spend; batch spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — batch API queue (50% discount) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m1-r5
provisioned throughput commitment
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=provisioned throughput commitment; workload; prompt tokens; completion tokens; standard spend; batch spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — provisioned throughput commitment is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m1-r6
unresolved billing currency
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=unresolved billing currency; workload; prompt tokens; completion tokens; standard spend; batch spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unresolved billing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: AWS Bedrock Nova pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Sub-second latency SLA and intent routing turnaround audit

Frozen Batch 67 scenario board. Formula / deterministic rule: turnaround = ttft + (tokens_out / tps); Nova Micro optimized for lowest latency Boundary: Owns turnaround time benchmarks and user experience responsiveness.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-nova-micro-m2-r1
real-time intent classification (<100ms)
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=real-time intent classification (<100ms); task; response SLA; TTFT; turnaround time; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — real-time intent classification (<100ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m2-r2
customer support routing ticket (<200ms)
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=customer support routing ticket (<200ms); task; response SLA; TTFT; turnaround time; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — customer support routing ticket (<200ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m2-r3
keyword extraction pass (<300ms)
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=keyword extraction pass (<300ms); task; response SLA; TTFT; turnaround time; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — keyword extraction pass (<300ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m2-r4
high-concurrency request surge
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=high-concurrency request surge; task; response SLA; TTFT; turnaround time; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — high-concurrency request surge is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m2-r5
network contention latency buffer
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=network contention latency buffer; task; response SLA; TTFT; turnaround time; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — network contention latency buffer is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m2-r6
unmeasured speed fixture
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=unmeasured speed fixture; task; response SLA; TTFT; turnaround time; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unmeasured speed fixture is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Amazon Nova documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Two-tier escalation architecture and routing cost savings

Frozen Batch 67 scenario board. Formula / deterministic rule: blended_cost = micro_volume * micro_cost + escalated_volume * escalated_cost Boundary: Owns two-tier architectural routing between ultra-budget triage and complex reasoning.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-nova-micro-m3-r1
100% Nova Micro baseline ($0.03/$0.14)
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=100% Nova Micro baseline ($0.03/$0.14); escalation mix; total monthly queries; blended spend; cost savings vs pure Pro; accuracy retention; routing recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100% Nova Micro baseline ($0.03/$0.14) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m3-r2
90% Micro triage / 10% Nova Lite escalation
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=90% Micro triage / 10% Nova Lite escalation; escalation mix; total monthly queries; blended spend; cost savings vs pure Pro; accuracy retention; routing recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 90% Micro triage / 10% Nova Lite escalation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m3-r3
80% Micro triage / 20% Nova Pro escalation
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=80% Micro triage / 20% Nova Pro escalation; escalation mix; total monthly queries; blended spend; cost savings vs pure Pro; accuracy retention; routing recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 80% Micro triage / 20% Nova Pro escalation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m3-r4
50% Micro triage / 50% Nova Pro escalation
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=50% Micro triage / 50% Nova Pro escalation; escalation mix; total monthly queries; blended spend; cost savings vs pure Pro; accuracy retention; routing recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50% Micro triage / 50% Nova Pro escalation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m3-r5
100% direct Nova Pro execution
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=100% direct Nova Pro execution; escalation mix; total monthly queries; blended spend; cost savings vs pure Pro; accuracy retention; routing recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100% direct Nova Pro execution is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-nova-micro-m3-r6
unresolved confidence threshold trigger
model=nova-micro; slug=nova-micro; provider=Amazon; scenario=unresolved confidence threshold trigger; escalation mix; total monthly queries; blended spend; cost savings vs pure Pro; accuracy retention; routing recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unresolved confidence threshold trigger has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: AWS Bedrock Nova pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the nova-micro Batch 67 scenario →

Continuous SEO Builder · Batch 74 Audit · 2026-09-08Owner: nova-micro

Amazon Nova Micro API Pricing: Industry-Lowest Cloud Token Economics

Amazon Nova Micro costs $0.035 per million input tokens and $0.14 per million output tokens ($0.06125/M blended at 3:1). The most economical text model available on AWS Bedrock, engineered for ultra-fast classification, routing, and high-volume data normalization. Verified 2026-09-08.

Module 1 · Amazon Nova Micro Micro-Cost Unit Token Economics
Blended Cost = (Input Tokens × $0.035 + Output Tokens × $0.14) / 1,000,000

Amazon Nova Micro delivers world-class cost efficiency at approximately $0.06/M blended tokens.

Boundary: Standard pay-as-you-go rate card on AWS Bedrock; applies to all standard text calls.
ScenarioRendered Evidence & Bounds
Scenario 1Support ticket intent categorization (500 in, 40 out): $0.000023 per ticket
Scenario 2Customer feedback sentiment scoring (1K in, 30 out): $0.000039 per review
Scenario 3High-volume webhook data normalization (800 in, 50 out): $0.000035 per webhook
Scenario 4Real-time text autocomplete keystroke completion (200 in, 20 out): $0.000010 per keystroke
Scenario 5Log anomaly classification turn (1.5K in, 60 out): $0.000061 per log entry
Scenario 6Monthly 100M token classification fleet: $6.13 total API infrastructure spend
Module 2 · Nova Micro High-Volume Batch ETL Processing on AWS S3
Batch Processing = Direct S3 Integration + Sub-Penny Token Economics

Direct S3 connectivity and microscopic token prices make it the ultimate data warehouse ETL engine.

Boundary: Evaluates massive asynchronous dataset enrichment directly connected to AWS data lakes.
ScenarioRendered Evidence & Bounds
Scenario 1Processes 100,000 customer survey responses for less than $0.50 total API cost
Scenario 2Enriches 1 million database customer records for approximately $3.50 total spend
Scenario 3Direct integration with Amazon S3 and AWS Lambda eliminates middleware server hosting
Scenario 4High-throughput serverless concurrency handles burst traffic without provisioning servers
Scenario 5Strict JSON mode output ensures reliable ingestion into downstream PostgreSQL/DynamoDB
Scenario 6Cuts data warehouse ETL preparation expenditures by more than 90% compared to legacy pipelines
Module 3 · Nova Micro Two-Tier Bedrock Gateway Escalation Architecture
Tiered Fleet Cost = (0.90 × Nova Micro Spend) + (0.10 × Nova Pro Spend)

Tiered Bedrock architecture slashes overall operational AI spend by 86% while boosting speed.

Boundary: Evaluates savings from absorbing 90% routine queries with Micro and escalating 10% to Nova Pro.
ScenarioRendered Evidence & Bounds
Scenario 11M queries routed via tiered architecture: $195.13 vs $1,400.00 monolithic Nova Pro fleet
Scenario 2Nova Micro handles 90% routine intent routing, sentiment tagging, and FAQ filtering
Scenario 3Nova Pro ($0.80/$3.20) reserved for complex multi-page document synthesis and vision
Scenario 4Overall AWS Bedrock API invoice reduced by 86.1% with zero loss in answer precision
Scenario 5Fleet average latency drops by 70% due to Nova Micro sub-80ms first-token generation
Scenario 6Standardized Bedrock Converse API parameters ensure frictionless handoff between models
Explore Related Analyses:AWS Bedrock provider profileCompare vs Nova LiteCompare vs GPT-5 NanoCheapest AI API comparison

How fast is Amazon Nova Micro?

Tokens / sec
168
TTFT
220 ms
Rank
#6 of 31
$ / M ÷ t/s
$0.0004
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Amazon Nova Micro cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.0061
1,000,000$0.06
10,000,000$0.61
100,000,000$6.12

How does Amazon Nova Micro compare with other models?

Amazon Nova Lite$0.11/MAmazon Nova Pro$1.40/MAmazon Nova Lite$0.11/MMuse Spark 1.3 Contributor$0.13/MGPT-OSS 20B$0.13/M
See all Amazon models →

What is Amazon Nova Micro best for?

#3 for Structured Data Extraction#7 for Coding#7 for Writing & Content

What are common questions about Amazon Nova Micro?

Is Amazon Nova Micro cheaper than Amazon Nova Lite?

Amazon Nova Micro costs $0.06/M blended tokens, Amazon Nova Lite costs $0.11/M — Amazon Nova Micro is cheaper.

How much does 1 million tokens cost with Amazon Nova Micro?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $0.06. Pure input costs $0.03/M; pure output costs $0.14/M.

What does Amazon Nova Micro cost at high volume?

At 100 million blended tokens a month, Amazon Nova Micro costs approximately $6.12. See the cost-at-scale table below for other volumes.

Try Amazon Nova Micro for free

Run real prompts against Amazon Nova Micro and every other model on this page in one workspace.

Try Amazon Nova Micro Free