← Back to all pricing

Qwen 3.8 30B on Groq API Pricing: Fast Bilingual Intelligence

Explore Qwen 3.8 30B on Groq API pricing ($0.60/M input, $3.00/M output), bilingual English/Chinese reasoning, and high-speed LPU inference.

Full specs, context window and API limits →

How much does Qwen 3.8 30B cost per million tokens?

Qwen 3.8 30B on Groq costs $0.60 per million input tokens and $3.00 per million output tokens ($1.20/M blended at 3:1). Offers premier bilingual performance powered by Groq LPUs. Verified 2026-09-08.

Verified 2026-09-07 source
Input
$0.60/M
Output
$3.00/M
Blended
$1.20/M
Provider
Verified 2026-07-10source

How much does Qwen 3.8 30B cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.2100
Medium1,000500$2.1000
Long4,0002,000$8.4000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Three model-specific pricing decisions

Qwen 3.8 30B is the Groq-hosted owner; its older Groq row, multimodal billing gaps, and accepted-run boundary are kept distinct from direct-Qwen pages.

1. Qwen 3.6 → 3.8 Groq migration bill

ModelVerified / lifecycleInput / output per M100K / 4K / 1KRetry sensitivity
Qwen 3.8 30B2026-07-10 · current$0.60 / $3.00$540.00Adjusted cost = base ÷ (1 − retry rate)
Qwen 3.6 27B2026-06-19 · Legacy — superseded by Qwen 3.8 30B$0.60 / $3.00$540.00Retry rate unavailable

2. Multimodal coding-agent bill

ShapeText-token billImage unitBoundary
Coding agent$840.00UnavailableText result only; no image conversion
Vision-shaped$840.00UnavailableDo not treat image input as zero

3. Qwen versus GPT-OSS 120B cost per accepted run

Fixed workload (input / output)Qwen 3.8 30BGPT-OSS 120BDecision boundary
Agent run · 8,000 / 1,200$840.00$192.0015% accepted-result uplift required to justify the higher bill
Coding run · 4,000 / 1,000$540.00$120.0020% accepted-result uplift required to justify the higher bill

Formula: 100,000 × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. Uplift is a decision threshold, not a measured quality claim.

Verified 2026-07-10. Luna is the data owner for this server-rendered module. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this exact scenario.

All three decisions are server-rendered for Qwen 3.8 30B; fixed inputs, formulas, dated sources, and unavailable states are intentionally visible.

Batch 67 · exact model pricing decision contributions · verified 2026-09-07

Exact model boundary: Groq qwen3.8-30b (slug qwen3-8-30b). First-party provider pricing and API documentation remain fact owners.

Bilingual workload token pricing and spend matrix

Frozen Batch 67 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 0.60 + out_tokens * 3.00) / 1M) Boundary: Owns base token tariff comparisons and bilingual workload budgeting.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-qwen3-8-30b-m1-r1
20K bilingual customer queries
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=20K bilingual customer queries; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 20K bilingual customer queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m1-r2
50K cross-border document translations
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=50K cross-border document translations; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50K cross-border document translations is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m1-r3
100K automated code generation passes
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=100K automated code generation passes; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100K automated code generation passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m1-r4
prompt caching active
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=prompt caching active; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — prompt caching active is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m1-r5
batch processing queue
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=batch processing queue; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — batch processing queue is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m1-r6
unresolved pricing currency
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unresolved pricing currency; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unresolved pricing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Groq Cloud official pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Cross-border API latency and streaming UX SLA audit

Frozen Batch 67 scenario board. Formula / deterministic rule: turnaround = ttft + (tokens_out / tps); Groq LPU low-latency generation Boundary: Owns turnaround time benchmarks and user experience responsiveness.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-qwen3-8-30b-m2-r1
domestic US API call (<150ms)
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=domestic US API call (<150ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — domestic US API call (<150ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m2-r2
cross-border Asia-US API call (<500ms)
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=cross-border Asia-US API call (<500ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — cross-border Asia-US API call (<500ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m2-r3
interactive code autocomplete
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=interactive code autocomplete; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — interactive code autocomplete is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m2-r4
dense bilingual legal translation
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=dense bilingual legal translation; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — dense bilingual legal translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m2-r5
international network congestion buffer
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=international network congestion buffer; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — international network congestion buffer is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m2-r6
unmeasured speed fixture
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unmeasured speed fixture; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unmeasured speed fixture is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Groq Cloud documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Bilingual reasoning accuracy floor and translation quality gate

Frozen Batch 67 scenario board. Formula / deterministic rule: roi = translation_value_delivered - ((in * 0.60 + out * 3.00) / 1M) Boundary: Owns translation quality and bilingual reasoning return on investment.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-qwen3-8-30b-m3-r1
e-commerce product catalog translation
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=e-commerce product catalog translation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — e-commerce product catalog translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m3-r2
technical software API documentation
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=technical software API documentation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — technical software API documentation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m3-r3
complex legal contract translation
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=complex legal contract translation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — complex legal contract translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m3-r4
bilingual conversational chatbot
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=bilingual conversational chatbot; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — bilingual conversational chatbot is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-qwen3-8-30b-m3-r5
unsupported cultural idiom mismatch
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unsupported cultural idiom mismatch; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported cultural idiom mismatch has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required
batch67-qwen3-8-30b-m3-r6
unverified translation metric
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unverified translation metric; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unverified translation metric is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Groq Cloud documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the qwen3-8-30b Batch 67 scenario →

Batch 75 Verified Model Pricing IntelligenceModel owner: qwen3-8-30b (Groq)Audit date: 2026-09-08

Qwen 3.8 30B on Groq API Pricing: Fast Bilingual Intelligence

Qwen 3.8 30B on Groq costs $0.60 per million input tokens and $3.00 per million output tokens ($1.20/M blended at 3:1). Offers premier bilingual performance powered by Groq LPUs. Verified 2026-09-08.

Bilingual workload token pricing and spend matrix

Frozen Batch 75 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 0.60 + out_tokens * 3.00) / 1M) Boundary: Owns base token tariff comparisons and bilingual workload budgeting.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-qwen3-8-30b-m1-r1
20K bilingual customer queries
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=20K bilingual customer queries; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 20K bilingual customer queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m1-r2
50K cross-border document translations
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=50K cross-border document translations; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 50K cross-border document translations is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m1-r3
100K automated code generation passes
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=100K automated code generation passes; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 100K automated code generation passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m1-r4
prompt caching active
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=prompt caching active; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — prompt caching active is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m1-r5
batch processing queue
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=batch processing queue; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — batch processing queue is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m1-r6
unresolved pricing currency
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unresolved pricing currency; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unresolved pricing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Groq official API pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.

Cross-border API latency and streaming UX SLA audit

Frozen Batch 75 scenario board. Formula / deterministic rule: turnaround = ttft + (tokens_out / tps); Groq LPU low-latency generation Boundary: Owns turnaround time benchmarks and user experience responsiveness.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-qwen3-8-30b-m2-r1
domestic US API call (<150ms)
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=domestic US API call (<150ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — domestic US API call (<150ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m2-r2
cross-border Asia-US API call (<500ms)
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=cross-border Asia-US API call (<500ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — cross-border Asia-US API call (<500ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m2-r3
interactive code autocomplete
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=interactive code autocomplete; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — interactive code autocomplete is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m2-r4
dense bilingual legal translation
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=dense bilingual legal translation; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — dense bilingual legal translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m2-r5
international network congestion buffer
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=international network congestion buffer; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — international network congestion buffer is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m2-r6
unmeasured speed fixture
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unmeasured speed fixture; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unmeasured speed fixture is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Groq developer documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

Bilingual reasoning accuracy floor and translation quality gate

Frozen Batch 75 scenario board. Formula / deterministic rule: roi = translation_value_delivered - ((in * 0.60 + out * 3.00) / 1M) Boundary: Owns translation quality and bilingual reasoning return on investment.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-qwen3-8-30b-m3-r1
e-commerce product catalog translation
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=e-commerce product catalog translation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — e-commerce product catalog translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m3-r2
technical software API documentation
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=technical software API documentation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — technical software API documentation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m3-r3
complex legal contract translation
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=complex legal contract translation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — complex legal contract translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m3-r4
bilingual conversational chatbot
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=bilingual conversational chatbot; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — bilingual conversational chatbot is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-qwen3-8-30b-m3-r5
unsupported cultural idiom mismatch
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unsupported cultural idiom mismatch; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unsupported cultural idiom mismatch has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required
batch75-qwen3-8-30b-m3-r6
unverified translation metric
model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unverified translation metric; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unverified translation metric is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Groq developer documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

How fast is Qwen 3.8 30B?

Tokens / sec
690
TTFT
150 ms
Rank
#5 of 31
$ / M ÷ t/s
$0.0017
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Qwen 3.8 30B cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.12
1,000,000$1.20
10,000,000$12.00
100,000,000$120.00

How does Qwen 3.8 30B compare with other models?

GPT-OSS 20B$0.13/MGPT-OSS 120B$0.26/MLlama 4 Maverick$0.30/MQwen 3.6 27B$1.20/MQwen 3.6 27B$1.20/MQwen 3.7 Plus$1.10/MGLM-5.1$1.00/M
See all Groq models →

What is Qwen 3.8 30B best for?

#15 for Agents & Tool Use#22 for Chatbots & Support#25 for Translation
Looking for a cheaper option?
GPT-OSS 20B is 89.1% cheaper — a drop-in migration. See all 8 alternatives to Qwen 3.8 30B

What are common questions about Qwen 3.8 30B?

Is Qwen 3.8 30B cheaper than Qwen 3.6 27B?

Qwen 3.8 30B costs $1.20/M blended tokens, Qwen 3.6 27B costs $1.20/M — Qwen 3.6 27B is cheaper.

How much does 1 million tokens cost with Qwen 3.8 30B?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $1.20. Pure input costs $0.60/M; pure output costs $3.00/M.

What does Qwen 3.8 30B cost at high volume?

At 100 million blended tokens a month, Qwen 3.8 30B costs approximately $120.00. See the cost-at-scale table below for other volumes.

Try Qwen 3.8 30B for free

Run real prompts against Qwen 3.8 30B and every other model on this page in one workspace.

Try Qwen 3.8 30B Free