← Back to all pricing

Qwen 3.8 30B on Groq API Pricing: Fast Bilingual Intelligence

Explore Qwen 3.8 30B on Groq API pricing ($0.60/M input, $3.00/M output), bilingual English/Chinese reasoning, and high-speed LPU inference.

Full specs, context window and API limits →

How much does Qwen 3.8 30B cost per million tokens?

Qwen 3.8 30B on Groq costs $0.60 per million input tokens and $3.00 per million output tokens ($1.20/M blended at 3:1). Offers premier bilingual performance powered by Groq LPUs. Verified 2026-09-08.

Verified 2026-09-07 — source
Input
$0.60/M
Output
$3.00/M
Blended
$1.20/M
Provider
Verified 2026-07-10 — source

How much does Qwen 3.8 30B cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.2100
Medium1,000500$2.1000
Long4,0002,000$8.4000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Three model-specific pricing decisions

Qwen 3.8 30B is the Groq-hosted owner; its older Groq row, multimodal billing gaps, and accepted-run boundary are kept distinct from direct-Qwen pages.

1. Qwen 3.6 → 3.8 Groq migration bill

ModelVerified / lifecycleInput / output per M100K / 4K / 1KRetry sensitivity
Qwen 3.8 30B2026-07-10 · current$0.60 / $3.00$540.00Adjusted cost = base ÷ (1 − retry rate)
Qwen 3.6 27B2026-06-19 · Legacy — superseded by Qwen 3.8 30B$0.60 / $3.00$540.00Retry rate unavailable

2. Multimodal coding-agent bill

ShapeText-token billImage unitBoundary
Coding agent$840.00UnavailableText result only; no image conversion
Vision-shaped$840.00UnavailableDo not treat image input as zero

3. Qwen versus GPT-OSS 120B cost per accepted run

Fixed workload (input / output)Qwen 3.8 30BGPT-OSS 120BDecision boundary
Agent run · 8,000 / 1,200$840.00$192.0015% accepted-result uplift required to justify the higher bill
Coding run · 4,000 / 1,000$540.00$120.0020% accepted-result uplift required to justify the higher bill

Formula: 100,000 × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. Uplift is a decision threshold, not a measured quality claim.

Verified 2026-07-10. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this exact scenario.

All three decisions are server-rendered for Qwen 3.8 30B; fixed inputs, formulas, dated sources, and unavailable states are intentionally visible.

Exact-model pricing guide · verified 2026-09-07

Exact model boundary: Groq qwen3.8-30b (slug qwen3-8-30b). First-party provider pricing and API documentation remain fact owners.

Bilingual workload token pricing and spend matrix

Frozen scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 0.60 + out_tokens * 3.00) / 1M) Boundary: Owns base token tariff comparisons and bilingual workload budgeting.

Frozen scenarioModel, identity, provider, and evidence fieldsResultState
20K bilingual customer queriesmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=20K bilingual customer queries; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 20K bilingual customer queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
50K cross-border document translationsmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=50K cross-border document translations; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50K cross-border document translations is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
100K automated code generation passesmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=100K automated code generation passes; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100K automated code generation passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
prompt caching activemodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=prompt caching active; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — prompt caching active is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch processing queuemodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=batch processing queue; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — batch processing queue is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unresolved pricing currencymodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unresolved pricing currency; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unresolved pricing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Groq Cloud official pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Cross-border API latency and streaming UX SLA audit

Frozen scenario board. Formula / deterministic rule: turnaround = ttft + (tokens_out / tps); Groq LPU low-latency generation Boundary: Owns turnaround time benchmarks and user experience responsiveness.

Frozen scenarioModel, identity, provider, and evidence fieldsResultState
domestic US API call (<150ms)model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=domestic US API call (<150ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — domestic US API call (<150ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
cross-border Asia-US API call (<500ms)model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=cross-border Asia-US API call (<500ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — cross-border Asia-US API call (<500ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
interactive code autocompletemodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=interactive code autocomplete; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — interactive code autocomplete is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
dense bilingual legal translationmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=dense bilingual legal translation; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — dense bilingual legal translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
international network congestion buffermodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=international network congestion buffer; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — international network congestion buffer is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unmeasured speed fixturemodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unmeasured speed fixture; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unmeasured speed fixture is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Groq Cloud documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Bilingual reasoning accuracy floor and translation quality gate

Frozen scenario board. Formula / deterministic rule: roi = translation_value_delivered - ((in * 0.60 + out * 3.00) / 1M) Boundary: Owns translation quality and bilingual reasoning return on investment.

Frozen scenarioModel, identity, provider, and evidence fieldsResultState
e-commerce product catalog translationmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=e-commerce product catalog translation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — e-commerce product catalog translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
technical software API documentationmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=technical software API documentation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — technical software API documentation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
complex legal contract translationmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=complex legal contract translation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — complex legal contract translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
bilingual conversational chatbotmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=bilingual conversational chatbot; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — bilingual conversational chatbot is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unsupported cultural idiom mismatchmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unsupported cultural idiom mismatch; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported cultural idiom mismatch has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required
unverified translation metricmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unverified translation metric; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unverified translation metric is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Groq Cloud documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run this scenario →

Verified Model Pricing Intelligence•Audit date: 2026-09-08

Qwen 3.8 30B on Groq API Pricing: Fast Bilingual Intelligence

Qwen 3.8 30B on Groq costs $0.60 per million input tokens and $3.00 per million output tokens ($1.20/M blended at 3:1). Offers premier bilingual performance powered by Groq LPUs. Verified 2026-09-08.

Bilingual workload token pricing and spend matrix

Frozen scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 0.60 + out_tokens * 3.00) / 1M) Boundary: Owns base token tariff comparisons and bilingual workload budgeting.

Frozen scenarioModel, identity, provider, and evidence fieldsResultState
20K bilingual customer queriesmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=20K bilingual customer queries; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 20K bilingual customer queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
50K cross-border document translationsmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=50K cross-border document translations; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 50K cross-border document translations is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
100K automated code generation passesmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=100K automated code generation passes; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 100K automated code generation passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
prompt caching activemodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=prompt caching active; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — prompt caching active is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch processing queuemodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=batch processing queue; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — batch processing queue is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unresolved pricing currencymodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unresolved pricing currency; workload; prompt tokens; completion tokens; monthly spend; speed advantage; cost verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unresolved pricing currency has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Groq official API pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.

Cross-border API latency and streaming UX SLA audit

Frozen scenario board. Formula / deterministic rule: turnaround = ttft + (tokens_out / tps); Groq LPU low-latency generation Boundary: Owns turnaround time benchmarks and user experience responsiveness.

Frozen scenarioModel, identity, provider, and evidence fieldsResultState
domestic US API call (<150ms)model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=domestic US API call (<150ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — domestic US API call (<150ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
cross-border Asia-US API call (<500ms)model=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=cross-border Asia-US API call (<500ms); task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — cross-border Asia-US API call (<500ms) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
interactive code autocompletemodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=interactive code autocomplete; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — interactive code autocomplete is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
dense bilingual legal translationmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=dense bilingual legal translation; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — dense bilingual legal translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
international network congestion buffermodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=international network congestion buffer; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — international network congestion buffer is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unmeasured speed fixturemodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unmeasured speed fixture; task; response SLA; TTFT; generation speed; SLA compliance; responsiveness champion; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unmeasured speed fixture is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Groq developer documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

Bilingual reasoning accuracy floor and translation quality gate

Frozen scenario board. Formula / deterministic rule: roi = translation_value_delivered - ((in * 0.60 + out * 3.00) / 1M) Boundary: Owns translation quality and bilingual reasoning return on investment.

Frozen scenarioModel, identity, provider, and evidence fieldsResultState
e-commerce product catalog translationmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=e-commerce product catalog translation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — e-commerce product catalog translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
technical software API documentationmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=technical software API documentation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — technical software API documentation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
complex legal contract translationmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=complex legal contract translation; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — complex legal contract translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
bilingual conversational chatbotmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=bilingual conversational chatbot; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — bilingual conversational chatbot is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unsupported cultural idiom mismatchmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unsupported cultural idiom mismatch; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unsupported cultural idiom mismatch has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required
unverified translation metricmodel=qwen3.8-30b; slug=qwen3-8-30b; provider=Groq; scenario=unverified translation metric; content domain; translation volume; accuracy score; token expenditure; economic recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unverified translation metric is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Groq developer documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

Exact-Model Pricing Evidence•Verified 2026-07-10; revalidation required before current claims.

Qwen 3.8 30B on Groq pricing evidence

Source-backed dated rate shape: dated input=$0.600000/M; output=$3.000000/M. Groq-hosted Qwen 3.8 30B tariff and cross-border workload arithmetic only; direct Qwen policy, Max economics, and multilingual rankings retain their owners. Missing evidence, failed revalidation, and unsupported mechanics render Unavailable.

Module 1 of 3: Chinese/English extraction bill shapes

Novel contribution boundary: Owns dated Groq-hosted 30B arithmetic for fixed bilingual token shapes; translation quality is not asserted. Formula / deterministic rule: spend = requests × (inputTokens × inputCostPer1k + outputTokens × outputCostPer1k) / 1,000

ScenarioExact model, provider, dated rates, and fixed inputsResultState
20K Chinese extraction requestsmodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=requests=20,000; inputTokens=1,000; outputTokens=300; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
50K English extraction requestsmodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=requests=50,000; inputTokens=2,000; outputTokens=500; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
100K mixed-language requestsmodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=requests=100,000; inputTokens=4,000; outputTokens=800; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party provenance: https://groq.com/pricing; registry provider groq; verified 2026-07-10; freshness gate=2026-09-14. Revalidate before any current-price claim.

Module 2 of 3: 30B→120B accepted-result threshold

Novel contribution boundary: Owns dated cross-model cost arithmetic with explicit retry input; quality uplift and routing acceptance are not sourced. Formula / deterministic rule: requiredAcceptedRate = 120BAttemptCost / 30BAttemptCost; observed acceptance = Unavailable

ScenarioExact model, provider, dated rates, and fixed inputsResultState
Short bilingual extraction; 10% retry share; 200 retry-input tokensmodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=requests=1; inputTokens=1,000; outputTokens=300; retryInputTokens=200; retryShare=10%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Medium translation; 20% retry share; 500 retry-input tokensmodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=requests=1; inputTokens=2,000; outputTokens=500; retryInputTokens=500; retryShare=20%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Long legal translation; 30% retry share; 1,000 retry-input tokensmodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=requests=1; inputTokens=4,000; outputTokens=800; retryInputTokens=1,000; retryShare=30%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party provenance: https://groq.com/pricing; registry provider groq; verified 2026-07-10; freshness gate=2026-09-14. Revalidate before any current-price claim.

Module 3 of 3: LPU latency, region, and currency evidence matrix

Novel contribution boundary: Owns exact-model Groq pricing evidence only; latency observations, regional terms, and currency conversion are not fabricated. Formula / deterministic rule: evidence = exact-model registry field when present; region, currency, and latency inputs = Unavailable

ScenarioExact model, provider, dated rates, and fixed inputsResultState
LPU latency observationmodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=evidenceField=latency; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Regional availability or termsmodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=evidenceField=region; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Billing currency or conversion rulemodel=qwen3.8-30b; provider=groq; registryRates=dated input=$0.600000/M; output=$3.000000/M; comparisonModel=gpt-oss-120b; fixedInputs=evidenceField=capacity; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party provenance: https://groq.com/pricing; registry provider groq; verified 2026-07-10; freshness gate=2026-09-14. Revalidate before any current-price claim.

Try Qwen 3.8 30B on Groq pricing analysis →

How fast is Qwen 3.8 30B?

Tokens / sec
690
TTFT
150 ms
Rank
#5 of 31
$ / M ÷ t/s
$0.0017
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Qwen 3.8 30B cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.12
1,000,000$1.20
10,000,000$12.00
100,000,000$120.00

How does Qwen 3.8 30B compare with other models?

GPT-OSS 20B — $0.13/MGPT-OSS 120B — $0.26/MLlama 4 Maverick — $0.30/MQwen 3.6 27B — $1.20/MQwen 3.6 27B — $1.20/MQwen 3.7 Plus — $1.10/MGLM-5.1 — $1.00/M
See all Groq models →

What is Qwen 3.8 30B best for?

#21 for Agents & Tool Use#26 for Chatbots & Support#29 for Translation
Looking for a cheaper option?
GPT-OSS 20B is 89.1% cheaper — a drop-in migration. See all 8 alternatives to Qwen 3.8 30B →

What are common questions about Qwen 3.8 30B?

Is Qwen 3.8 30B cheaper than Qwen 3.6 27B?

Qwen 3.8 30B costs $1.20/M blended tokens, Qwen 3.6 27B costs $1.20/M — Qwen 3.6 27B is cheaper.

How much does 1 million tokens cost with Qwen 3.8 30B?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $1.20. Pure input costs $0.60/M; pure output costs $3.00/M.

What does Qwen 3.8 30B cost at high volume?

At 100 million blended tokens a month, Qwen 3.8 30B costs approximately $120.00. See the cost-at-scale table below for other volumes.

Try Qwen 3.8 30B for free

Run real prompts against Qwen 3.8 30B and every other model on this page in one workspace.

Try Qwen 3.8 30B Free