← Back to all pricing

Qwen 3.8 Max API Pricing: Flagship Frontier Intelligence for Asian Markets

Comprehensive Qwen 3.8 Max API pricing analysis ($1.60/M input, $6.40/M output), DashScope enterprise cloud SLAs, bilingual reasoning benchmarks, and prompt caching ROI.

Full specs, context window and API limits →

How much does Qwen 3.8 Max cost per million tokens?

Qwen 3.8 Max costs $1.60 per million input tokens and $6.40 per million output tokens ($2.80/M blended at 3:1). Alibaba premier frontier model offering state-of-the-art coding, complex math, and deep bilingual Chinese/English comprehension. Verified 2026-09-08.

Verified 2026-09-07 — source
Input
$1.60/M
Output
$6.40/M
Blended
$2.80/M
Provider
Verified 2026-07-10 — source

How much does Qwen 3.8 Max cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.4800
Medium1,000500$4.8000
Long4,0002,000$19.2000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Three model-specific pricing decisions

Qwen 3.8 Max is kept to unit economics and evidence boundaries; region, currency, and context claims are not filled with provider defaults.

1. Max versus Plus fixed-workload crossover

Quality-uplift boundary

Fixed workloadQwen 3.8 MaxQwen 3.7 PlusBoundary
Chat$480.00$180.0015% accepted-result uplift needed to justify premium
Coding$1280.00$520.0020% accepted-result uplift needed to justify premium
Agent$2048.00$880.0025% accepted-result uplift needed to justify premium

Formula: calls × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. The uplift threshold is a decision input, not a measured quality claim.

2. Dated Max rate comparison

ModelListed rateVerifiedPerformance delta
Qwen 3.8 Max$1.60 / $6.402026-07-10Unavailable — price parity is not quality parity
Qwen 3.7 Max$1.60 / $6.402026-07-23Unavailable

3. Region, currency, context, cache, and batch evidence matrix

DimensionDated evidenceSafe calculation
Region / currencyUnavailableUSD registry only
Context tierUnavailableDo not infer a higher tier
Cache / batchUnavailableDo not default to zero

Verified 2026-07-10. “Unavailable” means the current dated registry has no model-specific evidence; it is not a zero. First-party price source · Run this scenario in the playground.

All results are server-rendered for Qwen 3.8 Max; formulas expose fixed inputs and missing evidence remains visibly unavailable.

Exact-model pricing guide · verified 2026-09-07

Exact model boundary: Qwen Qwen 3.8 Max (qwen3.8-max). Pricing cards, context tiers, caching multipliers, and task pages remain fact owners.

Bilingual English/Chinese cross-lingual translation economics

Frozen scenario board. Formula / deterministic rule: translation_cost = documents * ((source_tokens * 1.60 + target_tokens * 6.40) / 1M) Boundary: Owns cross-lingual enterprise translation economics for Qwen 3.8 Max.

Frozen scenarioExact identity and evidence fieldsResultState
1K legal contracts translationmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=1K legal contracts translation; document count; source tokens; target tokens; monthly cost; cost per 1K words; translation verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1K legal contracts translation is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
10K financial earnings reportsmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=10K financial earnings reports; document count; source tokens; target tokens; monthly cost; cost per 1K words; translation verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10K financial earnings reports is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
50K technical documentation pagesmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=50K technical documentation pages; document count; source tokens; target tokens; monthly cost; cost per 1K words; translation verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50K technical documentation pages is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
250K localized customer messagesmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=250K localized customer messages; document count; source tokens; target tokens; monthly cost; cost per 1K words; translation verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 250K localized customer messages is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
tokenizer expansion ratio anomalymodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=tokenizer expansion ratio anomaly; document count; source tokens; target tokens; monthly cost; cost per 1K words; translation verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — tokenizer expansion ratio anomaly is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unsupported ancient text encodingmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=unsupported ancient text encoding; document count; source tokens; target tokens; monthly cost; cost per 1K words; translation verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported ancient text encoding has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Alibaba Cloud Model Studio pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

1M context long-document analysis and financial forensics

Frozen scenario board. Formula / deterministic rule: audit_cost = reports * ((sec_filing_tokens * 1.60 + synthesis_tokens * 6.40) / 1M) Boundary: Owns forensic document examination and long-context auditing on Qwen.

Frozen scenarioExact identity and evidence fieldsResultState
50 10-K filing comprehensive auditsmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=50 10-K filing comprehensive audits; audit dossiers; input tokens; output tokens; analysis spend; cost per report; audit verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50 10-K filing comprehensive audits is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
200 annual report comparative checksmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=200 annual report comparative checks; audit dossiers; input tokens; output tokens; analysis spend; cost per report; audit verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 200 annual report comparative checks is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
1K regulatory compliance dossiersmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=1K regulatory compliance dossiers; audit dossiers; input tokens; output tokens; analysis spend; cost per report; audit verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1K regulatory compliance dossiers is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
5K quarterly financial summariesmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=5K quarterly financial summaries; audit dossiers; input tokens; output tokens; analysis spend; cost per report; audit verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 5K quarterly financial summaries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
context boundary truncation testmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=context boundary truncation test; audit dossiers; input tokens; output tokens; analysis spend; cost per report; audit verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — context boundary truncation test is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
corrupted PDF scan extractionmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=corrupted PDF scan extraction; audit dossiers; input tokens; output tokens; analysis spend; cost per report; audit verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — corrupted PDF scan extraction is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Qwen API documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Qwen 3.8 Max vs Qwen 3.7 Max upgrade economic threshold

Frozen scenario board. Formula / deterministic rule: delta = max38_cost - max37_cost; break-even requires benchmark accuracy gain Boundary: Owns upgrade decision modeling between Qwen 3.7 Max and 3.8 Max.

Frozen scenarioExact identity and evidence fieldsResultState
general conversational chatmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=general conversational chat; monthly call volume; Qwen 3.7 Max spend; Qwen 3.8 Max spend; cost difference; required benchmark delta; verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — general conversational chat is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
advanced math and logic proofsmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=advanced math and logic proofs; monthly call volume; Qwen 3.7 Max spend; Qwen 3.8 Max spend; cost difference; required benchmark delta; verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — advanced math and logic proofs is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
complex agentic tool callingmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=complex agentic tool calling; monthly call volume; Qwen 3.7 Max spend; Qwen 3.8 Max spend; cost difference; required benchmark delta; verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — complex agentic tool calling is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
high-throughput batch analysismodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=high-throughput batch analysis; monthly call volume; Qwen 3.7 Max spend; Qwen 3.8 Max spend; cost difference; required benchmark delta; verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — high-throughput batch analysis is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
regional latency edge casemodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=regional latency edge case; monthly call volume; Qwen 3.7 Max spend; Qwen 3.8 Max spend; cost difference; required benchmark delta; verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — regional latency edge case is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
untested reasoning accuracy gainmodel=qwen3.8-max; provider=Qwen; slug=qwen3-8-max; scenario=untested reasoning accuracy gain; monthly call volume; Qwen 3.7 Max spend; Qwen 3.8 Max spend; cost difference; required benchmark delta; verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — untested reasoning accuracy gain is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Alibaba Cloud Model Studio pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run this scenario →

Evidence audit · 2026-09-08

Qwen 3.8 Max API Pricing: Flagship Frontier Intelligence for Asian Markets

Qwen 3.8 Max costs $1.60 per million input tokens and $6.40 per million output tokens ($2.80/M blended at 3:1). Alibaba premier frontier model offering state-of-the-art coding, complex math, and deep bilingual Chinese/English comprehension. Verified 2026-09-08.

Module 1 · Qwen 3.8 Max Production Token Rate Card & Economics
Blended Cost = (Input Tokens × $1.60 + Output Tokens × $6.40) / 1,000,000

Qwen 3.8 Max delivers top-tier cognitive mastery and bilingual fluency at $2.80/M blended tokens.

Boundary: Standard pay-as-you-go commercial rate card on Alibaba Cloud DashScope platform.
ScenarioRendered Evidence & Bounds
Scenario 1Cross-border legal litigation brief analysis (20K in, 3.5K out): $0.054400 per brief
Scenario 2Complex multi-tier microservice architecture review (30K in, 4K out): $0.073600 per review
Scenario 3Bilingual financial earnings synthesis (40K in, 5K out): $0.096000 per company report
Scenario 4High-stakes regulatory compliance filing (24K in, 3K out): $0.057600 per filing pass
Scenario 5Autonomous agent multi-turn planning pass (32K in, 4K out): $0.076800 per planning turn
Scenario 6Monthly enterprise cognitive research tier (50M blended tokens): $140.00 infrastructure budget
Module 2 · Qwen 3.8 Max Context Caching & Chinese Token Optimization
Cached Cost = (Cached Input × $0.40 + Uncached Input × $1.60 + Output × $6.40) / 1,000,000

DashScope context caching lowers operational overhead for heavy multi-document analysis.

Boundary: 75% discount on prompt prefixes >1,024 tokens held in DashScope context cache.
ScenarioRendered Evidence & Bounds
Scenario 1Corporate legal precedent archive cache (80K tokens): 71% input cost reduction
Scenario 2Shared enterprise knowledge base context cached across 20 queries: 73% cumulative savings
Scenario 3Bilingual technical terminology dictionary cache: amortizes heavy domain glossaries
Scenario 4Hourly cache storage fee fully amortized after only 2 queries per hour within active sessions
Scenario 5Reduces time-to-first-token latency by 45% by avoiding redundant prompt compilation
Scenario 6Dramatically improves economics of complex interactive research across deep archives
Module 3 · Qwen 3.8 Max vs Western Flagships Cost-Capability Frontier
Cost Advantage = Western Flagship ($15-$30/M) vs Qwen 3.8 Max ($2.80/M) = 81%-90% Savings

Delivers elite cognitive reasoning and bilingual dominance at a fraction of Western flagship prices.

Boundary: Compares Qwen 3.8 Max against Western proprietary flagships on bilingual and STEM tasks.
ScenarioRendered Evidence & Bounds
Scenario 1Qwen 3.8 Max ($2.80/M blended) vs Claude Opus 5 ($30.00/M blended): 90.7% cost savings
Scenario 2Qwen 3.8 Max vs GPT-5.6 Sol ($8.00/M blended): 65.0% operational cost reduction
Scenario 3Top scores on MMLU-Pro, MATH-500, and Chinese LLM evaluation benchmarks
Scenario 4High-volume production tier (100M tokens/mo): saves >$2,700 compared to Western flagships
Scenario 5Standard OpenAI-compatible REST API allows seamless drop-in routing replacement
Scenario 6Strongly recommended for multinational enterprises operating across APAC and Western regions
Explore Related Analyses:Alibaba Cloud provider profile →Compare vs Qwen 3.7 Max →Compare vs DeepSeek V4 Pro →LLM state report →
Exact-Model Pricing Evidence•Verified 2026-07-10; revalidation required before current claims.

Qwen 3.8 Max pricing evidence

Source-backed dated rate shape: dated input=$1.600000/M; output=$6.400000/M. Alibaba direct Qwen 3.8 Max exact-model economics only; Qwen policy, Groq-hosted Qwen, and broad multilingual verdicts retain their owners. Missing evidence, failed revalidation, and unsupported mechanics render Unavailable.

Module 1 of 3: Long-context reasoning bill ladder

Novel contribution boundary: Owns dated Qwen 3.8 Max arithmetic for fixed long-context reasoning shapes; reasoning quality and quota are not asserted. Formula / deterministic rule: spend = requests × (inputTokens × inputCostPer1k + outputTokens × outputCostPer1k) / 1,000

ScenarioExact model, provider, dated rates, and fixed inputsResultState
5K compact reasoning requestsmodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=requests=5,000; inputTokens=2,000; outputTokens=1,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
500 long-context legal requestsmodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=requests=500; inputTokens=100,000; outputTokens=4,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
50 near-context-limit requestsmodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=requests=50; inputTokens=500,000; outputTokens=12,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party provenance: https://www.alibabacloud.com/help/en/model-studio/pricing; registry provider qwen; verified 2026-07-10; freshness gate=2026-09-14. Revalidate before any current-price claim.

Module 2 of 3: Max→Qwen 3.7 Max accepted-result premium

Novel contribution boundary: Owns dated version arithmetic with explicit retry input; accepted-result quality and model selection are not sourced. Formula / deterministic rule: requiredAcceptedRate = Qwen 3.7 Max AttemptCost / Qwen 3.8 Max AttemptCost; observed acceptance = Unavailable

ScenarioExact model, provider, dated rates, and fixed inputsResultState
2K-input reasoning run; 10% retry share; 500 retry-input tokensmodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=requests=1; inputTokens=2,000; outputTokens=1,000; retryInputTokens=500; retryShare=10%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
100K-input legal run; 20% retry share; 2,000 retry-input tokensmodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=requests=1; inputTokens=100,000; outputTokens=4,000; retryInputTokens=2,000; retryShare=20%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
500K-input long-context run; 30% retry share; 4,000 retry-input tokensmodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=requests=1; inputTokens=500,000; outputTokens=12,000; retryInputTokens=4,000; retryShare=30%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party provenance: https://www.alibabacloud.com/help/en/model-studio/pricing; registry provider qwen; verified 2026-07-10; freshness gate=2026-09-14. Revalidate before any current-price claim.

Module 3 of 3: Cache, quota, and region evidence matrix

Novel contribution boundary: Owns exact-model Alibaba registry evidence only; cache behavior, quota, and regional account mechanics are not inferred. Formula / deterministic rule: evidence = exact-model registry field when present; cache, quota, and regional account terms = Unavailable

ScenarioExact model, provider, dated rates, and fixed inputsResultState
Prompt-cache price or eligibilitymodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=evidenceField=cache; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Quota or account termmodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=evidenceField=quota; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Regional availability or currency termmodel=qwen3.8-max; provider=qwen; registryRates=dated input=$1.600000/M; output=$6.400000/M; comparisonModel=qwen3.7-max; fixedInputs=evidenceField=region; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-07-10, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party provenance: https://www.alibabacloud.com/help/en/model-studio/pricing; registry provider qwen; verified 2026-07-10; freshness gate=2026-09-14. Revalidate before any current-price claim.

Try Qwen 3.8 Max pricing analysis →

How fast is Qwen 3.8 Max?

Tokens / sec
47
TTFT
470 ms
Rank
#29 of 31
$ / M ÷ t/s
$0.06
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Qwen 3.8 Max cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.28
1,000,000$2.80
10,000,000$28.00
100,000,000$280.00

How does Qwen 3.8 Max compare with other models?

Qwen 3.7 Plus — $1.10/MQwen 3.7 Max — $2.80/MQwen 3.7 Max — $2.80/MGrok-4.20 Reasoning — $3.00/MGrok-4.20 — $3.00/M
See all Qwen models →

What is Qwen 3.8 Max best for?

#30 for Math & Reasoning#31 for Agents & Tool Use#37 for Image Understanding
Looking for a cheaper option?
GPT-OSS 120B (Cerebras) is 83.9% cheaper — a config migration. See all 8 alternatives to Qwen 3.8 Max →

What are common questions about Qwen 3.8 Max?

Is Qwen 3.8 Max cheaper than Qwen 3.7 Max?

Qwen 3.8 Max costs $2.80/M blended tokens, Qwen 3.7 Max costs $2.80/M — Qwen 3.7 Max is cheaper.

How much does 1 million tokens cost with Qwen 3.8 Max?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $2.80. Pure input costs $1.60/M; pure output costs $6.40/M.

What does Qwen 3.8 Max cost at high volume?

At 100 million blended tokens a month, Qwen 3.8 Max costs approximately $280.00. See the cost-at-scale table below for other volumes.

Try Qwen 3.8 Max for free

Run real prompts against Qwen 3.8 Max and every other model on this page in one workspace.

Try Qwen 3.8 Max Free