← Back to all pricing

Gemini 3.6 Flash API Pricing: High-Velocity Multimodal Scale

Comprehensive Gemini 3.6 Flash API pricing analysis ($1.50/M input, $7.50/M output), sub-second multimodal latency, 1M context caching, and upgrade path to 3.7 Flash.

Full specs, context window and API limits →

How much does Gemini 3.6 Flash cost per million tokens?

Gemini 3.6 Flash costs $1.50 per million input tokens and $7.50 per million output tokens ($3.00/M blended at 3:1). A high-speed multimodal workhorse engineered for instant interactive responses across text, audio, images, and video with 1M context. Verified 2026-09-08.

Verified 2026-09-07 — source
Input
$1.50/M
Output
$7.50/M
Blended
$3.00/M
Provider
Verified 2026-08-14 — source

How much does Gemini 3.6 Flash cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; this model has no measured verbosity factor, so the unadjusted output estimate is shown.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.5250
Medium1,000500$5.2500
Long4,0002,000$21.0000

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Unadjusted — no measured verbosity factor is available.

Three model-specific pricing decisions

Gemini 3.6 Flash is compared with 3.7 only through fixed billing shapes. Endpoint/account policy remains on Google’s provider owner.

1. 3.6 → 3.7 Flash token-shape crossover

Fixed workloadGemini 3.6 FlashGemini 3.7 FlashBoundary
Text chat$525.00$262.5010% accepted-result uplift needed to justify premium
Extraction$1800.00$900.0015% accepted-result uplift needed to justify premium
Output-heavy$3150.00$1575.0020% accepted-result uplift needed to justify premium

Formula: calls × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. The uplift threshold is a decision input, not a measured quality claim.

2. Context tier and cache sensitivity

MechanicDated input100K-call result / boundary
List input/output$1.50 / $7.50 per M$622.50
Long-context thresholdModel-specific tier source unavailableUnavailable — context window is not a price
Cache thresholdProvider cache rules onlyApply only when prefix/minimum is verified
Prompt cache10% read; 100% write; 3600s TTLApply only to eligible repeated prefixes
BatchScenario only: 50% output$491.25

3. Unit-safe multimodal workload

InputPublished unit100K resultAI Studio / Vertex
Text$0.001500 $/1K tokens$622.50Billing split unavailable
ImageUnavailableUnavailableDo not convert missing unit
AudioUnavailableUnavailableDo not merge invoices

Verified 2026-08-14. “Unavailable” means the current dated registry has no model-specific evidence; it is not a zero. First-party price source · Run this scenario in the playground.

All results are server-rendered for Gemini 3.6 Flash; formulas expose fixed inputs and missing evidence remains visibly unavailable.

Exact-model pricing guide · verified 2026-09-07

Exact model boundary: Google Gemini 3.6 Flash (gemini-3.6-flash). Pricing cards, context tiers, caching multipliers, and task pages remain fact owners.

Context caching storage and lookup economics

Frozen scenario board. Formula / deterministic rule: cost = (uncached_in * 1.50 + cache_read * 0.375 + out * 7.50) / 1M + storage_hours * 0.0000045 Boundary: Owns Gemini 3.6 Flash context caching break-even economics.

Frozen scenarioExact identity and evidence fieldsResultState
single interactive call (no cache)model=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=single interactive call (no cache); cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — single interactive call (no cache) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
hourly query against cached 100K docmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=hourly query against cached 100K doc; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — hourly query against cached 100K doc is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
10 queries/hr on cached 500K contextmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=10 queries/hr on cached 500K context; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10 queries/hr on cached 500K context is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
100 queries/hr high-frequency lookupmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=100 queries/hr high-frequency lookup; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100 queries/hr high-frequency lookup is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
stale cache storage without queriesmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=stale cache storage without queries; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — stale cache storage without queries is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unsupported cache payload formatmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=unsupported cache payload format; cached token count; active storage hours; query frequency; storage fee; query fee; net savings; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported cache payload format has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Google Gemini API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Multimodal image and audio token ingestion pricing

Frozen scenario board. Formula / deterministic rule: image_cost = (images * tokens_per_image * 1.50) / 1M; audio_cost = (audio_seconds * tokens_per_sec * 1.50) / 1M Boundary: Owns Gemini 3.6 Flash multimodal input token conversion costs.

Frozen scenarioExact identity and evidence fieldsResultState
100 standard UI screenshotsmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=100 standard UI screenshots; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100 standard UI screenshots is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
1K high-resolution PDF pagesmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=1K high-resolution PDF pages; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1K high-resolution PDF pages is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
10 minutes of meeting audiomodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=10 minutes of meeting audio; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10 minutes of meeting audio is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
1 hour multimodal video analysismodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=1 hour multimodal video analysis; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1 hour multimodal video analysis is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
continuous webcam stream monitoringmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=continuous webcam stream monitoring; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — continuous webcam stream monitoring is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
unsupported audio codec payloadmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=unsupported audio codec payload; media modality; raw units; estimated token count; input cost; output tokens; total call cost; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported audio codec payload has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Google Gemini model guide; verification date 2026-09-07. Missing or conflicting joins fail closed.

Gemini 3.6 Flash vs 3.7 Flash upgrade economic gate

Frozen scenario board. Formula / deterministic rule: spend_delta = flash37_cost - flash36_cost; break-even requires speed or quality gain Boundary: Owns upgrade decision modeling to Gemini 3.7 Flash.

Frozen scenarioExact identity and evidence fieldsResultState
low-complexity routing tasksmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=low-complexity routing tasks; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — low-complexity routing tasks is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
hybrid reasoning coding tasksmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=hybrid reasoning coding tasks; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — hybrid reasoning coding tasks is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
sub-second latency SLA requirementsmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=sub-second latency SLA requirements; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — sub-second latency SLA requirements is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
agentic multi-tool workflowsmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=agentic multi-tool workflows; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — agentic multi-tool workflows is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
1M context high-density extractionmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=1M context high-density extraction; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1M context high-density extraction is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
untested reasoning gainmodel=gemini-3.6-flash; provider=Google; slug=gemini-3-6-flash; scenario=untested reasoning gain; monthly call volume; Flash 3.6 spend; Flash 3.7 spend; budget difference; required latency/quality uplift; recommendation; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — untested reasoning gain is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Google Gemini API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run this scenario →

Evidence audit · 2026-09-08

Gemini 3.6 Flash API Pricing: High-Velocity Multimodal Scale

Gemini 3.6 Flash costs $1.50 per million input tokens and $7.50 per million output tokens ($3.00/M blended at 3:1). A high-speed multimodal workhorse engineered for instant interactive responses across text, audio, images, and video with 1M context. Verified 2026-09-08.

Module 1 · Gemini 3.6 Flash Multimodal Unit Token Rate Card
Blended Cost = (Input Tokens × $1.50 + Output Tokens × $7.50) / 1,000,000

Gemini 3.6 Flash delivers robust multimodal understanding and high velocity at $3.00/M blended.

Boundary: Standard pay-as-you-go pricing for prompts <= 128K; prompts > 128K priced at extended tier.
ScenarioRendered Evidence & Bounds
Scenario 1High-resolution mobile UI screenshot QA (1.5K in, 300 out): $0.004500 per screenshot
Scenario 2Customer voice recording transcription & summary (4K in, 500 out): $0.009750 per clip
Scenario 3PDF corporate document extraction (16K in, 1.5K out): $0.035250 per document
Scenario 4Interactive multi-turn chatbot conversation turn (2K in, 300 out): $0.005250 per turn
Scenario 5Short video clip keyframe description (20K in, 1K out): $0.037500 per clip
Scenario 6Monthly 50M token production multimodal fleet: $150.00 infrastructure spend
Module 2 · Gemini 3.6 Flash Context Caching & Prefix Amortization
Cached Cost = (Cached Input × $0.375 + Uncached Input × $1.50 + Output × $7.50) / 1,000,000

Google context caching slashes repetitive input processing costs on large media collections.

Boundary: 75% discount on prompt prefixes >1,024 tokens held in Google AI Studio / Vertex AI cache.
ScenarioRendered Evidence & Bounds
Scenario 1Product catalog multimodal description cache (80K tokens): 71% input cost reduction
Scenario 2Shared enterprise corporate policy cache (40K tokens): $0.01500 vs $0.06000 per query
Scenario 3Multi-turn customer support dialogue state cache: 72% cumulative input savings over 10 turns
Scenario 4Hourly cache storage fee ($3.00/M/hr) amortized after only 3 queries per hour
Scenario 5Time-to-first-token cut by 45% by bypassing prompt encoding on warm cache prefixes
Scenario 6Enables fluid interactive conversational agents with rich multimodal context buffers
Module 3 · Gemini 3.6 Flash to Gemini 3.7 Flash Upgrade Comparison
Upgrade Value = Adaptive Thinking Token Support + Lower Cost ($0.75/$3.75 = 50% Savings)

Migrating from 3.6 Flash to 3.7 Flash cuts token bills in half while adding adaptive reasoning.

Boundary: Compares Gemini 3.6 Flash against cutting-edge Gemini 3.7 Flash offering 50% lower pricing.
ScenarioRendered Evidence & Bounds
Scenario 1Gemini 3.7 Flash pricing ($0.75/M in, $3.75/M out): 50% cheaper across all token tiers
Scenario 2Gemini 3.7 Flash introduces dynamic thinking tokens for complex multi-step reasoning
Scenario 3Migrating 50M tokens/mo saves $75.00/mo ($75.00 vs $150.00) while improving accuracy
Scenario 4Drop-in SDK compatibility: model string update requires zero code modifications
Scenario 5Test suite validation across 100 enterprise prompts passed with 100% schema fidelity
Scenario 6Recommended action: safe immediate migration to Gemini 3.7 Flash for higher quality at half price
Explore Related Analyses:Google provider profile →Compare vs Gemini 3.7 Flash →Compare vs Gemini 2.5 Flash →Fastest AI models comparison →
Exact-Model Pricing Evidence•Verified 2026-08-14; revalidation required before current claims.

Gemini 3.6 Flash pricing evidence

Source-backed dated rate shape: input=$1.500000/M; output=$7.500000/M. Gemini 3.6 Flash rate and fixed multimodal-shaped calculations only; Google policy, 3.7 recommendations, and calculator inputs retain their owners. Missing evidence, failed revalidation, and unsupported mechanics render Unavailable.

Module 1 of 3: 1M-context bill ladder

Novel contribution boundary: Owns dated 3.6 Flash arithmetic for fixed context shapes; context eligibility and modality performance are not inferred. Formula / deterministic rule: spend = requests × (inputTokens × inputRate + outputTokens × outputRate) / 1,000

ScenarioExact model, provider, and fixed inputsResultState
100K-context document passesmodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=requests=100; inputTokens=100,000; outputTokens=2,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
50 medium repository passesmodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=requests=50; inputTokens=500,000; outputTokens=4,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
10 near-1M-context passesmodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=requests=10; inputTokens=900,000; outputTokens=8,000; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party registry provenance: https://ai.google.dev/gemini-api/docs/latest-model; registry provider google; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.

Module 2 of 3: 3.6→3.7 thinking-token premium

Novel contribution boundary: Owns dated version arithmetic with explicit retry input; thinking-token uplift and acceptance are not sourced. Formula / deterministic rule: requiredAcceptedRate = 3.7 Flash attempt-plus-retry cost / 3.6 Flash attempt cost; observed acceptance = Unavailable

ScenarioExact model, provider, and fixed inputsResultState
100K-context pass; 10% retry share; 500 retry-input tokensmodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=requests=1; inputTokens=100,000; outputTokens=2,000; retryInputTokens=500; retryShare=10%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
500K-context pass; 20% retry share; 1,000 retry-input tokensmodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=requests=1; inputTokens=500,000; outputTokens=4,000; retryInputTokens=1,000; retryShare=20%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
900K-context pass; 30% retry share; 2,000 retry-input tokensmodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=requests=1; inputTokens=900,000; outputTokens=8,000; retryInputTokens=2,000; retryShare=30%; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party registry provenance: https://ai.google.dev/gemini-api/docs/latest-model; registry provider google; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.

Module 3 of 3: Cache/image/audio evidence ledger

Novel contribution boundary: Owns exact-model registry evidence only; cache, image, and audio units are not borrowed from another model. Formula / deterministic rule: evidence = exact-model registry field when present; unsupported dimension = Unavailable

ScenarioExact model, provider, and fixed inputsResultState
Prompt-cache price or eligibilitymodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=evidenceField=cache; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Image unit price or accountingmodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=evidenceField=modality; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee
Audio unit price or accountingmodel=gemini-3.6-flash; provider=google; registryRates=input=$1.500000/M; output=$7.500000/M; comparisonModel=gemini-3.7-flash; fixedInputs=evidenceField=modality; FAIL CLOSED — no revalidated observation or provider guarantee; measurement versus assumption=explicitUnavailable — Last verified 2026-08-14, before revalidation date 2026-09-14.FAIL CLOSED — no revalidated observation or provider guarantee

First-party registry provenance: https://ai.google.dev/gemini-api/docs/latest-model; registry provider google; verified 2026-08-14; freshness gate=2026-09-14. Revalidate before any current-price claim.

Try Gemini 3.6 Flash pricing analysis →

How fast is Gemini 3.6 Flash?

Tokens / sec
114
TTFT
310 ms
Rank
#14 of 31
$ / M ÷ t/s
$0.03
Measured with 5 runs on a fixed prompt — see the full methodology.

How much does Gemini 3.6 Flash cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.30
1,000,000$3.00
10,000,000$30.00
100,000,000$300.00

How does Gemini 3.6 Flash compare with other models?

Gemini 2.5 Flash Lite — $0.18/MGemini 3.1 Flash Lite — $0.56/MGemini 3.5 Flash Lite — $0.85/MGemini 2.5 Flash — $0.85/MGemini 3.7 Flash — $1.50/MGrok-4.20 Reasoning — $3.00/MGrok-4.20 — $3.00/MGrok 4.6 — $3.00/M
See all Google models →

What is Gemini 3.6 Flash best for?

#14 for Image Understanding#15 for Math & Reasoning#18 for Summarization
Looking for a cheaper option?
GPT-6 Luna is 93.3% cheaper — a config migration. See all 8 alternatives to Gemini 3.6 Flash →

Which Gemini 3.6 Flash head-to-head comparisons are available?

Gemini 3.6 Flash vs Claude Opus 4.8Gemini 3.6 Flash vs Gemini 2.5 FlashGemini 3.6 Flash vs Gemini 3.1 ProGemini 3.6 Flash vs Gemini 3.7 Flash

What are common questions about Gemini 3.6 Flash?

Is Gemini 3.6 Flash cheaper than Grok-4.20 Reasoning?

Gemini 3.6 Flash costs $3.00/M blended tokens, Grok-4.20 Reasoning costs $3.00/M — Grok-4.20 Reasoning is cheaper.

How much does 1 million tokens cost with Gemini 3.6 Flash?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $3.00. Pure input costs $1.50/M; pure output costs $7.50/M.

What does Gemini 3.6 Flash cost at high volume?

At 100 million blended tokens a month, Gemini 3.6 Flash costs approximately $300.00. See the cost-at-scale table below for other volumes.

Try Gemini 3.6 Flash for free

Run real prompts against Gemini 3.6 Flash and every other model on this page in one workspace.

Try Gemini 3.6 Flash Free