Claude Fable 5$22.000/MClaude Opus 5$11.000/MClaude Opus 4.8$11.000/MClaude Opus 4.7$11.000/MClaude Opus 4.6$11.000/MClaude Opus 4.5$33.000/MClaude Sonnet 3.7$6.600/MClaude Opus 3$33.000/MClaude 2.1$12.800/MClaude 2$12.800/MGPT-5.6 Sol$12.500/MGPT-5.6 Terra$5.000/MGPT-5.5$12.500/MGPT-5.2$5.425/MGPT-5.2-Codex$5.425/MGPT-5$3.875/MGPT-4.5$97.500/MGPT-4 Turbo Preview$16.000/MGPT-4$39.000/MGPT-4-32k$78.000/Mo3$19.000/Mo3-mini$2.090/Mo4-mini$2.090/Mo1$28.500/Mo1-mini$5.700/Mo1-preview$28.500/MGemini 3.5 Pro$5.000/MGemini 3.1 Pro$5.000/MGemini 3 Pro$5.000/MGemini 2.5 Pro$3.875/MClaude Fable 5$22.000/MClaude Opus 5$11.000/MClaude Opus 4.8$11.000/MClaude Opus 4.7$11.000/MClaude Opus 4.6$11.000/MClaude Opus 4.5$33.000/MClaude Sonnet 3.7$6.600/MClaude Opus 3$33.000/MClaude 2.1$12.800/MClaude 2$12.800/MGPT-5.6 Sol$12.500/MGPT-5.6 Terra$5.000/MGPT-5.5$12.500/MGPT-5.2$5.425/MGPT-5.2-Codex$5.425/MGPT-5$3.875/MGPT-4.5$97.500/MGPT-4 Turbo Preview$16.000/MGPT-4$39.000/MGPT-4-32k$78.000/Mo3$19.000/Mo3-mini$2.090/Mo4-mini$2.090/Mo1$28.500/Mo1-mini$5.700/Mo1-preview$28.500/MGemini 3.5 Pro$5.000/MGemini 3.1 Pro$5.000/MGemini 3 Pro$5.000/MGemini 2.5 Pro$3.875/M
Google
Google
Multimodal

Gemini 3.5 Flash

Balanced

The Flash tier of the Gemini 3.5 generation, a fast, multimodal workhorse with a 1M-token context window. It has since been succeeded by Gemini 3.6 Flash, which does the same job using fewer tokens, so 3.5 Flash is mainly of interest to workloads already tuned against it.

Gemini 3.5 Flash is a multimodal AI model from Google. It costs $1.500 per million input tokens and $9.000 per million output tokens (blended $3.750/M), with a 1,000,000-token context window.

INPUT
$1.500/M
per million input tokens
OUTPUT
$9.000/M
per million output tokens
BLENDED 70/30
$3.750/M
unchanged since 3 May
CONTEXT
1,000,000
tokens
What it is good at
  • Fast multimodal inference
  • 1M-token context
  • Audio and video input
  • Established behaviour for existing pipelines
Typical use cases
  • Pipelines already tuned to 3.5 Flash
  • Multimodal extraction
  • High-throughput classification

Benchmarks

No published benchmark scores tracked for this model yet. Frontier and reasoning models from major providers have scores; smaller models and inference-host variants typically inherit the underlying open-weights score.

More from Google

See all 24

Frequently asked questions

How much does Gemini 3.5 Flash cost?

Gemini 3.5 Flash costs $1.500 per million input tokens and $9.000 per million output tokens, for a blended reference rate of $3.750 per million tokens.

What is Gemini 3.5 Flash's context window?

Gemini 3.5 Flash supports up to 1,000,000 tokens of context in a single request.

What is Gemini 3.5 Flash best for?

Gemini 3.5 Flash is well suited to Fast multimodal inference, 1M-token context and Audio and video input.

Who makes Gemini 3.5 Flash?

Gemini 3.5 Flash is developed and served by Google.

Compared with

Terms used on this page