Claude Fable 5$22.000/MClaude Opus 5$11.000/MClaude Opus 4.8$11.000/MClaude Opus 4.7$11.000/MClaude Opus 4.6$11.000/MClaude Opus 4.5$33.000/MClaude Sonnet 3.7$6.600/MClaude Opus 3$33.000/MClaude 2.1$12.800/MClaude 2$12.800/MGPT-5.6 Sol$12.500/MGPT-5.6 Terra$5.000/MGPT-5.5$12.500/MGPT-5.2$5.425/MGPT-5.2-Codex$5.425/MGPT-5$3.875/MGPT-4.5$97.500/MGPT-4 Turbo Preview$16.000/MGPT-4$39.000/MGPT-4-32k$78.000/Mo3$19.000/Mo3-mini$2.090/Mo4-mini$2.090/Mo1$28.500/Mo1-mini$5.700/Mo1-preview$28.500/MGemini 3.5 Pro$5.000/MGemini 3.1 Pro$5.000/MGemini 3 Pro$5.000/MGemini 2.5 Pro$3.875/MClaude Fable 5$22.000/MClaude Opus 5$11.000/MClaude Opus 4.8$11.000/MClaude Opus 4.7$11.000/MClaude Opus 4.6$11.000/MClaude Opus 4.5$33.000/MClaude Sonnet 3.7$6.600/MClaude Opus 3$33.000/MClaude 2.1$12.800/MClaude 2$12.800/MGPT-5.6 Sol$12.500/MGPT-5.6 Terra$5.000/MGPT-5.5$12.500/MGPT-5.2$5.425/MGPT-5.2-Codex$5.425/MGPT-5$3.875/MGPT-4.5$97.500/MGPT-4 Turbo Preview$16.000/MGPT-4$39.000/MGPT-4-32k$78.000/Mo3$19.000/Mo3-mini$2.090/Mo4-mini$2.090/Mo1$28.500/Mo1-mini$5.700/Mo1-preview$28.500/MGemini 3.5 Pro$5.000/MGemini 3.1 Pro$5.000/MGemini 3 Pro$5.000/MGemini 2.5 Pro$3.875/M
Qwen
Qwen
Multimodal

Qwen2-VL-72B

Vision Large

Qwen2 vision-language flagship. Strong on document understanding, chart QA, and agentic UI tasks.

Qwen2-VL-72B is a multimodal AI model from Qwen. It costs $2.000 per million input tokens and $2.000 per million output tokens (blended $2.000/M), with a 32,000-token context window.

INPUT
$2.000/M
per million input tokens
OUTPUT
$2.000/M
per million output tokens
BLENDED 70/30
$2.000/M
unchanged since 3 May
CONTEXT
32,000
tokens
What it is good at
  • Strong vision
  • Document understanding
  • Open weights
  • Long-video support
Typical use cases
  • Self-hosted vision QA
  • Document parsing
  • UI agents

Benchmarks

vs. best public score
MMLU84%
Multitask academic knowledge across 57 subjects.
Python function synthesis from docstrings.
LMArena Elo1196 Elo
Crowd-sourced head-to-head preference Elo rating.
Hand-curated from each provider's published reports and public leaderboards. Methodology varies across sources, treat as directional rather than authoritative.

More from Qwen

See all 22

Frequently asked questions

How much does Qwen2-VL-72B cost?

Qwen2-VL-72B costs $2.000 per million input tokens and $2.000 per million output tokens, for a blended reference rate of $2.000 per million tokens.

What is Qwen2-VL-72B's context window?

Qwen2-VL-72B supports up to 32,000 tokens of context in a single request.

What is Qwen2-VL-72B best for?

Qwen2-VL-72B is well suited to Strong vision, Document understanding and Open weights.

Who makes Qwen2-VL-72B?

Qwen2-VL-72B is developed and served by Qwen. It was released in Aug 2024.

Terms used on this page