Claude Fable 5$22.000/MClaude Opus 5$11.000/MClaude Opus 4.8$11.000/MClaude Opus 4.7$11.000/MClaude Opus 4.6$11.000/MClaude Opus 4.5$33.000/MClaude Sonnet 3.7$6.600/MClaude Opus 3$33.000/MClaude 2.1$12.800/MClaude 2$12.800/MGPT-5.6 Sol$12.500/MGPT-5.6 Terra$5.000/MGPT-5.5$12.500/MGPT-5.2$5.425/MGPT-5.2-Codex$5.425/MGPT-5$3.875/MGPT-4.5$97.500/MGPT-4 Turbo Preview$16.000/MGPT-4$39.000/MGPT-4-32k$78.000/Mo3$19.000/Mo3-mini$2.090/Mo4-mini$2.090/Mo1$28.500/Mo1-mini$5.700/Mo1-preview$28.500/MGemini 3.5 Pro$5.000/MGemini 3.1 Pro$5.000/MGemini 3 Pro$5.000/MGemini 2.5 Pro$3.875/MClaude Fable 5$22.000/MClaude Opus 5$11.000/MClaude Opus 4.8$11.000/MClaude Opus 4.7$11.000/MClaude Opus 4.6$11.000/MClaude Opus 4.5$33.000/MClaude Sonnet 3.7$6.600/MClaude Opus 3$33.000/MClaude 2.1$12.800/MClaude 2$12.800/MGPT-5.6 Sol$12.500/MGPT-5.6 Terra$5.000/MGPT-5.5$12.500/MGPT-5.2$5.425/MGPT-5.2-Codex$5.425/MGPT-5$3.875/MGPT-4.5$97.500/MGPT-4 Turbo Preview$16.000/MGPT-4$39.000/MGPT-4-32k$78.000/Mo3$19.000/Mo3-mini$2.090/Mo4-mini$2.090/Mo1$28.500/Mo1-mini$5.700/Mo1-preview$28.500/MGemini 3.5 Pro$5.000/MGemini 3.1 Pro$5.000/MGemini 3 Pro$5.000/MGemini 2.5 Pro$3.875/M
Qwen
Qwen
Frontier

Qwen2.5-Max

Flagship

Alibaba's closed-weights flagship. Frontier-quality MoE that competes with Claude / GPT on Chinese benchmarks at competitive pricing.

Qwen2.5-Max is a frontier AI model from Qwen. It costs $1.600 per million input tokens and $6.400 per million output tokens (blended $3.040/M), with a 32,000-token context window.

INPUT
$1.600/M
per million input tokens
OUTPUT
$6.400/M
per million output tokens
BLENDED 70/30
$3.040/M
unchanged since 3 May
CONTEXT
32,000
tokens
What it is good at
  • Frontier on Chinese benchmarks
  • MoE inference economics
  • Strong tool use
  • Multilingual
Typical use cases
  • Chinese-first production chat
  • Multilingual agents
  • Cost-sensitive frontier traffic

Benchmarks

vs. best public score
MMLU87%
Multitask academic knowledge across 57 subjects.
Graduate-level science questions, "Google-proof".
MATH85%
High-school competition math problems.
Python function synthesis from docstrings.
LMArena Elo1296 Elo
Crowd-sourced head-to-head preference Elo rating.
Hand-curated from each provider's published reports and public leaderboards. Methodology varies across sources, treat as directional rather than authoritative.

More from Qwen

See all 22

Frequently asked questions

How much does Qwen2.5-Max cost?

Qwen2.5-Max costs $1.600 per million input tokens and $6.400 per million output tokens, for a blended reference rate of $3.040 per million tokens.

What is Qwen2.5-Max's context window?

Qwen2.5-Max supports up to 32,000 tokens of context in a single request.

What is Qwen2.5-Max best for?

Qwen2.5-Max is well suited to Frontier on Chinese benchmarks, MoE inference economics and Strong tool use.

Who makes Qwen2.5-Max?

Qwen2.5-Max is developed and served by Qwen. It was released in Jan 2025.

Compared with

Terms used on this page