Claude Fable 5$22.000/MClaude Opus 5$11.000/MClaude Opus 4.8$11.000/MClaude Opus 4.7$11.000/MClaude Opus 4.6$11.000/MClaude Opus 4.5$33.000/MClaude Sonnet 3.7$6.600/MClaude Opus 3$33.000/MClaude 2.1$12.800/MClaude 2$12.800/MGPT-5.6 Sol$12.500/MGPT-5.6 Terra$5.000/MGPT-5.5$12.500/MGPT-5.2$5.425/MGPT-5.2-Codex$5.425/MGPT-5$3.875/MGPT-4.5$97.500/MGPT-4 Turbo Preview$16.000/MGPT-4$39.000/MGPT-4-32k$78.000/Mo3$19.000/Mo3-mini$2.090/Mo4-mini$2.090/Mo1$28.500/Mo1-mini$5.700/Mo1-preview$28.500/MGemini 3.5 Pro$5.000/MGemini 3.1 Pro$5.000/MGemini 3 Pro$5.000/MGemini 2.5 Pro$3.875/MClaude Fable 5$22.000/MClaude Opus 5$11.000/MClaude Opus 4.8$11.000/MClaude Opus 4.7$11.000/MClaude Opus 4.6$11.000/MClaude Opus 4.5$33.000/MClaude Sonnet 3.7$6.600/MClaude Opus 3$33.000/MClaude 2.1$12.800/MClaude 2$12.800/MGPT-5.6 Sol$12.500/MGPT-5.6 Terra$5.000/MGPT-5.5$12.500/MGPT-5.2$5.425/MGPT-5.2-Codex$5.425/MGPT-5$3.875/MGPT-4.5$97.500/MGPT-4 Turbo Preview$16.000/MGPT-4$39.000/MGPT-4-32k$78.000/Mo3$19.000/Mo3-mini$2.090/Mo4-mini$2.090/Mo1$28.500/Mo1-mini$5.700/Mo1-preview$28.500/MGemini 3.5 Pro$5.000/MGemini 3.1 Pro$5.000/MGemini 3 Pro$5.000/MGemini 2.5 Pro$3.875/M
Qwen
Qwen
Frontier

Qwen2-57B-A14B

MoE

Qwen2 MoE, 57B total / 14B active. Cheap-to-serve MoE before Qwen2.5 closed the gap.

Qwen2-57B-A14B is a frontier AI model from Qwen. It costs $0.650 per million input tokens and $0.650 per million output tokens (blended $0.650/M), with a 64,000-token context window.

INPUT
$0.650/M
per million input tokens
OUTPUT
$0.650/M
per million output tokens
BLENDED 70/30
$0.650/M
unchanged since 3 May
CONTEXT
64,000
tokens
What it is good at
  • MoE efficiency
  • Open weights
  • Multilingual
Typical use cases
  • Cost-sensitive self-hosted chat
  • MoE research

Benchmarks

vs. best public score
MMLU75%
Multitask academic knowledge across 57 subjects.
Graduate-level science questions, "Google-proof".
MATH49%
High-school competition math problems.
Python function synthesis from docstrings.
Hand-curated from each provider's published reports and public leaderboards. Methodology varies across sources, treat as directional rather than authoritative.

More from Qwen

See all 22

Frequently asked questions

How much does Qwen2-57B-A14B cost?

Qwen2-57B-A14B costs $0.650 per million input tokens and $0.650 per million output tokens, for a blended reference rate of $0.650 per million tokens.

What is Qwen2-57B-A14B's context window?

Qwen2-57B-A14B supports up to 64,000 tokens of context in a single request.

What is Qwen2-57B-A14B best for?

Qwen2-57B-A14B is well suited to MoE efficiency, Open weights and Multilingual.

Who makes Qwen2-57B-A14B?

Qwen2-57B-A14B is developed and served by Qwen. It was released in Jun 2024.

Terms used on this page