Compare · ModelsLive · 2 picked · head to head
Qwen2.5 0.5B Instruct vs Gpt2
Side by side · benchmarks, pricing, and signals you can act on.
Winner summary
Qwen2.5 0.5B Instruct wins on 5/6 benchmarks
Qwen2.5 0.5B Instruct wins 5 of 6 shared benchmarks. Leads in general · knowledge · language.
Category leads
general·Qwen2.5 0.5B Instructknowledge·Qwen2.5 0.5B Instructlanguage·Qwen2.5 0.5B Instructmath·Qwen2.5 0.5B Instructreasoning·Gpt2
Hype vs Reality
Attention vs performance
Qwen2.5 0.5B Instruct
#270 by perf·no signal
Gpt2
#274 by perf·no signal
Vendor risk
Who is behind the model
Alibaba (Qwen)
$293.0B·Tier 1
OpenAI
$840.0B·Tier 1
Head to head
6 benchmarks · 2 models
Qwen2.5 0.5B InstructGpt2
BBH (HuggingFace)
Qwen2.5 0.5B Instruct leads by +5.5
Qwen2.5 0.5B Instruct
8.2
Gpt2
2.7
GPQA
Qwen2.5 0.5B Instruct leads by +0.1
Qwen2.5 0.5B Instruct
1.2
Gpt2
1.1
IFEval
Qwen2.5 0.5B Instruct leads by +13.6
Qwen2.5 0.5B Instruct
31.5
Gpt2
17.9
MATH Level 5
Qwen2.5 0.5B Instruct leads by +10.1
Qwen2.5 0.5B Instruct
10.3
Gpt2
0.2
MMLU-PRO
Qwen2.5 0.5B Instruct leads by +6.2
Qwen2.5 0.5B Instruct
8.0
Gpt2
1.8
MUSR
Gpt2 leads by +14.0
Qwen2.5 0.5B Instruct
1.4
Gpt2
15.3
Full benchmark table
| Benchmark | Qwen2.5 0.5B Instruct | Gpt2 |
|---|---|---|
BBH (HuggingFace) | 8.2 | 2.7 |
GPQA | 1.2 | 1.1 |
IFEval | 31.5 | 17.9 |
MATH Level 5 | 10.3 | 0.2 |
MMLU-PRO | 8.0 | 1.8 |
MUSR | 1.4 | 15.3 |
Pricing · per 1M tokens · projected $/mo at 10M tokens
| Model | Input | Output | Context | Projected $/mo |
|---|---|---|---|---|
| — | — | — | — | |
| — | — | — | — |