Compare · ModelsLive · 2 picked · head to head
gpt-oss-120b vs Qwen3 32B
Side by side · benchmarks, pricing, and signals you can act on.
Winner summary
gpt-oss-120b wins on 2/2 benchmarks
gpt-oss-120b wins 2 of 2 shared benchmarks. Leads in coding · arena.
Category leads
coding·gpt-oss-120barena·gpt-oss-120b
Hype vs Reality
Attention vs performance
gpt-oss-120b
#137 by perf·no signal
Qwen3 32B
#66 by perf·no signal
Best value
gpt-oss-120b
1.3x better value than Qwen3 32B
gpt-oss-120b
434.3 pts/$
$0.11/M
Qwen3 32B
323.3 pts/$
$0.18/M
Vendor risk
Who is behind the model
OpenAI
$840.0B·Tier 1
Alibaba (Qwen)
$293.0B·Tier 1
Head to head
2 benchmarks · 2 models
gpt-oss-120bQwen3 32B
Aider polyglot
gpt-oss-120b leads by +1.8
Aider Polyglot · measures how well AI models can edit code across multiple programming languages using the Aider coding assistant framework.
gpt-oss-120b
41.8
Qwen3 32B
40.0
Chatbot Arena Elo · Overall
gpt-oss-120b leads by +5.4
gpt-oss-120b
1352.7
Qwen3 32B
1347.3
Full benchmark table
| Benchmark | gpt-oss-120b | Qwen3 32B |
|---|---|---|
Aider polyglot Aider Polyglot · measures how well AI models can edit code across multiple programming languages using the Aider coding assistant framework. | 41.8 | 40.0 |
Chatbot Arena Elo · Overall | 1352.7 | 1347.3 |
Pricing · per 1M tokens · projected $/mo at 10M tokens
| Model | Input | Output | Context | Projected $/mo |
|---|---|---|---|---|
| $0.04 | $0.18 | 131K tokens (~66 books) | $0.72 | |
| $0.08 | $0.28 | 131K tokens (~66 books) | $1.30 |