Benchmark · KnowledgeSettled

HELM · Omni-MATH

Updated 2026-01-21
Models tested
38
Top score
72.2
GPT-5 Mini
Median
44.1
min 22.4
Top-5 spread
σ 2.6
Competitive

Best score over time · one chart, every benchmark

HELM · OMNI-MATH26 MODELS · FRONTIER RUNNING MAX0255075100SCORE ↑Nov 24Mar 25Jun 25Oct 25Jan 26RELEASE DATE →benchgecko.ai/benchmark/helm-omni-math · frontier
Frontier on HELM · Omni-MATH rose from 28.1 to 72.2 in 9 months · +44.1 points · latest leader GPT-5 Mini from OpenAI.
Pink dots = frontier records · 10 totalClick to open model page

Same category · related evaluations