Benchmark · KnowledgeSettled

Professional Reasoning · Finance

Updated 2026-04-07
Models tested
5
Top score
53.3
Claude Opus 4.6 (Fast)
Median
51.1
min 47.7
Top-5 spread
σ 1.9
Settled

Best score over time · one chart, every benchmark

PROFESSIONAL REASONING · FINANCE5 MODELS · FRONTIER RUNNING MAX0255075100SCORE ↑Apr 25Jul 25Oct 25Jan 26Apr 26RELEASE DATE →benchgecko.ai/benchmark/seal-pro-reasoning-finance · frontier
Frontier on Professional Reasoning · Finance rose from 47.7 to 53.3 in 12 months · +5.6 points · latest leader Claude Opus 4.6 (Fast) from Anthropic.
Pink dots = frontier records · 4 totalClick to open model page

5 models tested · sorted by score

#ModelScore
1Anthropic logoClaude Opus 4.6 (Fast)53.3
2OpenAI logoGPT-551.3
3OpenAI logoGPT-5 Pro51.1
4OpenAI logoo3 Pro49.1
5OpenAI logoo347.7

Same category · related evaluations