Benchmark · KnowledgeSettled

Professional Reasoning · Finance

Updated 2026-04-07
Models tested
6
Top score
53.3
Claude Opus 4.6
Median
51.2
min 47.7
Top-5 spread
σ 1.6
Settled

Best score over time · one chart, every benchmark

PROFESSIONAL REASONING · FINANCE6 MODELS · FRONTIER RUNNING MAX0255075100SCORE ↑Apr 25Jul 25Oct 25Jan 26Apr 26RELEASE DATE →benchgecko.ai/benchmark/seal-pro-reasoning-finance · frontier
Frontier on Professional Reasoning · Finance rose from 47.7 to 53.3 in 10 months · +5.6 points · latest leader Claude Opus 4.6 from Anthropic.
Pink dots = frontier records · 4 totalClick to open model page

6 models tested · sorted by score

#ModelScore
1Anthropic logoClaude Opus 4.653.3
2Anthropic logoClaude Opus 4.6 (Fast)53.3
3OpenAI logoGPT-551.3
4OpenAI logoGPT-5 Pro51.1
5OpenAI logoo3 Pro49.1
6OpenAI logoo347.7

Same category · related evaluations