Benchmark · ReasoningSettled

ARC-AGI-2

ARC-AGI-2 · the second iteration of the Abstraction and Reasoning Corpus, testing novel pattern recognition and abstract reasoning without prior training data.

Updated 2026-09-22
Models tested
67
Top score
95.0
GPT-6 Astra
Median
16.0
min 0.1
Top-5 spread
σ 1.8
Settled

Best score over time · one chart, every benchmark

ARC-AGI-256 MODELS · FRONTIER RUNNING MAX0255075100SCORE ↑Jan 25Jun 25Nov 25Apr 26Sep 26RELEASE DATE →benchgecko.ai/benchmark/arc-agi-2 · frontier
Frontier on ARC-AGI-2 rose from 1.3 to 95.0 in 20 months · +93.7 points · latest leader GPT-6 Astra from OpenAI.
Pink dots = frontier records · 16 totalClick to open model page

67 models tested · sorted by score

#ModelScore
1OpenAI logoGPT-6 Astra95.0
2Anthropic logoClaude Opus 5.592.5
3OpenAI logoGPT-5.6 Sol92.5
4Anthropic logoClaude Opus 590.4
5Anthropic logoClaude Fable 5.190.0
6Anthropic logoClaude Fable 589.2
7Google DeepMind logoGemini 3.7 Flash84.6
8OpenAI logoGPT-5.6 Terra83.9
9OpenAI logoGPT-5.4 Pro83.3
10Google DeepMind logoGemini 3.1 Pro Preview77.1
11Anthropic logoClaude Opus 4.775.8
12OpenAI logoGPT-5.474.0
13Anthropic logoClaude Opus 4.872.1
14Google DeepMind logoGemini 3.5 Flash72.1
15Anthropic logoClaude Opus 4.669.2
16xAI logoGrok 4.667.1
17xAI logoGrok 4.2065.1
18DeepSeek logoDeepSeek V4 Flash 073161.4
19DeepSeek logoDeepSeek V4 Pro 081361.3
20Anthropic logoClaude Sonnet 4.660.4
21Google DeepMind logoGemini 3.6 Flash60.4
22moonshotai logoKimi K360.4
23OpenAI logoGPT-5.6 Luna59.5
24OpenAI logoGPT-5.2 Pro54.2
25OpenAI logoGPT-5.252.9
26xAI logoGrok 4.552.6
27Anthropic logoClaude Opus 4.537.6
28Google DeepMind logoGemini 3 Flash Preview33.6
29Google DeepMind logoGemini 3 Pro31.1
30z-ai logoGLM 5.222.8
31OpenAI logoGPT-5.4 Mini18.9
32OpenAI logoGPT-5 Pro18.3
33OpenAI logoGPT-5.117.6
34xAI logoGrok 416.0
35Anthropic logoClaude Sonnet 4.513.6
36moonshotai logoKimi K2.511.8
37Google DeepMind logoGemini 3.5 Flash Lite10.3
38OpenAI logoGPT-59.9
39Anthropic logoClaude Opus 48.6
40OpenAI logoo36.5
41OpenAI logoo4 Mini6.1
42Anthropic logoClaude Sonnet 45.9
43OpenAI logoGPT-5.4 Nano5.7
44xAI logoGrok 4 Fast5.3
45Google DeepMind logoGemini 2.5 Pro4.9
46z-ai logoGLM 54.9
47minimax logoMiniMax M2.54.9
48OpenAI logoo3 Pro4.9
49OpenAI logoGPT-5 Mini4.4
50Anthropic logoClaude Haiku 4.54.0
51DeepSeek logoDeepSeek V3.24.0
52OpenAI logoo3 Mini3.0
53OpenAI logoGPT-5 Nano2.6
54Google DeepMind logoGemini 2.5 Flash2.5
55Google DeepMind logoGemini 2.0 Flash1.3
56Google DeepMind logoGemini 2.0 Flash (Dec 2024)1.3
57DeepSeek logoR11.3
58Alibaba Qwen logoQwen3 235B A22B Instruct 25071.3
59DeepSeek logoR1 05281.1
60Anthropic logoClaude 3.7 Sonnet0.9
61OpenAI logoo1-mini0.8
62Google DeepMind logoGemini 1.5 Pro (Feb 2024)0.8
63Google DeepMind logoGemini 1.5 Pro (May 2024)0.8
64OpenAI logoGPT-4.50.8
65OpenAI logoGPT-4.10.4
66xAI logoGrok-3 mini0.4
67OpenAI logoGPT-4o-mini (2024-07-18)0.1

Same category · related evaluations