BenchLeader

ARC-AGI-3

Semi-private ARC-AGI-3 interactive evaluation set.

Published by
ARC Prize
Category
Reasoning
Index weight
0.5
Models
39
Data as of
9 Sept 2026

ARC Prize Foundation, arcprize.org.

39 of 39
#
1GPT 6 Astra Provider AdapterOpenAI99.9%
2GPT 6 Astra Provider AdapterOpenAI98.6%
3GPT 6 Astra Provider AdapterOpenAI98.4%
4GPT 6 Astra Provider AdapterOpenAI98.4%
5GPT 6 Astra Provider AdapterOpenAI98.0%
6GPT 6 Astra Provider AdapterOpenAI96.7%
7GPT-6 AstraOpenAI62.7%70.6
8GPT-6 AstraOpenAI59.3%68.6
9GPT-6 AstraOpenAI54.8%69.5
10GPT-6 AstraOpenAI38.6%67.4
11GPT-6 AstraOpenAI35.2%64.4
12Claude Opus 5Anthropic30.2%69.3
13GPT-6 AstraOpenAI17.5%65.8
14GPT-5.6 SolOpenAI7.8%65.5
15GPT-5.6 SolOpenAI7.0%67.5
16GPT-5.6 SolOpenAI2.2%68.0
17Grok 4.6xAI2.1%62.3
18Claude Opus 4.8Anthropic1.5%61.3
19GPT-5.6 SolOpenAI1.1%66.0
20GPT-5.6 TerraOpenAI0.8%58.0
21GPT-5.6 TerraOpenAI0.7%64.2
22GPT-5.6 TerraOpenAI0.5%63.1
23Claude Opus 4.6Anthropic0.5%54.1
24GPT-5.5OpenAI0.4%66.3
25Gemini 3.1 ProGoogle0.4%63.9
26GPT-5.6 SolOpenAI0.3%64.6
27Grok 4.5xAI0.3%54.2
28Grok 4.5xAI0.3%
29Grok 4.5xAI0.3%
30Claude Opus 4.7Anthropic0.2%61.3
31GPT-5.4OpenAI0.2%58.8
32GPT-5.6 LunaOpenAI0.2%56.5
33GPT-5.6 LunaOpenAI0.2%54.4
34GPT-5.6 LunaOpenAI0.2%53.6
35GPT-5.6 LunaOpenAI0.1%58.1
36GPT-5.6 TerraOpenAI0.1%58.1
37Grok 4.20xAI0.1%54.3
38GPT-5.6 LunaOpenAI0.0%59.3
39GPT-5.6 TerraOpenAI0.0%58.8