ARC-AGI-2

By

maalis 20, 2026
Benchmark

Abstraction and reasoning benchmark for novel visual problems.

Kärkitulos 95 %
Mediaani 68,8 %
Tuloshaitari 15,9 % - 95 %

Tulostaulukko

Näytä vain ajantasaiset mallit

Oletuksena mukana ovat vain ajantasaiset julkiset mallit. Avaa halutessasi myös vanhemmat ja poistuvat rivit.

SijaMalliTulosLähde
#1
GPT-6 Astra OpenAI
95 % ARC Prize · max · Päivitetty 7.9.2026
#2
GPT-5.6 Sol OpenAI
92,5 % ARC Prize · max · Päivitetty 7.9.2026
#3
Claude Opus 5 Anthropic
90,4 % ARC Prize · max · Päivitetty 7.9.2026
#4
Claude Fable 5.1 Anthropic
90 % ARC Prize · max · Päivitetty 7.9.2026
#5
Claude Fable 5 Anthropic
89,2 % ARC Prize · max · Päivitetty 7.9.2026
#6
Gemini 3.7 Flash Google DeepMind
84,6 % ARC Prize · high · Päivitetty 7.9.2026
#783,9 % ARC Prize · max · Päivitetty 7.9.2026
#8
GPT-5.4 pro OpenAI
83,3 % OpenAI · Päivitetty 21.3.2026
#9
GPT-5.4 OpenAI
73,3 % OpenAI · Päivitetty 21.3.2026
#10
Claude Opus 4.6 Anthropic
68,8 % Anthropic · Päivitetty 21.3.2026
#11
Gemini 3.6 Flash Google DeepMind
60,4 % ARC Prize · high · Päivitetty 7.9.2026
#12
GPT-5.6 Luna OpenAI
59,6 % ARC Prize · max; 30.7.2026 · Päivitetty 7.9.2026
#1358,3 % Anthropic · Päivitetty 21.3.2026
#14
GPT-5.2 pro OpenAI
54,2 % OpenAI · Päivitetty 21.3.2026
#15
GPT-5.2 OpenAI
52,9 % OpenAI · Päivitetty 21.3.2026
#16
GPT-5.2 Chat OpenAI
52,9 % OpenAI · Päivitetty 21.3.2026
#17
GPT-5.1 OpenAI
17,6 % OpenAI · Päivitetty 21.3.2026
#18
GPT-5.1 Chat OpenAI
17,6 % OpenAI · Päivitetty 21.3.2026
#19
Grok 4 xAI
15,9 % xAI · Päivitetty 21.3.2026

Tietoa benchmarkista

Päivitetty
7.9.2026

By