ARC-AGI-2

ARC Prize Foundation · verified-8d1a893f26ff · Verified ARC Prize results on the harder ARC-AGI-2 abstract reasoning benchmark.

Source
#1GPT-5.6 SolOpenAI92.50percentMax reasoning; ARC Prize verified leaderboardunknownOriginal sourcewinner eligibleThird-party benchmark
#2Claude Opus 5Anthropic90.40percentMax reasoning; ARC Prize verified leaderboardunknownOriginal sourcewinner eligibleThird-party benchmark
#3Claude Fable 5Anthropic89.20percentMax reasoning; ARC Prize verified leaderboardunknownOriginal sourcewinner eligibleThird-party benchmark
#4GPT-5.6 TerraOpenAI83.90percentMax reasoning; ARC Prize verified leaderboardunknownOriginal sourcewinner eligibleThird-party benchmark
#5DeepSeek-V4-FlashDeepSeek61.40percentMax reasoning; ARC Prize verified leaderboardunknownOriginal sourcewinner eligibleThird-party benchmark
#6DeepSeek-V4-ProDeepSeek61.30percentMax reasoning; ARC Prize verified leaderboardunknownOriginal sourcewinner eligibleThird-party benchmark
#7Kimi-K3Moonshot AI60.40percentMax reasoning; ARC Prize verified leaderboardunknownOriginal sourcewinner eligibleThird-party benchmark
#8GPT-5.6 LunaOpenAI59.50percentMax reasoning; ARC Prize verified leaderboardunknownOriginal sourcewinner eligibleThird-party benchmark

8 models ranked by the best winner-eligible current-version score when available, otherwise the best publisher-artifact score; highest first. Observed Aug 29, 2026.

Ranking protocol

verified score · percent. Each model appears once; verified winner-eligible runs take precedence, and missing models are not imputed.

Acquisition coverage

8 published models from 8 source rows; 0 source identities remain quarantined.

Primary evidence

Publisher artifacts

Send feedback