ARC-AGI-1

ARC Prize Foundation · verified-v1-15fb467fd4fc · Verified ARC Prize results on the original ARC-AGI abstract reasoning benchmark.

Model Ranking

Source
#1Claude Fable 5Anthropic98.50percentClaude Fable 5 (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#2Claude Fable 5.1Anthropic97.50percentClaude Fable 5.1 (Max)unknownOriginal sourcewinner eligibleThird-party benchmark
#2Claude Opus 5Anthropic97.50percentClaude Opus 5 (Max)unknownOriginal sourcewinner eligibleThird-party benchmark
#2GPT-5.6 SolOpenai97.50percentGPT-5.6 Sol (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#5GPT-5.5 ProOpenai96.50percentGPT-5.5 Pro (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#5GPT-5.6 TerraOpenai96.50percentGPT-5.6 Terra (Max)unknownOriginal sourcewinner eligibleThird-party benchmark
#7Gemini 3.7 FlashGoogle Deepmind95.50percentGemini 3.7 Flash (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#8GPT-5.5OpenaiSelected model95.00percentGPT-5.5 (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#9GPT-5.4 ProOpenai94.50percentGPT-5.4 Pro (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#9Kimi-K3Moonshot AI94.50percentKimi K3 (Max)unknownOriginal sourcewinner eligibleThird-party benchmark
#11Claude Opus 4.6Anthropic94.00percentClaude Opus 4.6 (120K, High)unknownOriginal sourcewinner eligibleThird-party benchmark
#12GPT-5.4Openai93.67percentGPT-5.4 (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#13Claude Opus 4.7Anthropic93.50percentClaude 4.7 (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#14Claude Opus 4.8Anthropic92.50percentClaude Opus 4.8 (Max)unknownOriginal sourcewinner eligibleThird-party benchmark
#14Gemini 3.5 FlashGoogle Deepmind92.50percentGemini 3.5 Flash (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#16Gemini 3.6 FlashGoogle Deepmind91.17percentGemini 3.6 Flash (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#17GPT-5.6 LunaOpenai90.67percentGPT-5.6 Luna 2026-07-30 (Max)unknownOriginal sourcewinner eligibleThird-party benchmark
#18DeepSeek-V4-Pro-0813DeepSeek90.50percentDeepSeek V4 Pro 0813 (Low)unknownOriginal sourcewinner eligibleThird-party benchmark
#18GPT-5.2 ProOpenai90.50percentGPT-5.2 Pro (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#20Grok 4.20 Multi-AgentXai89.50percentGrok 4.20 (Reasoning)unknownOriginal sourcewinner eligibleThird-party benchmark
#21DeepSeek-V4-FlashDeepSeek89.00percentDeepSeek V4 Flash 0731 (Max)unknownOriginal sourcewinner eligibleThird-party benchmark
#22Grok 4.6Xai87.50percentGrok 4.6 (Medium)unknownOriginal sourcewinner eligibleThird-party benchmark
#23Grok 4.5Xai87.17percentGrok 4.5 (Medium)unknownOriginal sourcewinner eligibleThird-party benchmark
#24Claude Sonnet 4.6Anthropic86.50percentClaude Sonnet 4.6 (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#25GPT-5.2Openai86.17percentGPT-5.2 (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#26InklingThinking Machines Lab79.50percentInklingunknownOriginal sourcewinner eligibleThird-party benchmark
#27GPT-5.1Openai72.83percentGPT-5.1 (Thinking, High)unknownOriginal sourcewinner eligibleThird-party benchmark
#28GPT-5 ProOpenai70.17percentGPT-5 ProunknownOriginal sourcewinner eligibleThird-party benchmark
#29GPT-5Openai65.67percentGPT-5 (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#30Claude Sonnet 4.5Anthropic63.67percentClaude Sonnet 4.5 (Thinking 32K)unknownOriginal sourcewinner eligibleThird-party benchmark
#30GPT-5.4 MiniOpenai63.67percentGPT-5.4 Mini (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#32GPT-5 MiniOpenai54.33percentGPT-5 Mini (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#33Gemini 3.5 Flash-LiteGoogle Deepmind53.50percentGemini 3.5 Flash-Lite (High)unknownOriginal sourcewinner eligibleThird-party benchmark
#34GPT-5.4 NanoOpenai51.50percentGPT-5.4 Nano (XHigh)unknownOriginal sourcewinner eligibleThird-party benchmark
#35Claude Haiku 4.5Anthropic47.67percentClaude Haiku 4.5 (Thinking 32K)unknownOriginal sourcewinner eligibleThird-party benchmark
#36GPT-5 NanoOpenai20.71percentGPT-5 Nano (Medium)unknownOriginal sourcewinner eligibleThird-party benchmark
#37GPT-4.1Openai5.50percentGPT-4.1unknownOriginal sourcewinner eligibleThird-party benchmark

37 models ranked by the best winner-eligible current-version score when available, otherwise the best publisher-artifact score; highest first. Observed Sep 3, 2026. The model you came from is highlighted.

Methodology and Coverage

Ranking protocolverified score · percent. Each model appears once; verified winner-eligible runs take precedence, and missing models are not imputed.
Acquisition coverage37 published models from 217 source rows; 41 source identities remain quarantined.

Primary Evidence

Publisher Artifacts

Questions

ARC-AGI-1 FAQs

What does ARC-AGI-1 measure?+

Verified ARC Prize results on the original ARC-AGI abstract reasoning benchmark. Model Markets classifies it as an abstract reasoning benchmark and preserves the publisher's verified-v1-15fb467fd4fc release as a distinct comparison cohort.

How are models ranked on ARC-AGI-1?+

Models are ordered by verified score in percent, with higher scores ranked first. Each model appears once; a verified winner-eligible current-version result takes precedence over a publisher-artifact-only result, and missing scores are not estimated.

Which model currently leads ARC-AGI-1?+

Claude Fable 5 leads the current verified table with 98.50 percent on verified-v1-15fb467fd4fc. This is a benchmark-specific result, not a universal model-quality claim.

How many models have a published ARC-AGI-1 score?+

37 catalog models are published from 217 source rows. 41 source identities remain quarantined rather than guessed.

Can ARC-AGI-1 scores be compared with other benchmarks?+

Raw scores should be compared only within the same benchmark version, metric, and protocol. Model Markets normalizes eligible scores only for aggregate rankings, and groups models by an identical benchmark set before ranking them. View aggregate rankings

Why might a model be missing from ARC-AGI-1?+

A model remains absent when the publisher has no current result, the source model identity is unresolved, the evaluation protocol is incompatible, or the evidence cannot be verified. Model Markets does not substitute a provider claim or infer a score from a related model.

How current is the ARC-AGI-1 leaderboard?+

The current Model Markets snapshot was observed Sep 3, 2026 from ARC Prize Foundation artifacts. The exact publisher source and each retained result artifact are linked on this page.

Send Feedback