LMArena Vision Arena

LMArena · vision-2026-08-27-51d09b2e834b · Blind human preferences for multimodal responses in LMArena's vision arena.

Source
#1Claude Fable 5Anthropic1329.46rating10,002claude-fable-5; 95% CI [1321.03632319, 1337.88661881]; votes 10002; rank 1unknownOriginal sourcewinner eligibleThird-party benchmark
#2Kimi-K2.6Moonshot AI1280.71rating15,378kimi-k2.6; 95% CI [1273.64165646, 1287.78511818]; votes 15378; rank 27unknownOriginal sourcewinner eligibleThird-party benchmark
#3Qwen3.8-27BQwen1279.32rating2,954qwen3.8-27b; 95% CI [1267.46655532, 1291.16933290]; votes 2954; rank 28unknownOriginal sourcewinner eligibleThird-party benchmark
#4Claude Sonnet 5Anthropic1277.94rating8,522claude-sonnet-5-high; 95% CI [1269.73992861, 1286.14906472]; votes 8522; rank 29unknownOriginal sourcewinner eligibleThird-party benchmark
#5GPT-5.6 SolOpenAI1276.90rating5,837gpt-5.6-sol-xhigh; 95% CI [1267.71657009, 1286.08047215]; votes 5837; rank 30unknownOriginal sourcewinner eligibleThird-party benchmark
#6GPT-5.6 TerraOpenAI1268.99rating5,774gpt-5.6-terra-xhigh; 95% CI [1259.82673197, 1278.15538857]; votes 5774; rank 33unknownOriginal sourcewinner eligibleThird-party benchmark
#7Kimi-K2.5Moonshot AI1266.74rating26,728kimi-k2.5-thinking; 95% CI [1260.83834046, 1272.64651923]; votes 26728; rank 36unknownOriginal sourcewinner eligibleThird-party benchmark
#8Qwen3.5-397B-A17BQwen1264.80rating25,997qwen3.5-397b-a17b; 95% CI [1258.85111028, 1270.75814841]; votes 25997; rank 38unknownOriginal sourcewinner eligibleThird-party benchmark
#9MiniMax-M3MiniMax1255.42rating13,390minimax-m3; 95% CI [1247.93588333, 1262.90862002]; votes 13390; rank 44unknownOriginal sourcewinner eligibleThird-party benchmark
#10GPT-5.6 LunaOpenAI1254.30rating5,857gpt-5.6-luna-xhigh; 95% CI [1245.05722338, 1263.53552757]; votes 5857; rank 45unknownOriginal sourcewinner eligibleThird-party benchmark
#11Mistral-Medium-3.5-128BMistral AI1222.18rating5,091mistral-medium-3.5; 95% CI [1212.39755732, 1231.95907443]; votes 5091; rank 67unknownOriginal sourcewinner eligibleThird-party benchmark
#12Llama-4-Maverick-17B-128E-InstructMeta1141.47rating6,936llama-4-maverick-17b-128e-instruct; 95% CI [1132.42029588, 1150.51619722]; votes 6936; rank 102unknownOriginal sourcewinner eligibleThird-party benchmark
#13Llama-4-Scout-17B-16E-InstructMeta1118.08rating6,467llama-4-scout-17b-16e-instruct; 95% CI [1108.62969338, 1127.52426769]; votes 6467; rank 110unknownOriginal sourcewinner eligibleThird-party benchmark

13 models ranked by the best winner-eligible current-version score when available, otherwise the best publisher-artifact score; highest first. Observed Aug 29, 2026.

Ranking protocol

arena rating · rating. Each model appears once; verified winner-eligible runs take precedence, and missing models are not imputed.

Acquisition coverage

13 published models from 148 source rows; 135 source identities remain quarantined.

Primary evidence

Publisher artifacts

Send feedback