LMArena Text Arena
LMArena · text-2026-09-01-011508720696 · Blind pairwise human preferences from LMArena's text arena.
Model Ranking
Source | |||||||
|---|---|---|---|---|---|---|---|
| #1 | Claude Opus 5Anthropic | 1,504.96 | — | 16,839 | claude-opus-5-max; 95% CI [1499.16488972, 1510.76500615]; votes 16839; rank 1unknown | Original sourcewinner eligible | Third-party benchmark |
| #2 | Claude Opus 4.6Anthropic | 1,503.04 | — | 72,110 | claude-opus-4-6-high; 95% CI [1499.54337414, 1506.53767621]; votes 72110; rank 3unknown | Original sourcewinner eligible | Third-party benchmark |
| #3 | Claude Fable 5Anthropic | 1,494.40 | — | 26,977 | claude-fable-5; 95% CI [1489.42750707, 1499.38052801]; votes 26977; rank 5unknown | Original sourcewinner eligible | Third-party benchmark |
| #4 | Gemini 3.7 FlashGoogle DeepMind | 1,491.10 | — | 5,685 | gemini-3.7-flash-high; 95% CI [1482.94370265, 1499.25525622]; votes 5685; rank 6unknown | Original sourcewinner eligible | Third-party benchmark |
| #5 | Claude Opus 4.7Anthropic | 1,490.10 | — | 60,123 | claude-opus-4-7-high; 95% CI [1486.23501236, 1493.97147563]; votes 60123; rank 7unknown | Original sourcewinner eligible | Third-party benchmark |
| #6 | Muse Spark 1.2Meta | 1,488.47 | — | 3,244 | muse-spark-1.2 (xHigh); 95% CI [1478.00612479, 1498.93408698]; votes 3244; rank 8unknown | Original sourcewinner eligible | Third-party benchmark |
| #7 | Gemini 3.5 FlashGoogle DeepMind | 1,483.50 | — | 33,874 | gemini-3.5-flash-high; 95% CI [1479.17846588, 1487.82213514]; votes 33874; rank 9unknown | Original sourcewinner eligible | Third-party benchmark |
| #8 | Gemini 3.1 ProGoogle DeepMind | 1,480.10 | — | 102,763 | gemini-3.1-pro-preview; 95% CI [1476.89767236, 1483.30025658]; votes 102763; rank 11unknown | Original sourcewinner eligible | Third-party benchmark |
| #9 | Qwen3.8-MaxQwen | 1,479.56 | — | 13,136 | qwen3.8-max; 95% CI [1473.34740586, 1485.77213629]; votes 13136; rank 12unknown | Original sourcewinner eligible | Third-party benchmark |
| #10 | Muse Spark 1.1Meta | 1,479.03 | — | 23,768 | muse-spark-1.1; 95% CI [1473.99485495, 1484.06002682]; votes 23768; rank 14unknown | Original sourcewinner eligible | Third-party benchmark |
| #11 | Gemini 3.6 FlashGoogle DeepMind | 1,476.42 | — | 22,009 | gemini-3.6-flash-high; 95% CI [1471.33793256, 1481.50948001]; votes 22009; rank 15unknown | Original sourcewinner eligible | Third-party benchmark |
| #12 | Kimi-K3Moonshot AI | 1,476.31 | — | 17,895 | kimi-k3-max; 95% CI [1470.86166728, 1481.76254962]; votes 17895; rank 16unknown | Original sourcewinner eligible | Third-party benchmark |
| #13 | GLM-5.3Z.ai | 1,474.49 | — | 7,401 | glm-5.3-max; 95% CI [1467.12172899, 1481.86064533]; votes 7401; rank 18unknown | Original sourcewinner eligible | Third-party benchmark |
| #14 | GPT-5.5OpenAI | 1,471.56 | — | 63,265 | gpt-5.5-high; 95% CI [1467.73328730, 1475.37792479]; votes 63265; rank 21unknown | Original sourcewinner eligible | Third-party benchmark |
| #15 | GLM-5.3-FlashZ.ai | 1,470.91 | — | 4,399 | glm-5.3-flash; 95% CI [1461.80526636, 1480.01283657]; votes 4399; rank 23unknown | Original sourcewinner eligible | Third-party benchmark |
| #16 | GPT-5.4OpenAI | 1,469.67 | — | 60,657 | gpt-5.4-high; 95% CI [1465.82164410, 1473.52732979]; votes 60657; rank 24unknown | Original sourcewinner eligible | Third-party benchmark |
| #17 | ERNIE 5.1Baidu | 1,468.10 | — | 37,137 | ernie-5.1; 95% CI [1463.48233336, 1472.72453179]; votes 37137; rank 25unknown | Original sourcewinner eligible | Third-party benchmark |
| #18 | GLM-5.2Z.ai | 1,466.80 | — | 33,758 | glm-5.2-max; 95% CI [1462.10739564, 1471.49788772]; votes 33758; rank 26unknown | Original sourcewinner eligible | Third-party benchmark |
| #19 | Gemini 3 FlashGoogle DeepMind | 1,466.68 | — | 30,248 | gemini-3-flash; 95% CI [1462.28845512, 1471.07550892]; votes 30248; rank 28unknown | Original sourcewinner eligible | Third-party benchmark |
| #20 | GLM-5.1Z.ai | 1,462.73 | — | 45,403 | glm-5.1; 95% CI [1458.76227206, 1466.68811970]; votes 45403; rank 30unknown | Original sourcewinner eligible | Third-party benchmark |
| #21 | Claude Opus 4.8Anthropic | 1,461.14 | — | 48,467 | claude-opus-4-8-high; 95% CI [1456.88347873, 1465.40568534]; votes 48467; rank 31unknown | Original sourcewinner eligible | Third-party benchmark |
| #22 | Claude Sonnet 4.6Anthropic | 1,458.01 | — | 66,343 | claude-sonnet-4-6; 95% CI [1454.41608210, 1461.60383515]; votes 66343; rank 32unknown | Original sourcewinner eligible | Third-party benchmark |
| #23 | Gemini 2.5 ProGoogle DeepMind | 1,457.82 | — | 122,575 | gemini-2.5-pro; 95% CI [1455.34940240, 1460.28624287]; votes 122575; rank 33unknown | Original sourcewinner eligible | Third-party benchmark |
| #24 | Kimi-K2.6Moonshot AI | 1,455.01 | — | 37,573 | kimi-k2.6; 95% CI [1450.48846324, 1459.52803920]; votes 37573; rank 34unknown | Original sourcewinner eligible | Third-party benchmark |
| #25 | GPT-5.6 SolOpenAI | 1,454.69 | — | 23,153 | gpt-5.6-sol-xhigh; 95% CI [1449.58093424, 1459.80348090]; votes 23153; rank 35unknown | Original sourcewinner eligible | Third-party benchmark |
| #26 | Qwen3.7-PlusQwen | 1,453.70 | — | 37,854 | qwen3.7-plus; 95% CI [1449.21174793, 1458.19774266]; votes 37854; rank 36unknown | Original sourcewinner eligible | Third-party benchmark |
| #27 | Grok 4.5xAI | 1,451.82 | — | 25,873 | grok-4.5; 95% CI [1446.90989155, 1456.73122428]; votes 25873; rank 39unknown | Original sourcewinner eligible | Third-party benchmark |
| #28 | DeepSeek-V4-ProDeepSeek | 1,451.00 | — | 54,243 | deepseek-v4-pro; 95% CI [1447.00829245, 1454.98663953]; votes 54243; rank 41unknown | Original sourcewinner eligible | Third-party benchmark |
| #29 | Claude Opus 4.5Anthropic | 1,450.35 | — | 70,057 | claude-opus-4-5-20251101; 95% CI [1447.17072951, 1453.51975270]; votes 70057; rank 42unknown | Original sourcewinner eligible | Third-party benchmark |
| #30 | Grok 4.20 Multi-AgentxAI | 1,450.22 | — | 60,845 | grok-4.20-multi-agent-beta-0309; 95% CI [1446.44654530, 1453.99996127]; votes 60845; rank 43unknown | Original sourcewinner eligible | Third-party benchmark |
| #31 | GPT-5.6 TerraOpenAI | 1,446.72 | — | 23,942 | gpt-5.6-terra-xhigh; 95% CI [1441.68248185, 1451.74987487]; votes 23942; rank 47unknown | Original sourcewinner eligible | Third-party benchmark |
| #32 | GLM-5Z.ai | 1,446.35 | — | 27,643 | glm-5; 95% CI [1442.03016476, 1450.67686961]; votes 27643; rank 48unknown | Original sourcewinner eligible | Third-party benchmark |
| #33 | Kimi-K2.5Moonshot AI | 1,445.75 | — | 70,620 | kimi-k2.5-thinking; 95% CI [1442.41231565, 1449.09515875]; votes 70620; rank 50unknown | Original sourcewinner eligible | Third-party benchmark |
| #34 | Grok 4.6xAI | 1,443.75 | — | 3,453 | grok-4.6-high; 95% CI [1433.62910542, 1453.86294509]; votes 3453; rank 55unknown | Original sourcewinner eligible | Third-party benchmark |
| #35 | Claude Sonnet 5Anthropic | 1,442.95 | — | 31,096 | claude-sonnet-5-high; 95% CI [1438.22001632, 1447.67497803]; votes 31096; rank 56unknown | Original sourcewinner eligible | Third-party benchmark |
| #36 | GPT-5.1OpenAI | 1,441.84 | — | 40,296 | gpt-5.1-high; 95% CI [1438.09444135, 1445.58058275]; votes 40296; rank 59unknown | Original sourcewinner eligible | Third-party benchmark |
| #37 | Gemma 4 31BGoogle DeepMind | 1,441.82 | — | 5,900 | gemma-4-31b; 95% CI [1434.27306811, 1449.35895578]; votes 5900; rank 60unknown | Original sourcewinner eligible | Third-party benchmark |
| #38 | Hy3Tencent | 1,439.99 | — | 6,911 | hy3; 95% CI [1432.36272776, 1447.61573606]; votes 6911; rank 63unknown | Original sourcewinner eligible | Third-party benchmark |
| #39 | Claude Sonnet 4.5Anthropic | 1,438.27 | — | 79,668 | claude-sonnet-4-5-20250929; 95% CI [1435.36635364, 1441.17549670]; votes 79668; rank 66unknown | Original sourcewinner eligible | Third-party benchmark |
| #40 | InklingThinking Machines Lab | 1,438.25 | — | 21,973 | inkling; 95% CI [1433.11517161, 1443.38005000]; votes 21973; rank 67unknown | Original sourcewinner eligible | Third-party benchmark |
| #41 | Qwen3.5-397B-A17BQwen | 1,437.84 | — | 73,400 | qwen3.5-397b-a17b; 95% CI [1434.48605524, 1441.19621255]; votes 73400; rank 68unknown | Original sourcewinner eligible | Third-party benchmark |
| #42 | Qwen3.8-27BQwen | 1,437.35 | — | 6,626 | qwen3.8-27b; 95% CI [1429.71618499, 1444.98971204]; votes 6626; rank 69unknown | Original sourcewinner eligible | Third-party benchmark |
| #43 | Gemini 3.5 Flash-LiteGoogle DeepMind | 1,436.25 | — | 21,843 | gemini-3.5-flash-lite; 95% CI [1431.05053629, 1441.44358777]; votes 21843; rank 74unknown | Original sourcewinner eligible | Third-party benchmark |
| #44 | MiniMax-M3MiniMax | 1,435.20 | — | 44,544 | minimax-m3; 95% CI [1430.86827835, 1439.53977389]; votes 44544; rank 77unknown | Original sourcewinner eligible | Third-party benchmark |
| #45 | Gemma 4 26B-A4BGoogle DeepMind | 1,434.86 | — | 5,814 | gemma-4-26b-a4b; 95% CI [1427.26766156, 1442.45594559]; votes 5814; rank 78unknown | Original sourcewinner eligible | Third-party benchmark |
| #46 | DeepSeek-V4-FlashDeepSeek | 1,431.98 | — | 48,963 | deepseek-v4-flash; 95% CI [1427.84091263, 1436.10937297]; votes 48963; rank 80unknown | Original sourcewinner eligible | Third-party benchmark |
| #47 | GPT-5.6 LunaOpenAI | 1,430.14 | — | 24,433 | gpt-5.6-luna-xhigh; 95% CI [1425.14784950, 1435.13857729]; votes 24433; rank 82unknown | Original sourcewinner eligible | Third-party benchmark |
| #48 | Mistral Large 3Mistral AI | 1,427.62 | — | 65,336 | mistral-large-3; 95% CI [1424.57601414, 1430.66670291]; votes 65336; rank 85unknown | Original sourcewinner eligible | Third-party benchmark |
| #49 | DeepSeek-V3.2DeepSeek | 1,424.83 | — | 46,487 | deepseek-v3.2; 95% CI [1421.30044809, 1428.36162643]; votes 46487; rank 91unknown | Original sourcewinner eligible | Third-party benchmark |
| #50 | Mistral-Medium-3.5-128BMistral AI | 1,421.16 | — | 11,017 | mistral-medium-3.5; 95% CI [1414.62812191, 1427.69573067]; votes 11017; rank 98unknown | Original sourcewinner eligible | Third-party benchmark |
| #51 | Gemini 2.5 FlashGoogle DeepMind | 1,417.31 | — | 122,770 | gemini-2.5-flash; 95% CI [1414.86923843, 1419.74079237]; votes 122770; rank 111unknown | Original sourcewinner eligible | Third-party benchmark |
| #52 | GPT-5.2OpenAI | 1,416.67 | — | 47,566 | gpt-5.2-high; 95% CI [1413.07448310, 1420.25864024]; votes 47566; rank 114unknown | Original sourcewinner eligible | Third-party benchmark |
| #53 | GPT-5.4 MiniOpenAI | 1,412.10 | — | 59,472 | gpt-5.4-mini-high; 95% CI [1408.28461201, 1415.92470838]; votes 59472; rank 123unknown | Original sourcewinner eligible | Third-party benchmark |
| #54 | GPT-5OpenAI | 1,405.96 | — | 31,418 | gpt-5-high; 95% CI [1401.51371519, 1410.40173213]; votes 31418; rank 132unknown | Original sourcewinner eligible | Third-party benchmark |
| #55 | MiniMax-M2.7MiniMax | 1,404.90 | — | 65,411 | minimax-m2.7; 95% CI [1401.24077059, 1408.56647727]; votes 65411; rank 134unknown | Original sourcewinner eligible | Third-party benchmark |
| #56 | Grok 4.3xAI | 1,397.97 | — | 65,024 | grok-4.3; 95% CI [1394.22069381, 1401.72787538]; votes 65024; rank 141unknown | Original sourcewinner eligible | Third-party benchmark |
| #57 | Qwen3.5-35B-A3BQwen | 1,395.60 | — | 29,067 | qwen3.5-35b-a3b; 95% CI [1391.30285568, 1399.90287908]; votes 29067; rank 143unknown | Original sourcewinner eligible | Third-party benchmark |
| #58 | Claude Haiku 4.5Anthropic | 1,395.25 | — | 124,979 | claude-haiku-4-5-20251001; 95% CI [1392.70335168, 1397.78975878]; votes 124979; rank 144unknown | Original sourcewinner eligible | Third-party benchmark |
| #59 | Muse Glimmer 30BMeta | 1,391.91 | — | 3,696 | muse-glimmer; 95% CI [1382.01378668, 1401.79860600]; votes 3696; rank 148unknown | Original sourcewinner eligible | Third-party benchmark |
| #60 | GPT-4.1OpenAI | 1,382.71 | — | 49,913 | gpt-4.1-2025-04-14; 95% CI [1379.00467679, 1386.41941365]; votes 49913; rank 153unknown | Original sourcewinner eligible | Third-party benchmark |
| #61 | GPT-5 MiniOpenAI | 1,372.94 | — | 26,551 | gpt-5-mini-high; 95% CI [1368.36426468, 1377.52117993]; votes 26551; rank 162unknown | Original sourcewinner eligible | Third-party benchmark |
| #62 | GPT-5.4 NanoOpenAI | 1,372.87 | — | 58,562 | gpt-5.4-nano-high; 95% CI [1369.01004978, 1376.72255426]; votes 58562; rank 163unknown | Original sourcewinner eligible | Third-party benchmark |
| #63 | DeepSeek-R1DeepSeek | 1,372.49 | — | 18,524 | deepseek-r1; 95% CI [1367.65185984, 1377.33749685]; votes 18524; rank 164unknown | Original sourcewinner eligible | Third-party benchmark |
| #64 | gpt-oss-120bOpenAI | 1,365.91 | — | 29,935 | gpt-oss-120b; 95% CI [1361.54274876, 1370.28718499]; votes 29935; rank 172unknown | Original sourcewinner eligible | Third-party benchmark |
| #65 | Granite 4.2 30BIBM | 1,362.55 | — | 3,287 | granite-4.2-30b; 95% CI [1351.93384890, 1373.17607017]; votes 3287; rank 177unknown | Original sourcewinner eligible | Third-party benchmark |
| #66 | Nova 2 LiteAmazon | 1,362.52 | — | 12,117 | nova-2-lite; 95% CI [1356.44886287, 1368.59662424]; votes 12117; rank 178unknown | Original sourcewinner eligible | Third-party benchmark |
| #67 | MiniMax-M2.5MiniMax | 1,359.16 | — | 40,895 | minimax-m2.5; 95% CI [1355.19195179, 1363.12059277]; votes 40895; rank 180unknown | Original sourcewinner eligible | Third-party benchmark |
| #68 | NVIDIA-Nemotron-3-Nano-30B-A3B-BF16NVIDIA | 1,348.42 | — | 15,338 | nvidia-nemotron-3-nano-30b-a3b-bf16; 95% CI [1342.96803096, 1353.87681829]; votes 15338; rank 191unknown | Original sourcewinner eligible | Third-party benchmark |
| #69 | GPT-4.1 MiniOpenAI | 1,340.09 | — | 38,630 | gpt-4.1-mini-2025-04-14; 95% CI [1335.78819641, 1344.39628941]; votes 38630; rank 195unknown | Original sourcewinner eligible | Third-party benchmark |
| #70 | DeepSeek-V3DeepSeek | 1,332.28 | — | 21,770 | deepseek-v3; 95% CI [1327.55202083, 1337.01331591]; votes 21770; rank 205unknown | Original sourcewinner eligible | Third-party benchmark |
| #71 | NVIDIA Nemotron 3.5 Lightning 30B-A3BNVIDIA | 1,331.84 | — | 4,533 | nvidia-nemotron-3.5-lightning-30b-a3b-nvfp4; 95% CI [1322.39322537, 1341.28358716]; votes 4533; rank 207unknown | Original sourcewinner eligible | Third-party benchmark |
| #72 | Command ACohere | 1,330.79 | — | 55,434 | command-a-03-2025; 95% CI [1327.33626503, 1334.25009199]; votes 55434; rank 208unknown | Original sourcewinner eligible | Third-party benchmark |
| #73 | GPT-5 NanoOpenAI | 1,319.84 | — | 8,128 | gpt-5-nano-high; 95% CI [1312.99438214, 1326.68844296]; votes 8128; rank 214unknown | Original sourcewinner eligible | Third-party benchmark |
| #74 | Granite 4.2 8BIBMSelected model | 1,317.93 | — | 3,119 | granite-4.2-8b; 95% CI [1306.62269586, 1329.24728966]; votes 3119; rank 219unknown | Original sourcewinner eligible | Third-party benchmark |
| #75 | Olmo-3.1-32B-InstructAi2 | 1,311.90 | — | 11,463 | olmo-3.1-32b-instruct; 95% CI [1305.73447366, 1318.07100374]; votes 11463; rank 223unknown | Original sourcewinner eligible | Third-party benchmark |
| #76 | Olmo-3-32B-ThinkAi2 | 1,299.56 | — | 5,682 | olmo-3-32b-think; 95% CI [1291.25214421, 1307.87126458]; votes 5682; rank 230unknown | Original sourcewinner eligible | Third-party benchmark |
| #77 | Granite 4.2 3BIBM | 1,298.83 | — | 3,097 | granite-4.2-3b; 95% CI [1287.13258156, 1310.53627273]; votes 3097; rank 233unknown | Original sourcewinner eligible | Third-party benchmark |
| #78 | granite-4.1-8bIBM | 1,292.07 | — | 4,027 | granite-4.1-8b; 95% CI [1281.98658230, 1302.15965212]; votes 4027; rank 237unknown | Original sourcewinner eligible | Third-party benchmark |
| #79 | gpt-oss-20bOpenAI | 1,287.27 | — | 10,386 | gpt-oss-20b; 95% CI [1280.87434855, 1293.66774302]; votes 10386; rank 242unknown | Original sourcewinner eligible | Third-party benchmark |
| #80 | Llama-4-Maverick-17B-128E-InstructMeta | 1,287.13 | — | 39,349 | llama-4-maverick-17b-128e-instruct; 95% CI [1282.87677682, 1291.39199009]; votes 39349; rank 243unknown | Original sourcewinner eligible | Third-party benchmark |
| #81 | GPT-4o MiniOpenAI | 1,286.22 | — | 68,698 | gpt-4o-mini-2024-07-18; 95% CI [1282.70478675, 1289.73790661]; votes 68698; rank 245unknown | Original sourcewinner eligible | Third-party benchmark |
| #82 | GPT-4.1 NanoOpenAI | 1,284.64 | — | 6,103 | gpt-4.1-nano-2025-04-14; 95% CI [1276.99177350, 1292.27849322]; votes 6103; rank 246unknown | Original sourcewinner eligible | Third-party benchmark |
| #83 | GPT-4oOpenAI | 1,282.33 | — | 45,499 | gpt-4o-2024-08-06; 95% CI [1278.14385443, 1286.52509361]; votes 45499; rank 250unknown | Original sourcewinner eligible | Third-party benchmark |
| #84 | Llama-4-Scout-17B-16E-InstructMeta | 1,279.25 | — | 29,739 | llama-4-scout-17b-16e-instruct; 95% CI [1274.53478136, 1283.95578792]; votes 29739; rank 255unknown | Original sourcewinner eligible | Third-party benchmark |
| #85 | Llama-3.3-70B-InstructMeta | 1,273.91 | — | 54,411 | llama-3.3-70b-instruct; 95% CI [1270.42968055, 1277.38585448]; votes 54411; rank 258unknown | Original sourcewinner eligible | Third-party benchmark |
| #86 | Llama-3.1-70B-InstructMeta | 1,260.70 | — | 55,240 | llama-3.1-70b-instruct; 95% CI [1256.98821169, 1264.41220064]; votes 55240; rank 272unknown | Original sourcewinner eligible | Third-party benchmark |
| #87 | phi-4Microsoft | 1,216.49 | — | 24,126 | phi-4; 95% CI [1211.91444642, 1221.07047082]; votes 24126; rank 296unknown | Original sourcewinner eligible | Third-party benchmark |
| #88 | Llama-3.1-8B-InstructMeta | 1,186.37 | — | 49,605 | llama-3.1-8b-instruct; 95% CI [1182.27083365, 1190.47005605]; votes 49605; rank 309unknown | Original sourcewinner eligible | Third-party benchmark |
88 models ranked by the best winner-eligible current-version score when available, otherwise the best publisher-artifact score; highest first. Observed Sep 3, 2026. The model you came from is highlighted.
Methodology and Coverage
Primary Evidence
Publisher Artifacts
Questions
LMArena Text Arena FAQs
What does LMArena Text Arena measure?+
Blind pairwise human preferences from LMArena's text arena. Model Markets classifies it as a general language benchmark and preserves the publisher's text-2026-09-01-011508720696 release as a distinct comparison cohort.
How are models ranked on LMArena Text Arena?+
Models are ordered by arena rating in rating, with higher scores ranked first. Each model appears once; a verified winner-eligible current-version result takes precedence over a publisher-artifact-only result, and missing scores are not estimated.
Which model currently leads LMArena Text Arena?+
Claude Opus 5 leads the current verified table with 1,504.96 rating on text-2026-09-01-011508720696. This is a benchmark-specific result, not a universal model-quality claim.
How many models have a published LMArena Text Arena score?+
88 catalog models are published from 398 source rows. 299 source identities remain quarantined rather than guessed.
Can LMArena Text Arena scores be compared with other benchmarks?+
Raw scores should be compared only within the same benchmark version, metric, and protocol. Model Markets normalizes eligible scores only for aggregate rankings, and groups models by an identical benchmark set before ranking them. View aggregate rankings →
Why might a model be missing from LMArena Text Arena?+
A model remains absent when the publisher has no current result, the source model identity is unresolved, the evaluation protocol is incompatible, or the evidence cannot be verified. Model Markets does not substitute a provider claim or infer a score from a related model.
How current is the LMArena Text Arena leaderboard?+
The current Model Markets snapshot was observed Sep 3, 2026 from LMArena artifacts. The exact publisher source and each retained result artifact are linked on this page.