Skip to content

Arena 榜单

Last updated: 2h ago

这个页面面向 “LLM arena”“Arena Elo leaderboard”“AI arena rankings” 这类搜索意图,集中展示当前最有代表性的对抗型和快速评估榜单。

15

Arena Elo 上榜模型

10

LiveBench 上榜模型

4

Arena 头部服务商

1

Arena 头部开源模型

Arena Elo

Human preference rating from 6M+ crowdsourced blind head-to-head comparisons. Users chat with two anonymous models and pick the better response.

#模型服务商分数
#1Claude Opus 4.6Anthropic1503
#2Gemini 3.1 Pro PreviewGoogle1494
#3Gemini 3.1 ProGoogle1494
#4Muse Spark 1.1meta1493
#5Claude Opus 4.7Anthropic1491
#6Gemini 3 ProGoogle1486
#7GPT-5.4OpenAI1485
#8GPT-5.2OpenAI1481
#9Claude Opus 4.8Anthropic1479
#10Gemini 3.5 FlashGoogle1477
#11GPT-5.2 ChatOpenAI1476
#12GPT-5.1OpenAI1475
#13GPT-5.5OpenAI1475
#14GLM 5.3 Flash
开源
Zhipu AI1475
#15Gemini 3 FlashGoogle1474

LiveBench

Comprehensive benchmark across 6 categories (math, coding, reasoning, data analysis, instruction following, language) using contamination-resistant, regularly updated questions.

头部服务商分布

Google

4

Anthropic

3

OpenAI

2

meta

1

配套页面

Frequently Asked Questions

Arena 类榜单更强调模型之间的实时对抗或快速更新评估,而传统基准测试更像固定题集。两者结合起来更能反映真实竞争格局。

是。这个页面直接读取已聚合的真实 Arena Elo 和 LiveBench 分数,只显示当前本地基准数据集中存在的模型。

因为 “llm arena”“arena elo leaderboard” 这类搜索意图与通用基准页不同,用户想快速看到对抗型榜单而不是完整 benchmark 矩阵。

AI Arenas 2026 - Elo & LiveBench | LM Market Cap