Skip to content

Arena 榜单

Last updated: 27m ago

这个页面面向 “LLM arena”“Arena Elo leaderboard”“AI arena rankings” 这类搜索意图,集中展示当前最有代表性的对抗型和快速评估榜单。

15

Arena Elo 上榜模型

10

LiveBench 上榜模型

5

Arena 头部服务商

0

Arena 头部开源模型

Arena Elo

Human preference rating from 6M+ crowdsourced blind head-to-head comparisons. Users chat with two anonymous models and pick the better response.

#模型服务商分数
#1Claude Fable 5Anthropic1506
#2Claude Opus 4.6Anthropic1503
#3Gemini 3.1 Pro PreviewGoogle1494
#4Gemini 3.1 ProGoogle1494
#5Claude Opus 4.7Anthropic1491
#6Qwen3.8 MaxAlibaba1491
#7Muse Spark 1.1meta1489
#8Gemini 3 ProGoogle1486
#9GPT-5.4OpenAI1485
#10Gemini 3.6 FlashGoogle1484
#11GPT-5.2OpenAI1481
#12Claude Opus 4.8Anthropic1479
#13Gemini 3.5 FlashGoogle1477
#14GPT-5.2 ChatOpenAI1476
#15GPT-5.1OpenAI1475

LiveBench

Comprehensive benchmark across 6 categories (math, coding, reasoning, data analysis, instruction following, language) using contamination-resistant, regularly updated questions.

头部服务商分布

Google

4

Anthropic

3

Alibaba

1

meta

1

OpenAI

1

配套页面

Frequently Asked Questions

Arena 类榜单更强调模型之间的实时对抗或快速更新评估,而传统基准测试更像固定题集。两者结合起来更能反映真实竞争格局。

是。这个页面直接读取已聚合的真实 Arena Elo 和 LiveBench 分数,只显示当前本地基准数据集中存在的模型。

因为 “llm arena”“arena elo leaderboard” 这类搜索意图与通用基准页不同,用户想快速看到对抗型榜单而不是完整 benchmark 矩阵。

AI Arenas 2026 - Elo & LiveBench | LM Market Cap