Skip to content

LLM排行榜

Top Performers by Task

Stay up to date with AI

Weekly rankings, new model releases, and pricing changes - straight to your inbox.

No spam. Unsubscribe anytime.

Frequently Asked Questions

根据我们对基准测试、定价、速度和功能的实时综合评分,Claude Fable 5目前以97分领先AI模型排行榜。排名每小时使用来自58+个服务商的实时数据更新。

我们使用基准测试驱动的评分系统(0-100),其中基准测试分数占90%(来自MMLU、GPQA、HumanEval、SWE-bench等15+标准化评估),功能和上下文窗口作为辅助排序(10%)。数据每小时刷新。

我们追踪406个AI模型,来自58个服务商,包括OpenAI、Anthropic、Google、DeepSeek、Meta和Mistral。其中包括378个编程模型、18个图像生成模型和10个视频生成模型。

我们的编程类别根据SWE-bench、HumanEval等编程基准测试和真实编程任务的表现对378个模型进行排名。顶级编程模型每小时评估一次。访问我们的编程排行榜查看当前前10名。

是的,我们追踪了40个免费AI模型。这些包括来自Google、Meta和其他提供免费API访问的服务商的模型。访问我们的免费AI模型页面查看完整排名列表。

LLM Leaderboard 2026 - AI Models Ranked