Skip to content

最佳写作AI模型

使用Arena Elo评分(归一化到0-100刻度)对AI模型的写作质量进行排名。

Last updated: 35m ago
第一名模型

Claude Opus 4.6

评分: 100

平均评分

81.4

所有排名模型

已排名模型

107

有基准测试数据

权重:Arena Elo (100%)

Top Best for Writing Models by Weighted Score

Top 15 models by weighted score

LMMarketCap.com
#模型评分
1Claude Opus 4.6Anthropic100
2Gemini 3.1 Pro PreviewGoogle99
3Claude Opus 4.7Anthropic98.5
4Muse Spark 1.1meta98.5
5GPT-5.4OpenAI97.5
6GPT-5.2OpenAI96.8
7MiMo-V2.6-ProXiaomi96.7
8Claude Opus 4.8Anthropic96.5
9Gemini 3.5 FlashGoogle96.2
10GPT-5.2 ChatOpenAI96
11GPT-5.5OpenAI95.8
12GPT-5.1OpenAI95.8
13GLM 5.3 FlashZhipu AI95.7
14Gemini 3 Flash PreviewGoogle95.7
15MiMo-V2.5-ProXiaomi94.5
16Grok 4.5xAI94.2
17GLM 5.1Zhipu AI94.2
18GPT-5OpenAI94.2
19Kimi K2.6Moonshot AI93.5
20Claude Sonnet 4.6Anthropic93.3
21Qwen3.6 Max PreviewAlibaba93.3
22GLM 5Zhipu AI92.8
23Hy3Tencent92.8
24Gemini 3.5 Flash LiteGoogle92.7
25Qwen3.7 PlusAlibaba92.7
26MiMo-V2.6-FlashXiaomi92.3
27Gemma 4 31BGoogle92.2
28Claude Sonnet 4.5Anthropic92
29Claude Opus 4.1Anthropic91.7
30Gemini 2.5 ProGoogle90.7
31Qwen3.6 PlusAlibaba90.5
32Inklingthinkingmachines90.3
33Qwen3.5 397B A17BAlibaba90.3
34GLM 4.7Zhipu AI90.2
35MiniMax M3MiniMax90
36Qwen3.8 27BAlibaba89.7
37Gemma 4 26B A4B Google89.7
38MiMo-V2.5Xiaomi89
39GLM 5V TurboZhipu AI88.8
40Gemini 3.1 Flash Lite PreviewGoogle88.8
41Claude Opus 4.5Anthropic88.3
42Mistral Medium 3.5Mistral AI87.7
43DeepSeek V3.2DeepSeek87.5
44GLM 4.6Zhipu AI87.3
45DeepSeek V3.2 ExpDeepSeek87
46DeepSeek V3.1DeepSeek86.2
47Qwen3.5-122B-A10BAlibaba86
48o3OpenAI85.8
49MiniMax M2.7MiniMax85.8
50DeepSeek V3.1 TerminusDeepSeek85.8
51Qwen3 VL 235B A22B InstructAlibaba85.5
52GLM 4.5Zhipu AI85.2
53Hy3 previewTencent84.8
54Qwen3.5-27BAlibaba84.8
55Inkling Smallthinkingmachines84.2
56Qwen3 Next 80B A3B InstructAlibaba83.2
57Qwen3.5-FlashAlibaba82.7
58Gemini 2.5 FlashGoogle82.5
59Qwen3 VL 235B A22B ThinkingAlibaba82.5
60Qwen3.5-35B-A3BAlibaba82.3
61Step 3.5 FlashStepFun82.2
62MiniMax M2.5MiniMax81.8
63GPT-5 MiniOpenAI81.7
64Claude Sonnet 4Anthropic81.2
65GPT-4.1 MiniOpenAI80.5
66R1 0528DeepSeek80
67o4 MiniOpenAI80
68GLM 4.6VZhipu AI79.8
69GLM 4.5 AirZhipu AI78.8
70o3 MiniOpenAI78.5
71R1DeepSeek78.2
72Qwen3 Next 80B A3B ThinkingAlibaba78.2
73Trinity Large Thinkingarcee-ai78
74GLM 4.7 FlashZhipu AI77.5
75MiniMax M1MiniMax77.3
76o3 Mini HighOpenAI77.3
77GLM 4.5VZhipu AI75.3
78gpt-oss-120bOpenAI75.3
79o1OpenAI75
80Qwen3 8BAlibaba74.5
81DeepSeek V3 0324DeepSeek74.2
82MiniMax M2MiniMax73.8
83Mercury 2Inception73.8
84GPT-5 NanoOpenAI73
85Nova 2 LiteAmazon72.5
86Llama 4 MaverickMeta70.8
87GPT-4.1 NanoOpenAI70.3
88DeepSeek V3DeepSeek69.7
89GPT-4o-mini (2024-07-18)OpenAI69.7
90gpt-oss-20bOpenAI69.7
91Mistral Large 2407Mistral AI69
92GPT-4.1OpenAI66.7
93Granite 4.2 8BIBM64.8
94GPT-4oOpenAI64.3
95Mistral LargeMistral AI63.3
96GPT-4OpenAI62.7
97Command ACohere60.2
98Phi 4Microsoft59.3
99GPT-4 TurboOpenAI59.2
100Command R+ (08-2024)Cohere58.3
101Llama 3.3 70B InstructMeta57.2
102Claude Haiku 4.5Anthropic56.7
103GPT-4o-miniOpenAI53.7
104Llama 3.1 8B InstructMeta51.8
105Llama 3.1 70B InstructMeta49.7
106Llama 3.2 3B InstructMeta44.5
107Llama 3.2 1B InstructMeta35.2

评分计算方式

每个模型的评分是其可用基准测试结果的加权平均值。当模型缺少某些基准测试时,权重会在可用的基准测试之间重新归一化。 所有评分均为0-100的刻度。数据来源于官方模型卡片、已发表论文和第三方评估平台。

Frequently Asked Questions

根据我们的基准测试分析,Anthropic的Claude Opus 4.6目前在Writing领域排名第一,加权评分为100/100。

模型使用Arena Elo基准测试分数的加权平均进行排名。所有分数均归一化到0-100的刻度。

我们目前对107个拥有相关基准测试数据的模型进行了Writing任务排名。

Best AI Models for Writing (2026) | LM Market Cap