Skip to content

最佳数据分析AI模型

使用MMLU、MATH-500和GPQA基准测试分数对AI模型的数据分析能力进行排名。找到数据科学、分析和洞察的最佳LLM。

Last updated: 30m ago
第一名模型

o3

评分: 85.7

平均评分

70.1

所有排名模型

已排名模型

41

有基准测试数据

权重:MMLU (40%)MATH-500 (30%)GPQA (30%)

Top Best for Data Analysis Models by Weighted Score

Top 15 models by weighted score

LMMarketCap.com

Benchmark Breakdown

Per-benchmark scores for top 10 models

MMLU
MATH-500
GPQA
LMMarketCap.com
#模型评分
1o3OpenAI85.7
2GPT-5.4OpenAI85.2
3R1 0528DeepSeek84.8
4o1OpenAI84.4
5GPT-5.2OpenAI84.3
6R1DeepSeek84.2
7GPT-5.1OpenAI84
8GPT-5OpenAI83.5
9Gemini 2.5 ProGoogle83.4
10o3 MiniOpenAI82.5
11Claude Opus 4.6Anthropic82.3
12DeepSeek V3 0324DeepSeek81.4
13Claude Opus 4.5Anthropic81
14DeepSeek V3DeepSeek80.3
15Claude Opus 4Anthropic80
16Claude Sonnet 4.6Anthropic79.8
17Gemini 3 Flash PreviewGoogle79.2
18Claude Sonnet 4.5Anthropic78.7
19o4 MiniOpenAI77.8
20Claude Sonnet 4Anthropic77.4
21Gemini 2.5 FlashGoogle77.2
22Llama 4 MaverickMeta76.5
23GPT-4.1OpenAI76.2
24GPT-4oOpenAI75.2
25Gemini 3.1 Pro PreviewGoogle74.1
26Llama 3.3 70B InstructMeta74.1
27GPT-5.5OpenAI73.9
28GPT-5.5 ProOpenAI73.9
29Mistral LargeMistral AI72.9
30GPT-4 TurboOpenAI72.5
31Claude Haiku 4.5Anthropic71.4
32DeepSeek V3.2DeepSeek70.8
33Llama 3.1 70B InstructMeta70.5
34GPT-4o-miniOpenAI69.2
35Phi 4Microsoft64.3
36Llama 4 ScoutMeta60.3
37Gemma 2 27BGoogle60.2
38Command R7B (12-2024)Cohere6.3
39Llama 3.1 8B InstructMeta5.9
40Llama 3.2 3B InstructMeta4.9
41Qwen2.5 7B InstructAlibaba4.4

评分计算方式

每个模型的评分是其可用基准测试结果的加权平均值。当模型缺少某些基准测试时,权重会在可用的基准测试之间重新归一化。 所有评分均为0-100的刻度。数据来源于官方模型卡片、已发表论文和第三方评估平台。

Frequently Asked Questions

根据我们的基准测试分析,OpenAI的o3目前在Data Analysis领域排名第一,加权评分为85.7/100。

模型使用MMLU、MATH-500、GPQA基准测试分数的加权平均进行排名。所有分数均归一化到0-100的刻度。

我们目前对41个拥有相关基准测试数据的模型进行了Data Analysis任务排名。

Best AI Models for Data Analysis (2026) | LM Market Cap