Skip to content

Best AI Models for Roleplay

AI models ranked by roleplay and creative conversation quality using Arena Elo ratings, normalized to a 0-100 scale.

Last updated: 31m ago
#1 Model

Claude Opus 4.6

Score: 100

Average Score

81

Across all ranked models

Models Ranked

106

With benchmark data

Weights:Arena Elo (100%)

Top Best for Roleplay Models by Weighted Score

Top 15 models by weighted score

LMMarketCap.com
#ModelScore
1Claude Opus 4.6Anthropic100
2Gemini 3.1 Pro PreviewGoogle99
3Muse Spark 1.1meta98.8
4Claude Opus 4.7Anthropic98.5
5GPT-5.4OpenAI97.5
6GPT-5.2OpenAI96.8
7Claude Opus 4.8Anthropic96.5
8Gemini 3.5 FlashGoogle96.2
9GPT-5.2 ChatOpenAI96
10GPT-5.5OpenAI95.8
11GLM 5.3 FlashZhipu AI95.8
12GPT-5.1OpenAI95.8
13Gemini 3 Flash PreviewGoogle95.7
14Grok 4.5xAI94.7
15MiMo-V2.5-ProXiaomi94.5
16GLM 5.1Zhipu AI94.3
17GPT-5OpenAI94.2
18Claude Sonnet 4.6Anthropic93.3
19Kimi K2.6Moonshot AI93.3
20Qwen3.6 Max PreviewAlibaba93.3
21GLM 5Zhipu AI93
22Gemini 3.5 Flash LiteGoogle92.7
23Hy3Tencent92.7
24Qwen3.7 PlusAlibaba92.7
25Claude Sonnet 4.5Anthropic92
26Gemma 4 31BGoogle91.8
27Claude Opus 4.1Anthropic91.7
28Gemini 2.5 ProGoogle90.7
29Qwen3.6 PlusAlibaba90.5
30Qwen3.5 397B A17BAlibaba90.3
31GLM 4.7Zhipu AI90.3
32MiniMax M3MiniMax90.2
33Inklingthinkingmachines90
34Gemma 4 26B A4B Google89.7
35Qwen3.8 27BAlibaba89.5
36MiMo-V2.5Xiaomi89
37GLM 5V TurboZhipu AI88.8
38Gemini 3.1 Flash Lite PreviewGoogle88.7
39Claude Opus 4.5Anthropic88.3
40Mistral Medium 3.5Mistral AI87.7
41DeepSeek V3.2DeepSeek87.5
42GLM 4.6Zhipu AI87.5
43DeepSeek V3.2 ExpDeepSeek87
44DeepSeek V3.1DeepSeek86.2
45Qwen3.5-122B-A10BAlibaba86.2
46o3OpenAI85.8
47MiniMax M2.7MiniMax85.8
48DeepSeek V3.1 TerminusDeepSeek85.8
49Qwen3 VL 235B A22B InstructAlibaba85.7
50Hy3 previewTencent85.5
51GLM 4.5Zhipu AI85.2
52Qwen3.5-27BAlibaba84.7
53Inkling Smallthinkingmachines84.2
54Qwen3 Next 80B A3B InstructAlibaba83.2
55Qwen3.5-FlashAlibaba82.8
56Gemini 2.5 FlashGoogle82.5
57Qwen3 VL 235B A22B ThinkingAlibaba82.5
58Qwen3.5-35B-A3BAlibaba82.5
59Step 3.5 FlashStepFun82.3
60MiniMax M2.5MiniMax81.7
61GPT-5 MiniOpenAI81.7
62Claude Sonnet 4Anthropic81.2
63GPT-4.1 MiniOpenAI80.5
64R1 0528DeepSeek80
65o4 MiniOpenAI80
66GLM 4.6VZhipu AI79.7
67GLM 4.5 AirZhipu AI78.8
68o3 MiniOpenAI78.5
69R1DeepSeek78.2
70Qwen3 Next 80B A3B ThinkingAlibaba78.2
71Trinity Large Thinkingarcee-ai78.2
72GLM 4.7 FlashZhipu AI77.7
73MiniMax M1MiniMax77.3
74o3 Mini HighOpenAI77.2
75GLM 4.5VZhipu AI75.5
76gpt-oss-120bOpenAI75.3
77o1OpenAI75
78Qwen3 8BAlibaba74.5
79Mercury 2Inception74.3
80MiniMax M2MiniMax74.3
81DeepSeek V3 0324DeepSeek74.2
82GPT-5 NanoOpenAI72.8
83Nova 2 LiteAmazon72.7
84Llama 4 MaverickMeta70.8
85GPT-4.1 NanoOpenAI70.3
86DeepSeek V3DeepSeek69.7
87GPT-4o-mini (2024-07-18)OpenAI69.7
88gpt-oss-20bOpenAI69.5
89Mistral Large 2407Mistral AI69
90GPT-4.1OpenAI66.7
91Granite 4.2 8BIBM64.5
92GPT-4oOpenAI64.3
93Mistral LargeMistral AI63.3
94GPT-4OpenAI62.7
95Command ACohere60.2
96Claude 3 HaikuAnthropic60.2
97Phi 4Microsoft59.3
98GPT-4 TurboOpenAI59.2
99Command R+ (08-2024)Cohere58.3
100Llama 3.3 70B InstructMeta57.2
101Claude Haiku 4.5Anthropic56.7
102GPT-4o-miniOpenAI53.7
103Llama 3.1 8B InstructMeta51.8
104Llama 3.1 70B InstructMeta49.7
105Llama 3.2 3B InstructMeta44.5
106Llama 3.2 1B InstructMeta35.2

How scores are calculated

Each model's score is a weighted average of its available benchmark results. When a model is missing some benchmarks, the weights are re-normalized across the benchmarks that are available. All scores are on a 0-100 scale. Data sourced from official model cards, published papers, and third-party evaluation platforms.

Frequently Asked Questions

Based on our benchmark analysis, Claude Opus 4.6 by Anthropic is currently the #1 ranked model for roleplay, with a weighted score of 100/100.

Models are ranked using a weighted average of Arena Elo benchmark scores. All scores are normalized to a 0-100 scale.

We currently rank 106 models that have relevant benchmark data for roleplay tasks.

Best AI Models for Roleplay (2026) | LM Market Cap