Large Context Window AI Models
Compare 370 AI models with context windows of 32K tokens or more. The largest models support 2M tokens -- enough to process entire codebases, books, or hundreds of documents in a single prompt. Data updated hourly.
1M+ Tokens
(119 models)The largest context windows available. These models can process entire codebases, full books, or hundreds of documents in a single request.
| # | Model | Provider | Context Window | Pages | Input / 1M | Output / 1M |
|---|---|---|---|---|---|---|
| 1 | Grok 4.20 | xAI | 2M | ~3K | $1.25 | $2.50 |
| 2 | Grok 4.20 Multi-Agent | xAI | 2M | ~3K | $1.25 | $2.50 |
| 3 | Llama 4 Scout | Meta | 1.3M | ~2K | $0.10 | $0.30 |
| 4 | GPT-5.4 | OpenAI | 1.1M | ~1K | $2.50 | $15.00 |
| 5 | GPT-5.4 (batch) | OpenAI | 1.1M | ~1K | $1.25 | $7.50 |
| 6 | GPT-5.4 Pro | OpenAI | 1.1M | ~1K | $30.00 | $180.00 |
| 7 | GPT-5.4 Pro (batch) | OpenAI | 1.1M | ~1K | $15.00 | $90.00 |
| 8 | GPT-5.5 | OpenAI | 1.1M | ~1K | $5.00 | $30.00 |
| 9 | GPT-5.5 (batch) | OpenAI | 1.1M | ~1K | $2.50 | $15.00 |
| 10 | GPT-5.5 Pro | OpenAI | 1.1M | ~1K | $30.00 | $180.00 |
| 11 | GPT-5.5 Pro (batch) | OpenAI | 1.1M | ~1K | $15.00 | $90.00 |
| 12 | GPT-5.6 Luna | OpenAI | 1.1M | ~1K | $0.10 | $0.60 |
| 13 | GPT-5.6 Luna (batch) | OpenAI | 1.1M | ~1K | $0.10 | $0.60 |
| 14 | GPT-5.6 Luna Pro | OpenAI | 1.1M | ~1K | $0.10 | $0.60 |
| 15 | GPT-5.6 Luna Pro (batch) | OpenAI | 1.1M | ~1K | $0.10 | $0.60 |
| 16 | GPT-5.6 Sol | OpenAI | 1.1M | ~1K | $5.00 | $30.00 |
| 17 | GPT-5.6 Sol (batch) | OpenAI | 1.1M | ~1K | $2.50 | $15.00 |
| 18 | GPT-5.6 Sol Pro | OpenAI | 1.1M | ~1K | $5.00 | $30.00 |
| 19 | GPT-5.6 Sol Pro (batch) | OpenAI | 1.1M | ~1K | $2.50 | $15.00 |
| 20 | GPT-5.6 Terra | OpenAI | 1.1M | ~1K | $1.00 | $6.00 |
| 21 | GPT-5.6 Terra (batch) | OpenAI | 1.1M | ~1K | $1.00 | $6.00 |
| 22 | GPT-5.6 Terra Pro | OpenAI | 1.1M | ~1K | $1.00 | $6.00 |
| 23 | GPT-5.6 Terra Pro (batch) | OpenAI | 1.1M | ~1K | $1.00 | $6.00 |
| 24 | MiMo-V2.5 | Xiaomi | 1.1M | ~1K | $0.14 | $0.28 |
| 25 | MiMo-V2.5-Pro | Xiaomi | 1.1M | ~1K | $0.43 | $0.87 |
| 26 | OpenAI GPT Latest | ~openai | 1.1M | ~1K | $5.00 | $30.00 |
| 27 | LongCat 2.0 | Meituan | 1.0M | ~1K | $0.30 | $1.20 |
| 28 | DeepSeek V4 Flash 0423 | DeepSeek | 1.0M | ~1K | $0.14 | $0.28 |
| 29 | DeepSeek V4 Flash 0731 | DeepSeek | 1.0M | ~1K | $0.09 | $0.18 |
| 30 | DeepSeek V4 Flash Latest | ~deepseek | 1.0M | ~1K | $0.09 | $0.18 |
| 31 | DeepSeek V4 Pro | DeepSeek | 1.0M | ~1K | $0.43 | $0.87 |
| 32 | Gemini 2.5 Flash | 1.0M | ~1K | $0.30 | $2.50 | |
| 33 | Gemini 2.5 Flash (batch) | 1.0M | ~1K | $0.15 | $1.25 | |
| 34 | Gemini 2.5 Flash Lite | 1.0M | ~1K | $0.10 | $0.40 | |
| 35 | Gemini 2.5 Flash Lite (batch) | 1.0M | ~1K | $0.05 | $0.20 | |
| 36 | Gemini 2.5 Pro | 1.0M | ~1K | $1.25 | $10.00 | |
| 37 | Gemini 2.5 Pro (batch) | 1.0M | ~1K | $0.63 | $5.00 | |
| 38 | Gemini 2.5 Pro Preview 05-06 | 1.0M | ~1K | $1.25 | $10.00 | |
| 39 | Gemini 2.5 Pro Preview 06-05 | 1.0M | ~1K | $1.25 | $10.00 | |
| 40 | Gemini 3 Flash Preview | 1.0M | ~1K | $0.50 | $3.00 | |
| 41 | Gemini 3 Flash Preview (batch) | 1.0M | ~1K | $0.25 | $1.50 | |
| 42 | Gemini 3.1 Flash Lite | 1.0M | ~1K | $0.25 | $1.50 | |
| 43 | Gemini 3.1 Flash Lite (batch) | 1.0M | ~1K | $0.13 | $0.75 | |
| 44 | Gemini 3.1 Flash Lite Preview | 1.0M | ~1K | $0.25 | $1.50 | |
| 45 | Gemini 3.1 Pro Preview | 1.0M | ~1K | $2.00 | $12.00 | |
| 46 | Gemini 3.1 Pro Preview (batch) | 1.0M | ~1K | $1.00 | $6.00 | |
| 47 | Gemini 3.1 Pro Preview Custom Tools | 1.0M | ~1K | $2.00 | $12.00 | |
| 48 | Gemini 3.5 Flash | 1.0M | ~1K | $1.50 | $9.00 | |
| 49 | Gemini 3.5 Flash (batch) | 1.0M | ~1K | $0.75 | $4.50 | |
| 50 | Gemini 3.5 Flash Lite | 1.0M | ~1K | $0.30 | $2.50 | |
| 51 | Gemini 3.5 Flash Lite (batch) | 1.0M | ~1K | $0.15 | $1.25 | |
| 52 | Gemini 3.6 Flash | 1.0M | ~1K | $1.50 | $7.50 | |
| 53 | Gemini 3.6 Flash (batch) | 1.0M | ~1K | $0.75 | $3.75 | |
| 54 | GLM 5.2 | Zhipu AI | 1.0M | ~1K | $0.24 | $0.74 |
| 55 | Google Gemini Flash Latest | 1.0M | ~1K | $1.50 | $7.50 | |
| 56 | Google Gemini Pro Latest | 1.0M | ~1K | $2.00 | $12.00 | |
| 57 | Inkling | thinkingmachines | 1.0M | ~1K | $0.95 | $4.05 |
| 58 | Kimi K3 | Moonshot AI | 1.0M | ~1K | $3.00 | $15.00 |
| 59 | Laguna S 2.1 | poolside | 1.0M | ~1K | $0.09 | $0.18 |
| 60 | Llama 4 Maverick | Meta | 1.0M | ~1K | $0.20 | $0.80 |
| 61 | Llama Guard 4 12B | Meta | 1.0M | ~1K | $0.18 | $0.18 |
| 62 | Lyria 3 Clip Preview | 1.0M | ~1K | Free | Free | |
| 63 | Lyria 3 Pro Preview | 1.0M | ~1K | Free | Free | |
| 64 | MiniMax M3 | MiniMax | 1.0M | ~1K | $0.30 | $1.20 |
| 65 | MoonshotAI Kimi Latest | ~moonshotai | 1.0M | ~1K | $2.50 | $14.00 |
| 66 | Muse Spark 1.1 | meta | 1.0M | ~1K | $1.25 | $4.25 |
| 67 | Muse Spark 1.2 | meta | 1.0M | ~1K | $1.25 | $4.25 |
| 68 | GPT-4.1 | OpenAI | 1.0M | ~1K | $2.00 | $8.00 |
| 69 | GPT-4.1 (batch) | OpenAI | 1.0M | ~1K | $1.00 | $4.00 |
| 70 | GPT-4.1 Mini | OpenAI | 1.0M | ~1K | $0.40 | $1.60 |
| 71 | GPT-4.1 Mini (batch) | OpenAI | 1.0M | ~1K | $0.20 | $0.80 |
| 72 | GPT-4.1 Nano | OpenAI | 1.0M | ~1K | $0.10 | $0.40 |
| 73 | GPT-4.1 Nano (batch) | OpenAI | 1.0M | ~1K | $0.05 | $0.20 |
| 74 | Palmyra X5 | Writer | 1.0M | ~1K | $0.60 | $6.00 |
| 75 | MiniMax-01 | MiniMax | 1.0M | ~1K | $0.20 | $1.10 |
| 76 | Anthropic Claude Sonnet Latest | ~anthropic | 1M | ~1K | $2.00 | $10.00 |
| 77 | Claude Fable 5 | Anthropic | 1M | ~1K | $10.00 | $50.00 |
| 78 | Claude Fable 5 (batch) | Anthropic | 1M | ~1K | $5.00 | $25.00 |
| 79 | Claude Fable Latest | ~anthropic | 1M | ~1K | $10.00 | $50.00 |
| 80 | Claude Opus 4.6 | Anthropic | 1M | ~1K | $5.00 | $25.00 |
| 81 | Claude Opus 4.6 (batch) | Anthropic | 1M | ~1K | $2.50 | $12.50 |
| 82 | Claude Opus 4.7 | Anthropic | 1M | ~1K | $5.00 | $25.00 |
| 83 | Claude Opus 4.7 (batch) | Anthropic | 1M | ~1K | $2.50 | $12.50 |
| 84 | Claude Opus 4.7 (Fast) | Anthropic | 1M | ~1K | $30.00 | $150.00 |
| 85 | Claude Opus 4.8 | Anthropic | 1M | ~1K | $5.00 | $25.00 |
| 86 | Claude Opus 4.8 (batch) | Anthropic | 1M | ~1K | $2.50 | $12.50 |
| 87 | Claude Opus 4.8 (Fast) | Anthropic | 1M | ~1K | $10.00 | $50.00 |
| 88 | Claude Opus 5 | Anthropic | 1M | ~1K | $5.00 | $25.00 |
| 89 | Claude Opus 5 (batch) | Anthropic | 1M | ~1K | $2.50 | $12.50 |
| 90 | Claude Opus 5 (Fast) | Anthropic | 1M | ~1K | $10.00 | $50.00 |
| 91 | Claude Opus Latest | ~anthropic | 1M | ~1K | $5.00 | $25.00 |
| 92 | Claude Sonnet 4 | Anthropic | 1M | ~1K | $3.00 | $15.00 |
| 93 | Claude Sonnet 4.5 | Anthropic | 1M | ~1K | $3.00 | $15.00 |
| 94 | Claude Sonnet 4.5 (batch) | Anthropic | 1M | ~1K | $1.50 | $7.50 |
| 95 | Claude Sonnet 4.6 | Anthropic | 1M | ~1K | $3.00 | $15.00 |
| 96 | Claude Sonnet 4.6 (batch) | Anthropic | 1M | ~1K | $1.50 | $7.50 |
| 97 | Claude Sonnet 5 | Anthropic | 1M | ~1K | $2.00 | $10.00 |
| 98 | Claude Sonnet 5 (batch) | Anthropic | 1M | ~1K | $1.00 | $5.00 |
| 99 | Fugu Ultra | sakana | 1M | ~1K | $5.00 | $30.00 |
| 100 | Grok 4.3 | xAI | 1M | ~1K | $1.25 | $2.50 |
| 101 | MiniMax M1 | MiniMax | 1M | ~1K | $0.55 | $2.20 |
| 102 | Nemotron 3 Super | NVIDIA | 1M | ~1K | $0.08 | $0.40 |
| 103 | Nemotron 3 Ultra (free) | NVIDIA | 1M | ~1K | Free | Free |
| 104 | Nova 2 Lite | Amazon | 1M | ~1K | $0.30 | $2.50 |
| 105 | Nova Premier 1.0 | Amazon | 1M | ~1K | $2.50 | $12.50 |
| 106 | Qwen Plus 0728 | Alibaba | 1M | ~1K | $0.26 | $0.78 |
| 107 | Qwen Plus 0728 (thinking) | Alibaba | 1M | ~1K | $0.40 | $1.20 |
| 108 | Qwen-Plus | Alibaba | 1M | ~1K | $0.26 | $0.78 |
| 109 | Qwen3 Coder Flash | Alibaba | 1M | ~1K | $0.20 | $0.97 |
| 110 | Qwen3 Coder Plus | Alibaba | 1M | ~1K | $0.65 | $3.25 |
| 111 | Qwen3.5 Plus 2026-02-15 | Alibaba | 1M | ~1K | $0.26 | $1.56 |
| 112 | Qwen3.5 Plus 2026-04-20 | Alibaba | 1M | ~1K | $0.30 | $1.80 |
| 113 | Qwen3.5-Flash | Alibaba | 1M | ~1K | $0.07 | $0.26 |
| 114 | Qwen3.6 Flash | Alibaba | 1M | ~1K | $0.19 | $1.13 |
| 115 | Qwen3.6 Plus | Alibaba | 1M | ~1K | $0.33 | $1.95 |
| 116 | Qwen3.7 Flash | Alibaba | 1M | ~1K | $0.03 | $0.13 |
| 117 | Qwen3.7 Max | Alibaba | 1M | ~1K | $1.48 | $4.42 |
| 118 | Qwen3.7 Plus | Alibaba | 1M | ~1K | $0.32 | $1.28 |
| 119 | Qwen3.8 Max | Alibaba | 1M | ~1K | $2.00 | $6.00 |
200K+ Tokens
(149 models)Extended context models ideal for long documents, legal contracts, research papers, and multi-file code analysis.
| # | Model | Provider | Context Window | Pages | Input / 1M | Output / 1M |
|---|---|---|---|---|---|---|
| 1 | Inkling (batch) | thinkingmachines | 524K | ~699 | $0.50 | $2.02 |
| 2 | Inkling Small | thinkingmachines | 524K | ~699 | $0.45 | $1.20 |
| 3 | MiniMax M3 (batch) | MiniMax | 524K | ~699 | $0.15 | $0.60 |
| 4 | Nemotron 3 Ultra | NVIDIA | 512K | ~683 | $0.60 | $3.60 |
| 5 | Nemotron 3 Ultra (batch) | NVIDIA | 512K | ~683 | $0.30 | $1.80 |
| 6 | GLM 5.2 (batch) | Zhipu AI | 512K | ~683 | $0.70 | $2.20 |
| 7 | Grok 4.5 | xAI | 500K | ~667 | $2.00 | $6.00 |
| 8 | Grok Latest | ~x-ai | 500K | ~667 | $2.00 | $6.00 |
| 9 | GPT Chat Latest | OpenAI | 400K | ~533 | $5.00 | $30.00 |
| 10 | GPT-5 | OpenAI | 400K | ~533 | $1.25 | $10.00 |
| 11 | GPT-5 (batch) | OpenAI | 400K | ~533 | $0.63 | $5.00 |
| 12 | GPT-5 Codex (batch) | OpenAI | 400K | ~533 | $0.63 | $5.00 |
| 13 | GPT-5 Image | OpenAI | 400K | ~533 | $10.00 | $10.00 |
| 14 | GPT-5 Image Mini | OpenAI | 400K | ~533 | $2.50 | $2.00 |
| 15 | GPT-5 Mini | OpenAI | 400K | ~533 | $0.25 | $2.00 |
| 16 | GPT-5 Mini (batch) | OpenAI | 400K | ~533 | $0.13 | $1.00 |
| 17 | GPT-5 Nano | OpenAI | 400K | ~533 | $0.05 | $0.40 |
| 18 | GPT-5 Nano (batch) | OpenAI | 400K | ~533 | $0.02 | $0.20 |
| 19 | GPT-5 Pro | OpenAI | 400K | ~533 | $15.00 | $120.00 |
| 20 | GPT-5 Pro (batch) | OpenAI | 400K | ~533 | $7.50 | $60.00 |
| 21 | GPT-5.1 | OpenAI | 400K | ~533 | $1.25 | $10.00 |
| 22 | GPT-5.1 (batch) | OpenAI | 400K | ~533 | $0.63 | $5.00 |
| 23 | GPT-5.1-Codex | OpenAI | 400K | ~533 | $1.25 | $10.00 |
| 24 | GPT-5.1-Codex-Max | OpenAI | 400K | ~533 | $1.25 | $10.00 |
| 25 | GPT-5.1-Codex-Mini | OpenAI | 400K | ~533 | $0.25 | $2.00 |
| 26 | GPT-5.2 | OpenAI | 400K | ~533 | $1.75 | $14.00 |
| 27 | GPT-5.2 (batch) | OpenAI | 400K | ~533 | $0.88 | $7.00 |
| 28 | GPT-5.2 Pro | OpenAI | 400K | ~533 | $21.00 | $168.00 |
| 29 | GPT-5.2 Pro (batch) | OpenAI | 400K | ~533 | $10.50 | $84.00 |
| 30 | GPT-5.2-Codex | OpenAI | 400K | ~533 | $1.75 | $14.00 |
| 31 | GPT-5.3-Codex | OpenAI | 400K | ~533 | $1.75 | $14.00 |
| 32 | GPT-5.4 Mini | OpenAI | 400K | ~533 | $0.75 | $4.50 |
| 33 | GPT-5.4 Mini (batch) | OpenAI | 400K | ~533 | $0.38 | $2.25 |
| 34 | GPT-5.4 Nano | OpenAI | 400K | ~533 | $0.20 | $1.25 |
| 35 | GPT-5.4 Nano (batch) | OpenAI | 400K | ~533 | $0.10 | $0.63 |
| 36 | OpenAI GPT Mini Latest | ~openai | 400K | ~533 | $0.75 | $4.50 |
| 37 | Nova Lite 1.0 | Amazon | 300K | ~400 | $0.06 | $0.24 |
| 38 | Nova Pro 1.0 | Amazon | 300K | ~400 | $0.80 | $3.20 |
| 39 | GPT-5.4 Image 2 | OpenAI | 272K | ~363 | $8.00 | $15.00 |
| 40 | Falcon-H1-Arabic 34B Instruct | TII | 262K | ~350 | Free | Free |
| 41 | Falcon-H1-Arabic 7B Instruct | TII | 262K | ~350 | Free | Free |
| 42 | Gemma 3 27B | 262K | ~350 | $0.08 | $0.45 | |
| 43 | Gemma 4 26B A4B | 262K | ~350 | $0.07 | $0.34 | |
| 44 | Gemma 4 26B A4B (free) | 262K | ~350 | Free | Free | |
| 45 | Gemma 4 31B | 262K | ~350 | $0.10 | $0.34 | |
| 46 | Gemma 4 31B (free) | 262K | ~350 | Free | Free | |
| 47 | Hy3 | Tencent | 262K | ~350 | $0.13 | $0.53 |
| 48 | Hy3 preview | Tencent | 262K | ~350 | $0.06 | $0.21 |
| 49 | KAT-Coder-Pro V2 | Kuaishou | 262K | ~350 | $0.30 | $1.20 |
| 50 | Kimi K2 0905 | Moonshot AI | 262K | ~350 | $0.60 | $2.50 |
| 51 | Kimi K2 Thinking | Moonshot AI | 262K | ~350 | $0.60 | $2.50 |
| 52 | Kimi K2.5 | Moonshot AI | 262K | ~350 | $0.57 | $2.85 |
| 53 | Kimi K2.6 | Moonshot AI | 262K | ~350 | $0.58 | $2.44 |
| 54 | Kimi K2.7 Code | Moonshot AI | 262K | ~350 | $0.70 | $3.50 |
| 55 | Kimi K2.7 Code (batch) | Moonshot AI | 262K | ~350 | $0.47 | $2.00 |
| 56 | Laguna S 2.1 (free) | poolside | 262K | ~350 | Free | Free |
| 57 | Laguna XS 2.1 | poolside | 262K | ~350 | $0.06 | $0.12 |
| 58 | Laguna XS 2.1 (free) | poolside | 262K | ~350 | Free | Free |
| 59 | Ling 3.0 Tiny (free) | inclusionai | 262K | ~350 | Free | Free |
| 60 | Ling-2.6-1T | inclusionai | 262K | ~350 | $0.07 | $0.63 |
| 61 | Ling-2.6-flash | inclusionai | 262K | ~350 | $0.01 | $0.03 |
| 62 | Ling-3.0-flash | inclusionai | 262K | ~350 | $0.02 | $0.06 |
| 63 | Ministral 3 14B 2512 | Mistral AI | 262K | ~350 | $0.20 | $0.20 |
| 64 | Ministral 3 8B 2512 | Mistral AI | 262K | ~350 | $0.15 | $0.15 |
| 65 | Mistral Large 3 2512 | Mistral AI | 262K | ~350 | $0.50 | $1.50 |
| 66 | Mistral Medium 3.5 | Mistral AI | 262K | ~350 | $1.50 | $7.50 |
| 67 | Mistral Small 4 | Mistral AI | 262K | ~350 | $0.15 | $0.60 |
| 68 | Nemotron 3 Nano 30B A3B | NVIDIA | 262K | ~350 | $0.05 | $0.20 |
| 69 | Nemotron 3 Super (free) | NVIDIA | 262K | ~350 | Free | Free |
| 70 | Qwen3 235B A22B Instruct 2507 | Alibaba | 262K | ~350 | $0.09 | $0.55 |
| 71 | Qwen3 235B A22B Thinking 2507 | Alibaba | 262K | ~350 | $0.23 | $2.30 |
| 72 | Qwen3 30B A3B Instruct 2507 | Alibaba | 262K | ~350 | $0.05 | $0.19 |
| 73 | Qwen3 Coder 30B A3B Instruct | Alibaba | 262K | ~350 | $0.07 | $0.27 |
| 74 | Qwen3 Coder 480B A35B | Alibaba | 262K | ~350 | $0.30 | $1.00 |
| 75 | Qwen3 Coder Next | Alibaba | 262K | ~350 | $0.12 | $0.80 |
| 76 | Qwen3 Max | Alibaba | 262K | ~350 | $0.78 | $3.90 |
| 77 | Qwen3 Max Thinking | Alibaba | 262K | ~350 | $0.78 | $3.90 |
| 78 | Qwen3 Next 80B A3B Instruct | Alibaba | 262K | ~350 | $0.09 | $1.10 |
| 79 | Qwen3 Next 80B A3B Thinking | Alibaba | 262K | ~350 | $0.15 | $1.20 |
| 80 | Qwen3 VL 235B A22B Instruct | Alibaba | 262K | ~350 | $0.21 | $1.90 |
| 81 | Qwen3 VL 30B A3B Instruct | Alibaba | 262K | ~350 | $0.15 | $0.60 |
| 82 | Qwen3 VL 30B A3B Thinking | Alibaba | 262K | ~350 | $0.20 | $2.40 |
| 83 | Qwen3 VL 8B Instruct | Alibaba | 262K | ~350 | $0.12 | $0.45 |
| 84 | Qwen3.5 397B A17B | Alibaba | 262K | ~350 | $0.39 | $2.34 |
| 85 | Qwen3.5-122B-A10B | Alibaba | 262K | ~350 | $0.29 | $2.40 |
| 86 | Qwen3.5-27B | Alibaba | 262K | ~350 | $0.20 | $1.56 |
| 87 | Qwen3.5-35B-A3B | Alibaba | 262K | ~350 | $0.14 | $1.00 |
| 88 | Qwen3.5-9B | Alibaba | 262K | ~350 | $0.10 | $0.15 |
| 89 | Qwen3.6 27B | Alibaba | 262K | ~350 | $0.60 | $3.60 |
| 90 | Qwen3.6 35B A3B | Alibaba | 262K | ~350 | $0.15 | $1.00 |
| 91 | Qwen3.6 Max Preview | Alibaba | 262K | ~350 | $1.03 | $6.16 |
| 92 | Ring-2.6-1T | inclusionai | 262K | ~350 | $0.07 | $0.63 |
| 93 | Seed 1.6 | ByteDance | 262K | ~350 | $0.25 | $2.00 |
| 94 | Seed 1.6 Flash | ByteDance | 262K | ~350 | $0.07 | $0.30 |
| 95 | Seed-2.0-Lite | ByteDance | 262K | ~350 | $0.25 | $2.00 |
| 96 | Seed-2.0-Mini | ByteDance | 262K | ~350 | $0.10 | $0.40 |
| 97 | Step 3.5 Flash | StepFun | 262K | ~350 | $0.10 | $0.30 |
| 98 | Step 3.7 Flash | StepFun | 262K | ~350 | $0.20 | $1.15 |
| 99 | Trinity Large Thinking | arcee-ai | 262K | ~350 | $0.22 | $0.85 |
| 100 | Codestral 2508 | Mistral AI | 256K | ~341 | $0.30 | $0.90 |
| 101 | Command A | Cohere | 256K | ~341 | $2.50 | $10.00 |
| 102 | Grok Build 0.1 | xAI | 256K | ~341 | $1.00 | $2.00 |
| 103 | Jamba Large 1.7 | AI21 Labs | 256K | ~341 | $2.00 | $8.00 |
| 104 | KAT-Coder-Air V2.5 | Kuaishou | 256K | ~341 | $0.15 | $0.60 |
| 105 | KAT-Coder-Pro V2.5 | Kuaishou | 256K | ~341 | $0.74 | $2.96 |
| 106 | Mistral Small 3.2 24B | Mistral AI | 256K | ~341 | $0.09 | $0.25 |
| 107 | Nemotron 3 Nano 30B A3B (free) | NVIDIA | 256K | ~341 | Free | Free |
| 108 | Nemotron 3 Nano Omni (free) | NVIDIA | 256K | ~341 | Free | Free |
| 109 | North Mini Code (free) | Cohere | 256K | ~341 | Free | Free |
| 110 | GLM 4.6 | Zhipu AI | 205K | ~273 | $0.50 | $2.00 |
| 111 | GLM 4.7 | Zhipu AI | 205K | ~273 | $0.40 | $1.75 |
| 112 | GLM 5 | Zhipu AI | 205K | ~273 | $0.95 | $2.55 |
| 113 | GLM 5.1 | Zhipu AI | 205K | ~273 | $0.95 | $2.99 |
| 114 | MiniMax M2 | MiniMax | 205K | ~273 | $0.26 | $1.02 |
| 115 | MiniMax M2.1 | MiniMax | 205K | ~273 | $0.30 | $1.20 |
| 116 | MiniMax M2.5 | MiniMax | 205K | ~273 | $0.22 | $0.90 |
| 117 | MiniMax M2.7 | MiniMax | 205K | ~273 | $0.27 | $1.08 |
| 118 | GLM 4.7 Flash | Zhipu AI | 203K | ~270 | $0.06 | $0.40 |
| 119 | GLM 5 Turbo | Zhipu AI | 203K | ~270 | $1.20 | $4.00 |
| 120 | GLM 5V Turbo | Zhipu AI | 203K | ~270 | $1.20 | $4.00 |
| 121 | Anthropic Claude Haiku Latest | ~anthropic | 200K | ~267 | $1.00 | $5.00 |
| 122 | Claude 3 Haiku | Anthropic | 200K | ~267 | $0.25 | $1.25 |
| 123 | Claude Haiku 4.5 | Anthropic | 200K | ~267 | $1.00 | $5.00 |
| 124 | Claude Haiku 4.5 (batch) | Anthropic | 200K | ~267 | $0.50 | $2.50 |
| 125 | Claude Opus 4 | Anthropic | 200K | ~267 | $15.00 | $75.00 |
| 126 | Claude Opus 4.1 | Anthropic | 200K | ~267 | $15.00 | $75.00 |
| 127 | Claude Opus 4.1 (batch) | Anthropic | 200K | ~267 | $7.50 | $37.50 |
| 128 | Claude Opus 4.5 | Anthropic | 200K | ~267 | $5.00 | $25.00 |
| 129 | Claude Opus 4.5 (batch) | Anthropic | 200K | ~267 | $2.50 | $12.50 |
| 130 | Composer 2 | Cursor | 200K | ~267 | $0.50 | $2.50 |
| 131 | Composer 2 Fast | Cursor | 200K | ~267 | $1.50 | $7.50 |
| 132 | o1 | OpenAI | 200K | ~267 | $15.00 | $60.00 |
| 133 | o1 (batch) | OpenAI | 200K | ~267 | $7.50 | $30.00 |
| 134 | o1-pro | OpenAI | 200K | ~267 | $150.00 | $600.00 |
| 135 | o1-pro (batch) | OpenAI | 200K | ~267 | $75.00 | $300.00 |
| 136 | o3 | OpenAI | 200K | ~267 | $2.00 | $8.00 |
| 137 | o3 (batch) | OpenAI | 200K | ~267 | $1.00 | $4.00 |
| 138 | o3 Mini | OpenAI | 200K | ~267 | $1.10 | $4.40 |
| 139 | o3 Mini (batch) | OpenAI | 200K | ~267 | $0.55 | $2.20 |
| 140 | o3 Mini High | OpenAI | 200K | ~267 | $1.10 | $4.40 |
| 141 | o3 Mini High (batch) | OpenAI | 200K | ~267 | $0.55 | $2.20 |
| 142 | o3 Pro | OpenAI | 200K | ~267 | $20.00 | $80.00 |
| 143 | o3 Pro (batch) | OpenAI | 200K | ~267 | $10.00 | $40.00 |
| 144 | o4 Mini | OpenAI | 200K | ~267 | $1.10 | $4.40 |
| 145 | o4 Mini (batch) | OpenAI | 200K | ~267 | $0.55 | $2.20 |
| 146 | o4 Mini High | OpenAI | 200K | ~267 | $1.10 | $4.40 |
| 147 | o4 Mini High (batch) | OpenAI | 200K | ~267 | $0.55 | $2.20 |
| 148 | Sonar Pro | Perplexity | 200K | ~267 | $3.00 | $15.00 |
| 149 | Sonar Pro Search | Perplexity | 200K | ~267 | $3.00 | $15.00 |
128K Tokens
(76 models)The current standard for frontier models. Sufficient for most production use cases, including long conversations and medium-length documents.
| # | Model | Provider | Context Window | Pages | Input / 1M | Output / 1M |
|---|---|---|---|---|---|---|
| 1 | DeepSeek V3 | DeepSeek | 164K | ~218 | $0.26 | $1.03 |
| 2 | DeepSeek V3 0324 | DeepSeek | 164K | ~218 | $0.27 | $1.12 |
| 3 | DeepSeek V3.1 | DeepSeek | 164K | ~218 | $0.25 | $0.95 |
| 4 | DeepSeek V3.1 Terminus | DeepSeek | 164K | ~218 | $0.27 | $1.00 |
| 5 | DeepSeek V3.2 | DeepSeek | 164K | ~218 | $0.26 | $0.38 |
| 6 | DeepSeek V3.2 Exp | DeepSeek | 164K | ~218 | $0.27 | $0.41 |
| 7 | R1 | DeepSeek | 164K | ~218 | $0.70 | $2.50 |
| 8 | R1 0528 | DeepSeek | 164K | ~218 | $0.50 | $2.15 |
| 9 | Aion-2.0 | aion-labs | 131K | ~175 | $0.80 | $1.60 |
| 10 | Aion-3.0 | aion-labs | 131K | ~175 | $3.00 | $6.00 |
| 11 | Aion-3.0-Mini | aion-labs | 131K | ~175 | $0.70 | $1.40 |
| 12 | Falcon-H1-Arabic 3B Instruct | TII | 131K | ~175 | Free | Free |
| 13 | Gemma 3 12B | 131K | ~175 | $0.05 | $0.15 | |
| 14 | Gemma 3 4B | 131K | ~175 | $0.05 | $0.10 | |
| 15 | GLM 4.5 | Zhipu AI | 131K | ~175 | $0.60 | $2.20 |
| 16 | GLM 4.5 Air | Zhipu AI | 131K | ~175 | $0.13 | $0.85 |
| 17 | GLM 4.6V | Zhipu AI | 131K | ~175 | $0.30 | $0.90 |
| 18 | gpt-oss-120b | OpenAI | 131K | ~175 | $0.04 | $0.17 |
| 19 | gpt-oss-20b | OpenAI | 131K | ~175 | $0.03 | $0.13 |
| 20 | gpt-oss-20b (free) | OpenAI | 131K | ~175 | Free | Free |
| 21 | gpt-oss-safeguard-20b | OpenAI | 131K | ~175 | $0.07 | $0.30 |
| 22 | Granite 4.1 8B | IBM | 131K | ~175 | $0.05 | $0.10 |
| 23 | Hunyuan A13B Instruct | Tencent | 131K | ~175 | $0.14 | $0.57 |
| 24 | Kimi K2 0711 | Moonshot AI | 131K | ~175 | $0.57 | $2.30 |
| 25 | Llama 3.1 70B Instruct | Meta | 131K | ~175 | $0.40 | $0.40 |
| 26 | Llama 3.1 8B Instruct | Meta | 131K | ~175 | $0.05 | $0.08 |
| 27 | Llama 3.2 3B Instruct | Meta | 131K | ~175 | $0.05 | $0.33 |
| 28 | Llama 3.3 70B Instruct | Meta | 131K | ~175 | $0.10 | $0.32 |
| 29 | Ministral 3 3B 2512 | Mistral AI | 131K | ~175 | $0.10 | $0.10 |
| 30 | Mistral Large 2407 | Mistral AI | 131K | ~175 | $2.00 | $6.00 |
| 31 | Mistral Medium 3 | Mistral AI | 131K | ~175 | $0.40 | $2.00 |
| 32 | Mistral Medium 3.1 | Mistral AI | 131K | ~175 | $0.40 | $2.00 |
| 33 | Mistral Nemo | Mistral AI | 131K | ~175 | $0.02 | $0.03 |
| 34 | Nano Banana 2 (Gemini 3.1 Flash Image) | 131K | ~175 | $0.50 | $3.00 | |
| 35 | Nano Banana Pro (Gemini 3 Pro Image) | 131K | ~175 | $2.00 | $12.00 | |
| 36 | Qwen3 14B | Alibaba | 131K | ~175 | $0.23 | $0.91 |
| 37 | Qwen3 235B A22B | Alibaba | 131K | ~175 | $0.45 | $1.82 |
| 38 | Qwen3 30B A3B | Alibaba | 131K | ~175 | $0.12 | $0.50 |
| 39 | Qwen3 32B | Alibaba | 131K | ~175 | $0.08 | $0.28 |
| 40 | Qwen3 8B | Alibaba | 131K | ~175 | $0.12 | $0.45 |
| 41 | Qwen3 VL 235B A22B Thinking | Alibaba | 131K | ~175 | $0.40 | $4.00 |
| 42 | Qwen3 VL 32B Instruct | Alibaba | 131K | ~175 | $0.10 | $0.42 |
| 43 | Qwen3 VL 8B Thinking | Alibaba | 131K | ~175 | $0.18 | $2.10 |
| 44 | Solar Pro 3 | Upstage | 131K | ~175 | $0.15 | $0.60 |
| 45 | Virtuoso Large | arcee-ai | 131K | ~175 | $0.75 | $1.20 |
| 46 | Granite 4.0 Micro | IBM | 131K | ~175 | $0.02 | $0.11 |
| 47 | Cogito v2.1 671B | deepcogito | 128K | ~171 | $1.25 | $1.25 |
| 48 | Command R (08-2024) | Cohere | 128K | ~171 | $0.15 | $0.60 |
| 49 | Command R+ (08-2024) | Cohere | 128K | ~171 | $2.50 | $10.00 |
| 50 | Command R7B (12-2024) | Cohere | 128K | ~171 | $0.04 | $0.15 |
| 51 | GPT Audio | OpenAI | 128K | ~171 | $2.50 | $10.00 |
| 52 | GPT Audio Mini | OpenAI | 128K | ~171 | $0.60 | $2.40 |
| 53 | GPT-4 Turbo | OpenAI | 128K | ~171 | $10.00 | $30.00 |
| 54 | GPT-4 Turbo (batch) | OpenAI | 128K | ~171 | $5.00 | $15.00 |
| 55 | GPT-4 Turbo Preview | OpenAI | 128K | ~171 | $10.00 | $30.00 |
| 56 | GPT-4o | OpenAI | 128K | ~171 | $2.50 | $10.00 |
| 57 | GPT-4o (2024-05-13) | OpenAI | 128K | ~171 | $5.00 | $15.00 |
| 58 | GPT-4o (2024-08-06) | OpenAI | 128K | ~171 | $2.50 | $10.00 |
| 59 | GPT-4o (2024-11-20) | OpenAI | 128K | ~171 | $2.50 | $10.00 |
| 60 | GPT-4o (batch) | OpenAI | 128K | ~171 | $1.25 | $5.00 |
| 61 | GPT-4o-mini | OpenAI | 128K | ~171 | $0.15 | $0.60 |
| 62 | GPT-4o-mini (2024-07-18) | OpenAI | 128K | ~171 | $0.15 | $0.60 |
| 63 | GPT-4o-mini (batch) | OpenAI | 128K | ~171 | $0.07 | $0.30 |
| 64 | GPT-5.2 Chat | OpenAI | 128K | ~171 | $1.75 | $14.00 |
| 65 | GPT-5.3 Chat | OpenAI | 128K | ~171 | $1.75 | $14.00 |
| 66 | Mercury 2 | Inception | 128K | ~171 | $0.25 | $0.75 |
| 67 | Mistral Large | Mistral AI | 128K | ~171 | $2.00 | $6.00 |
| 68 | Mistral Small 3.1 24B | Mistral AI | 128K | ~171 | $0.35 | $0.55 |
| 69 | Nemotron 3.5 Content Safety (free) | NVIDIA | 128K | ~171 | Free | Free |
| 70 | Nemotron Nano 12B 2 VL (free) | NVIDIA | 128K | ~171 | Free | Free |
| 71 | Nemotron Nano 9B V2 (free) | NVIDIA | 128K | ~171 | Free | Free |
| 72 | Nova Micro 1.0 | Amazon | 128K | ~171 | $0.04 | $0.14 |
| 73 | Qwen2.5 VL 72B Instruct | Alibaba | 128K | ~171 | $0.25 | $0.75 |
| 74 | Sonar Deep Research | Perplexity | 128K | ~171 | $2.00 | $8.00 |
| 75 | Sonar Reasoning Pro | Perplexity | 128K | ~171 | $2.00 | $8.00 |
| 76 | UI-TARS 7B | ByteDance | 128K | ~171 | $0.10 | $0.20 |
32K–64K Tokens
(26 models)Moderate context windows suitable for shorter documents, code files, and focused conversations.
| # | Model | Provider | Context Window | Pages | Input / 1M | Output / 1M |
|---|---|---|---|---|---|---|
| 1 | Sonar | Perplexity | 127K | ~169 | $1.00 | $1.00 |
| 2 | ERNIE 4.5 VL 424B A47B | Baidu | 123K | ~164 | $0.42 | $1.25 |
| 3 | Qwen3 30B A3B Thinking 2507 | Alibaba | 82K | ~109 | $0.20 | $2.40 |
| 4 | GLM 4.5V | Zhipu AI | 66K | ~87 | $0.60 | $1.80 |
| 5 | MiniMax M2-her | MiniMax | 66K | ~87 | $0.30 | $1.20 |
| 6 | Mixtral 8x22B Instruct | Mistral AI | 66K | ~87 | $2.00 | $6.00 |
| 7 | Nano Banana 2 (Gemini 3.1 Flash Image Preview) | 66K | ~87 | $0.50 | $3.00 | |
| 8 | Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) | 66K | ~87 | $0.25 | $1.50 | |
| 9 | Nano Banana Pro (Gemini 3 Pro Image Preview) | 66K | ~87 | $2.00 | $12.00 | |
| 10 | Olmo 3 32B Think | Allen AI | 66K | ~87 | $0.15 | $0.50 |
| 11 | Reka Flash 3 | rekaai | 66K | ~87 | $0.10 | $0.20 |
| 12 | WizardLM-2 8x22B | Microsoft | 66K | ~87 | $0.62 | $0.62 |
| 13 | Llama 3.2 1B Instruct | Meta | 60K | ~80 | $0.03 | $0.20 |
| 14 | Falcon Arabic 7B Instruct | TII | 33K | ~44 | Free | Free |
| 15 | Falcon Mamba 7B Instruct | TII | 33K | ~44 | Free | Free |
| 16 | Falcon3 10B Instruct | TII | 33K | ~44 | Free | Free |
| 17 | Falcon3 7B Instruct | TII | 33K | ~44 | Free | Free |
| 18 | Gemma 3n 4B | 33K | ~44 | $0.06 | $0.12 | |
| 19 | Mistral Small 3 | Mistral AI | 33K | ~44 | $0.05 | $0.08 |
| 20 | Nano Banana (Gemini 2.5 Flash Image) | 33K | ~44 | $0.30 | $2.50 | |
| 21 | Perceptron Mk1 | perceptron | 33K | ~44 | $0.15 | $1.50 |
| 22 | Qwen2.5 72B Instruct | Alibaba | 33K | ~44 | $0.36 | $0.40 |
| 23 | Qwen2.5 7B Instruct | Alibaba | 33K | ~44 | $0.10 | $0.20 |
| 24 | Qwen2.5 Coder 32B Instruct | Alibaba | 33K | ~44 | $0.66 | $1.00 |
| 25 | Saba | Mistral AI | 33K | ~44 | $0.20 | $0.60 |
| 26 | Voxtral Small 24B 2507 | Mistral AI | 32K | ~43 | $0.10 | $0.30 |
What Is a Context Window and Why Does It Matter?
Context window = working memory
A model's context window is the total number of tokens (roughly words) it can process in a single request. This includes both your input prompt and the model's output. A model with a 128K context window can process about 170 pages of text at once, while a 1M-token model can handle roughly 1,300 pages -- enough for entire books or large codebases.
Larger context enables new use cases
With small context windows (under 32K), you must chunk documents and use retrieval-augmented generation (RAG). Large context models eliminate this complexity for many workloads: analyzing full legal contracts, reviewing entire repositories, summarizing research paper collections, or maintaining very long conversations with full history retained.
Context size vs. effective recall
Not all context is created equal. Some models perform well on "needle in a haystack" tests at their full context length, while others degrade on information retrieval when prompts get very long. The advertised context window is the maximum, but effective performance may vary. Check our leaderboard for quality scores that account for real-world performance.
Cost implications of large context
Using a large context window means sending more tokens per request, which increases cost. For example, filling a 1M-token context at $3/1M input tokens costs $3 per request. For cost-sensitive workloads, consider whether RAG with a smaller context model might be more efficient than filling a large context window end to end.
Explore More
Dive deeper into model capabilities, compare context windows side by side, or see overall rankings across all dimensions.
A large context window model can process long inputs - from 128K tokens (about 100 pages) up to 2M tokens (about 1,500 pages). This allows analyzing entire codebases, long documents, or extensive conversation histories in a single request.
Large context models excel when you need the AI to reason across an entire document at once. RAG (Retrieval-Augmented Generation) is better for searching across massive document collections. Large context is simpler to implement but costs more per request.
No. While many models advertise 1M+ token context windows, their effective recall can vary significantly. Some models lose accuracy when important information is buried in the middle of very long contexts. Our rankings account for practical performance, not just advertised limits.