Model Rankings
— Model rankings —

LLM rankings, side by side

Benchmarks, cost vs intelligence, context windows, and head-to-head comparisons across every major large language model.

ModelOverall▼$/1M
GPT-5.5 (xhigh)
OpenAI
38.4$11.25
DeepSeek V4 Flash (Reasoning, High Effort)
37.5$0.17
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
36.0$1.98
DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
34.3$0.17
GPT-5.5 (medium)
OpenAI
33.8$11.25
DeepSeek V4 Pro (Non-reasoning)
31.9$0.54
Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
Anthropic
31.9$10.00
Muse Spark
31.3$0.00
Claude Opus 4.7 (Non-reasoning, High Effort)
Anthropic
30.9$10.00
GPT-5.5 (low)
OpenAI
30.7$11.25
Gemini 3.1 Pro Preview
Google DeepMind
29.7$4.50
Claude Opus 4.5 (Reasoning)
Anthropic
29.1$10.00
Qwen3.6 Max Preview
28.4$2.92
Gemini 3 Pro Preview (high)
28.0$4.50
Qwen3.6 Plus
27.0$1.13
GLM-5-Turbo
26.6$0.00
Gemini 3 Flash Preview (Reasoning)
26.3$1.13
GLM-5.1 (Reasoning)
26.1$1.98
MiMo-V2.5-Pro
26.0$1.35
Hy3
25.3$0.25
Grok 4.20 0309 (Reasoning)
xAI
25.2$3.00
MiMo-V2-Omni-0327
25.1$0.80
Claude Sonnet 4.6 (Non-reasoning, High Effort)
Anthropic
24.7$6.00
GLM-5.1 (Non-reasoning)
24.2$2.13
GPT-5.4 mini (xhigh)
OpenAI
24.1$1.69
Kimi K2.6 (Non-reasoning)
23.6$1.71
GLM 5V Turbo (Reasoning)
23.5$0.00
Claude Sonnet 4.6 (Non-reasoning, Low Effort)
Anthropic
23.3$6.00
GPT-5.5 (Non-reasoning)
OpenAI
23.2$11.25
MiniMax-M2.7
22.8$0.53
MiMo-V2-Flash (Feb 2026)
22.4$0.15
Gemini 3 Pro Preview (low)
22.3$4.50
Kimi K2 Thinking
22.0$1.07
o3-pro
OpenAI
21.9$35.00
KAT Coder Pro V2
21.7$0.53
Qwen3.5 397B A17B (Non-reasoning)
21.4$1.35
Qwen3.6 27B (Reasoning)
21.4$1.35
Qwen3 Max Thinking
21.3$2.40
MiMo-V2-Flash (Reasoning)
20.8$0.15
GPT-5.4 nano (xhigh)
OpenAI
20.7$0.46
Claude 4.5 Sonnet (Reasoning)
Anthropic
20.7$6.00
Grok 4.1 Fast (Reasoning)
xAI
20.4$0.28
Qwen3.5 Omni Plus
20.4$1.50
GPT-5.1 Codex mini (high)
OpenAI
20.4$0.69
o3
OpenAI
20.2$3.50
GPT-5.4 nano (medium)
OpenAI
20.0$0.46
Qwen3.6 27B (Non-reasoning)
19.8$1.35
GPT-5.4 mini (medium)
OpenAI
19.7$1.69
Gemma 4 31B (Reasoning)
19.0$0.20
DeepSeek V4 Flash (Non-reasoning)
18.9$0.12
KAT-Coder-Pro V1
18.6$0.53
GLM-4.6 (Reasoning)
18.5$0.96
Qwen3.5 397B A17B (Reasoning)
18.4$1.35
MiMo-V2.5-Pro (Non-reasoning)
18.3$0.54
Qwen3.6 35B A3B (Reasoning)
18.2$0.56
Gemini 3 Flash Preview (Non-reasoning)
17.9$1.13
Qwen3.5 122B A10B (Non-reasoning)
17.7$1.10
Hy3-preview (Non-reasoning)
17.0$0.10
Ling-2.6-1T
17.0$0.85
Doubao Seed Code
16.9$0.00
Claude 4.5 Haiku (Reasoning)
Anthropic
16.9$2.00
Gemma 4 26B A4B (Reasoning)
16.7$0.17
o4-mini (high)
OpenAI
16.7$1.93
Step 3.5 Flash
16.6$0.15
DeepSeek V3.2 Exp (Reasoning)
16.6$0.32
Qwen3 Max Thinking (Preview)
16.3$2.40
DeepSeek V3.2 (Non-reasoning)
16.0$0.32
MiMo-V2-Flash (Non-reasoning)
16.0$0.15
Qwen3.5 122B A10B (Reasoning)
15.6$1.10
Gemini 3.1 Flash-Lite
15.6$0.56
Gemini 2.5 Flash Preview (Sep '25) (Reasoning)
15.5$0.00
Claude 4.5 Haiku (Non-reasoning)
Anthropic
15.4$2.00
Kimi K2 0905
15.3$1.07
Qwen3.6 35B A3B (Non-reasoning)
15.2$0.84
o1
OpenAI
15.2$26.25
GLM-4.7-Flash (Reasoning)
14.9$0.15
DeepSeek V3.1 Terminus (Reasoning)
14.8$1.91
Grok 3 mini Reasoning (high)
xAI
14.6$0.35
K-EXAONE (Reasoning)
14.4$0.00
Nova 2.0 Pro Preview (medium)
14.2$3.44
Mistral Medium 3.5
14.2$3.00
Gemma 4 31B (Non-reasoning)
13.9$0.20
Mercury 2
13.8$0.38
Qwen3.5 9B (Reasoning)
13.7$0.15
Nova 2.0 Lite (high)
13.4$0.85
EXAONE 4.5 33B
13.2$0.00
Nemotron 3 Super 120B A12B (Reasoning)
12.8$0.45
Nova 2.0 Pro Preview (low)
12.8$3.44
gpt-oss-120b (high)
OpenAI
11.6$0.26
Trinity Large Thinking
10.8$0.39
Claude Code
Anthropic
9.5—
ElevenLabs Voice (v3)
ElevenLabs
9.4—
Midjourney v7
Midjourney
9.3—
FLUX.1 Pro
Black Forest Labs
9.1—
Cursor Composer
Anysphere
9.0—
Sora
OpenAI
8.8—
Llama 3.3 Instruct 70B
Meta AI
7.7$0.71
GPT 5.5 Codex
OpenAI
——
GPT-5.5 Pro (xhigh)
OpenAI
—$0.00
GPT-3.5 Turbo (0613)
OpenAI
—$0.00
Gemini 3 Deep Think
—$0.00
Cogito v2.1 (Reasoning)
—$1.25
GPT-4o Realtime (Dec '24)
OpenAI
—$0.00
EXAONE 4.5 33B (Non-reasoning)
—$0.00
GPT-4o mini Realtime (Dec '24)
OpenAI
—$0.00
Mi:dm K 2.5 Pro Preview
—$0.00
Grok 4.3 (Beta)
xAI
——

Rankings data by Artificial Analysis. CSV imports cover supplementary benchmarks.