- Claude Code - Opus 5 (xhigh)68.1%$0.12/pt
- Grok Build - Grok 4.5 (high)64.1%$0.04/pt
70% cheaper · 4.1% worse than Claude Code - Opus 5 (xhigh)
- Muse Code - Muse Spark 1.2 (xhigh)61.6%$0.03/pt
15% cheaper · 2.4% worse than Grok Build - Grok 4.5 (high)
- Opencode - Gemini 3.7 Flash (high)59.6%$0.02/pt
39% cheaper · 2.0% worse than Muse Code - Muse Spark 1.2 (xhigh)
- Codex - GPT-5.6 Luna (high)51.7%$0.02/pt
28% cheaper · 7.9% worse than Opencode - Gemini 3.7 Flash (high)
- Codex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt
87% cheaper · 1.9% worse than Codex - GPT-5.6 Luna (high)
- Cursor CLI - Composer 2.538.3%0.22¢/pt
29% cheaper · 11.5% worse than Codex - DeepSeek V4 Flash 0731 (max)
Coding Agents
Which Artificial Analysis coding agent and model pairing gives you the most intelligence per dollar — and where you are overpaying for the same score.
Best Models
The most cost-efficient model for each performance score, from all available models.
Charts
Compare DeepSWE pass rate with mean cost. The top-right corner is the sweet spot: higher performance for less money.
Chart loads in the browser.
Comparison Table
55 models · sort by performance or price
- Claude Code - Opus 5 (xhigh)· Anthropic68.1%$0.12/ptBest in class
- Claude Code - Fable 5 (max) (with fallback)· Anthropic67.2%$0.17/ptClaude Code - Opus 5 (xhigh)68.1%$0.12/pt30% cheaper1.0% better
43% pricier · 1.0% worse than Claude Code - Opus 5 (xhigh)
- Claude Code - Opus 5 (max)· Anthropic67.0%$0.13/ptClaude Code - Opus 5 (xhigh)68.1%$0.12/pt9% cheaper1.1% better
23% cheaper · 0.1% worse than Claude Code - Fable 5 (max) (with fallback)
- Claude Code - Opus 5 (high)· Anthropic65.6%$0.06/ptGrok Build - Grok 4.5 (high)64.1%$0.04/pt38% cheaper1.5% worse
56% cheaper · 1.4% worse than Claude Code - Opus 5 (max)
- Codex - GPT-5.6 Sol (max)· OpenAI65.1%$0.10/ptGrok Build - Grok 4.5 (high)64.1%$0.04/pt62% cheaper1.0% worse
64% pricier · 0.6% worse than Claude Code - Opus 5 (high)
- Codex - GPT-5.6 Sol (high)· OpenAI64.1%$0.06/ptGrok Build - Grok 4.5 (high)64.1%$0.04/pt37% cheaper0.0% worse
40% cheaper · 0.9% worse than Codex - GPT-5.6 Sol (max)
- Grok Build - Grok 4.5 (high)· xAI64.1%$0.04/ptBest in class
37% cheaper · 0.0% worse than Codex - GPT-5.6 Sol (high)
- Claude Code - Opus 5 (medium)· Anthropic64.1%$0.05/ptGrok Build - Grok 4.5 (high)64.1%$0.04/pt23% cheaper0.0% better
30% pricier · 0.0% worse than Grok Build - Grok 4.5 (high)
- Codex - GPT-5.6 Sol (xhigh)· OpenAI63.3%$0.08/ptGrok Build - Grok 4.5 (high)64.1%$0.04/pt49% cheaper0.8% better
51% pricier · 0.7% worse than Claude Code - Opus 5 (medium)
- Kimi Code CLI - Kimi K3· Moonshot62.6%$0.05/ptMuse Code - Muse Spark 1.2 (xhigh)61.6%$0.03/pt33% cheaper1.0% worse
36% cheaper · 0.7% worse than Codex - GPT-5.6 Sol (xhigh)
- Claude Code - Opus 4.8 (max)· Anthropic62.1%$0.12/ptMuse Code - Muse Spark 1.2 (xhigh)61.6%$0.03/pt73% cheaper0.5% worse
151% pricier · 0.5% worse than Kimi Code CLI - Kimi K3
- Muse Code - Muse Spark 1.2 (xhigh)· Meta61.6%$0.03/ptBest in class
73% cheaper · 0.5% worse than Claude Code - Opus 4.8 (max)
- Codex - GPT-5.6 Sol (medium)· OpenAI61.6%$0.05/ptMuse Code - Muse Spark 1.2 (xhigh)61.6%$0.03/pt26% cheaper0.0% better
36% pricier · 0.0% worse than Muse Code - Muse Spark 1.2 (xhigh)
- Claude Code - Qwen3.8 Max· Alibaba61.3%$0.05/ptMuse Code - Muse Spark 1.2 (xhigh)61.6%$0.03/pt36% cheaper0.3% better
15% pricier · 0.3% worse than Codex - GPT-5.6 Sol (medium)
- Codex - GPT-5.5 (xhigh)· OpenAI61.0%$0.08/ptMuse Code - Muse Spark 1.2 (xhigh)61.6%$0.03/pt56% cheaper0.6% better
47% pricier · 0.3% worse than Claude Code - Qwen3.8 Max
- Codex - GPT-5.6 Terra (max)· OpenAI60.4%$0.04/ptMuse Code - Muse Spark 1.2 (xhigh)61.6%$0.03/pt23% cheaper1.2% better
43% cheaper · 0.6% worse than Codex - GPT-5.5 (xhigh)
- Opencode - Gemini 3.7 Flash (high)· Google59.6%$0.02/ptBest in class
53% cheaper · 0.8% worse than Codex - GPT-5.6 Terra (max)
- Claude Code - Opus 5 (low)· Anthropic59.4%$0.04/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt45% cheaper0.2% better
81% pricier · 0.2% worse than Opencode - Gemini 3.7 Flash (high)
- Claude Code - Opus 4.8 (xhigh)· Anthropic59.1%$0.10/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt78% cheaper0.6% better
147% pricier · 0.3% worse than Claude Code - Opus 5 (low)
- Opencode - Muse Spark 1.2 (xhigh)· Meta58.9%$0.03/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt34% cheaper0.7% better
66% cheaper · 0.2% worse than Claude Code - Opus 4.8 (xhigh)
- Claude Code - Opus 4.8 (high)· Anthropic57.6%$0.07/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt66% cheaper2.1% better
98% pricier · 1.3% worse than Opencode - Muse Spark 1.2 (xhigh)
- Codex - GPT-5.6 Luna (max)· OpenAI57.2%$0.03/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt16% cheaper2.5% better
60% cheaper · 0.4% worse than Claude Code - Opus 4.8 (high)
- Antigravity SDK - Gemini 3.7 Flash (high)· Google56.6%$0.02/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt9% cheaper3.1% better
7% cheaper · 0.6% worse than Codex - GPT-5.6 Luna (max)
- Codex - GPT-5.6 Terra (xhigh)· OpenAI56.0%$0.03/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt33% cheaper3.6% better
35% pricier · 0.5% worse than Antigravity SDK - Gemini 3.7 Flash (high)
- Claude Code - Opus 4.8 (medium)· Anthropic55.8%$0.06/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt62% cheaper3.9% better
76% pricier · 0.3% worse than Codex - GPT-5.6 Terra (xhigh)
- Codex - GPT-5.5 (medium)· OpenAI55.3%$0.05/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt52% cheaper4.3% better
20% cheaper · 0.5% worse than Claude Code - Opus 4.8 (medium)
- Codex - GPT-5.6 Sol (low)· OpenAI55.2%$0.03/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt24% cheaper4.4% better
37% cheaper · 0.1% worse than Codex - GPT-5.5 (medium)
- Opencode - Muse Spark 1.1 (xhigh)· Meta54.9%$0.03/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt12% cheaper4.7% better
14% cheaper · 0.3% worse than Codex - GPT-5.6 Sol (low)
- Codex - GPT-5.6 Terra (high)· OpenAI54.6%$0.03/ptOpencode - Gemini 3.7 Flash (high)59.6%$0.02/pt19% cheaper5.0% better
9% pricier · 0.3% worse than Opencode - Muse Spark 1.1 (xhigh)
- Codex - GPT-5.6 Luna (xhigh)· OpenAI53.0%$0.02/ptCodex - GPT-5.6 Luna (high)51.7%$0.02/pt24% cheaper1.3% worse
23% cheaper · 1.7% worse than Codex - GPT-5.6 Terra (high)
- Codex - GPT-5.6 Luna (high)· OpenAI51.7%$0.02/ptBest in class
24% cheaper · 1.3% worse than Codex - GPT-5.6 Luna (xhigh)
- Claude Code - Opus 4.7 (max)· Anthropic51.6%$0.11/ptCodex - GPT-5.6 Luna (high)51.7%$0.02/pt84% cheaper0.1% better
545% pricier · 0.1% worse than Codex - GPT-5.6 Luna (high)
- Opencode - Opus 4.7 (medium)· Anthropic51.3%$0.06/ptCodex - GPT-5.6 Luna (high)51.7%$0.02/pt69% cheaper0.4% better
50% cheaper · 0.3% worse than Claude Code - Opus 4.7 (max)
- Codex - DeepSeek V4 Flash 0731 (max)· DeepSeek49.8%0.24¢/ptBest in class
96% cheaper · 1.5% worse than Opencode - Opus 4.7 (medium)
- Claude Code - Opus 4.8 (low)· Anthropic49.0%$0.04/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt95% cheaper0.7% better
1734% pricier · 0.7% worse than Codex - DeepSeek V4 Flash 0731 (max)
- Codex - GPT-5.6 Terra (medium)· OpenAI48.0%$0.02/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt87% cheaper1.7% better
59% cheaper · 1.0% worse than Claude Code - Opus 4.8 (low)
- Opencode - Gemini 3.6 Flash (high)· Google47.2%$0.04/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt94% cheaper2.5% better
136% pricier · 0.8% worse than Codex - GPT-5.6 Terra (medium)
- Cursor CLI - GPT-5.5 (medium)· xAI47.1%$0.04/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt94% cheaper2.7% better
4% cheaper · 0.2% worse than Opencode - Gemini 3.6 Flash (high)
- Cursor CLI - Opus 4.7 (medium)· xAI46.7%$0.06/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt96% cheaper3.1% better
36% pricier · 0.4% worse than Cursor CLI - GPT-5.5 (medium)
- Codex - GPT-5.6 Sol (none)· OpenAI43.4%$0.03/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt91% cheaper6.4% better
49% cheaper · 3.3% worse than Cursor CLI - Opus 4.7 (medium)
- Claude Code - GLM-5.2· Zhipu43.3%$0.15/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt98% cheaper6.4% better
377% pricier · 0.1% worse than Codex - GPT-5.6 Sol (none)
- Claude Code - Opus 4.7 (medium)· Anthropic42.4%$0.04/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt93% cheaper7.4% better
73% cheaper · 0.9% worse than Claude Code - GLM-5.2
- Codex - GPT-5.6 Luna (medium)· OpenAI42.0%$0.01/ptCodex - DeepSeek V4 Flash 0731 (max)49.8%0.24¢/pt73% cheaper7.8% better
75% cheaper · 0.4% worse than Claude Code - Opus 4.7 (medium)
- Claude Code - Sonnet 4.6 (medium)· Anthropic38.6%$0.05/ptCursor CLI - Composer 2.538.3%0.22¢/pt96% cheaper0.3% worse
361% pricier · 3.3% worse than Codex - GPT-5.6 Luna (medium)
- Codex - GPT-5.6 Terra (low)· OpenAI38.6%$0.01/ptCursor CLI - Composer 2.538.3%0.22¢/pt83% cheaper0.3% worse
76% cheaper · 0.0% worse than Claude Code - Sonnet 4.6 (medium)
- Cursor CLI - Composer 2.5· xAI38.3%0.22¢/ptBest in class
83% cheaper · 0.3% worse than Codex - GPT-5.6 Terra (low)
- Cursor CLI - Composer 2.5 Fast· xAI38.3%$0.01/ptCursor CLI - Composer 2.538.3%0.22¢/pt85% cheaper0.0% better
555% pricier · 0.0% better than Cursor CLI - Composer 2.5
- Claude Code - Qwen3.7 Plus (thinking)· Alibaba38.1%$0.17/ptCursor CLI - Composer 2.538.3%0.22¢/pt99% cheaper0.2% better
1030% pricier · 0.2% worse than Cursor CLI - Composer 2.5 Fast
- Claude Code - GLM-5.1· Zhipu36.9%$0.12/ptCursor CLI - Composer 2.538.3%0.22¢/pt98% cheaper1.4% better
32% cheaper · 1.2% worse than Claude Code - Qwen3.7 Plus (thinking)
- Claude Code - Kimi K2.6· Moonshot33.9%$0.04/ptCursor CLI - Composer 2.538.3%0.22¢/pt93% cheaper4.4% better
72% cheaper · 3.0% worse than Claude Code - GLM-5.1
- Gemini CLI - Gemini 3.1 Pro (high)· Google32.9%$0.03/ptCursor CLI - Composer 2.538.3%0.22¢/pt92% cheaper5.4% better
15% cheaper · 1.0% worse than Claude Code - Kimi K2.6
- Claude Code - DeepSeek V4 Pro (high)· DeepSeek32.8%$0.02/ptCursor CLI - Composer 2.538.3%0.22¢/pt83% cheaper5.5% better
51% cheaper · 0.1% worse than Gemini CLI - Gemini 3.1 Pro (high)
- Codex - GPT-5.6 Luna (low)· OpenAI25.1%0.77¢/ptCursor CLI - Composer 2.538.3%0.22¢/pt56% cheaper13.2% better
62% cheaper · 7.8% worse than Claude Code - DeepSeek V4 Pro (high)
- Codex - GPT-5.6 Terra (none)· OpenAI23.1%$0.02/ptCursor CLI - Composer 2.538.3%0.22¢/pt76% cheaper15.2% better
88% pricier · 2.0% worse than Codex - GPT-5.6 Luna (low)
- Codex - GPT-5.6 Luna (none)· OpenAI19.1%$0.02/ptCursor CLI - Composer 2.538.3%0.22¢/pt74% cheaper19.2% better
9% cheaper · 4.0% worse than Codex - GPT-5.6 Terra (none)
Model selector
Choose the model and reasoning effort rows to compare.
Alibaba
Claude Code - Qwen3.8 Max
Alibaba
Claude Code - Qwen3.7 Plus
Alibaba
Anthropic
Claude Code - Opus 5
Anthropic
Claude Code - Fable 5 (with fallback)
Anthropic
Claude Code - Opus 4.8
Anthropic
Claude Code - Opus 4.7
Anthropic
Opencode - Opus 4.7
Anthropic
Claude Code - Sonnet 4.6
Anthropic
DeepSeek
Codex - DeepSeek V4 Flash 0731
DeepSeek
Claude Code - DeepSeek V4 Pro
DeepSeek
Google
Opencode - Gemini 3.7 Flash
Antigravity SDK v0.1.8 - Gemini 3.7 Flash
Opencode - Gemini 3.6 Flash
Gemini CLI - Gemini 3.1 Pro
Meta
Muse Code - Muse Spark 1.2
Meta
Opencode - Muse Spark 1.2
Meta
Opencode - Muse Spark 1.1
Meta
Moonshot
Kimi Code CLI - Kimi K3
Moonshot
Claude Code - Kimi K2.6
Moonshot
OpenAI
Codex - GPT-5.6 Sol
OpenAI
Codex - GPT-5.5
OpenAI
Codex - GPT-5.6 Terra
OpenAI
Codex - GPT-5.6 Luna
OpenAI
xAI
Grok Build - Grok 4.5
xAI
Cursor CLI - GPT-5.5
xAI
Cursor CLI - Opus 4.7
xAI
Cursor CLI - Composer 2.5
xAI
Cursor CLI - Composer 2.5 Fast
xAI
Zhipu
Claude Code - GLM-5.2
Zhipu
Claude Code - GLM-5.1
Zhipu