Coding Agents

Which Artificial Analysis coding agent and model pairing gives you the most intelligence per dollar — and where you are overpaying for the same score.

Best Models

The most cost-efficient model for each performance score, from all available models.

  1. Claude Code - Opus 5 (xhigh)· Anthropic
    68.1%
    $0.120/pt
  2. Grok Build - Grok 4.5 (high)· 70% cheaper · 4.1% worse than Claude Code - Opus 5 (xhigh)
    64.1%
    $0.038/pt
  3. Muse Code - Muse Spark 1.2 (xhigh)· 15% cheaper · 2.4% worse than Grok Build - Grok 4.5 (high)
    61.6%
    $0.034/pt
  4. Opencode - Gemini 3.7 Flash (high)· 39% cheaper · 2.0% worse than Muse Code - Muse Spark 1.2 (xhigh)
    59.6%
    $0.021/pt
  5. Codex - GPT-5.6 Luna (high)· 28% cheaper · 7.9% worse than Opencode - Gemini 3.7 Flash (high)
    51.7%
    $0.018/pt
  6. Codex - DeepSeek V4 Flash 0731 (max)· 87% cheaper · 1.9% worse than Codex - GPT-5.6 Luna (high)
    49.8%
    0.239¢/pt
  7. Cursor CLI - Composer 2.5· 29% cheaper · 11.5% worse than Codex - DeepSeek V4 Flash 0731 (max)
    38.3%
    0.222¢/pt
PerformanceCost ($1 blocks, 10¢ blocks)Empty

Models in the same performance bracket are treated as similar-score alternatives in the comparison.

Charts

Compare artificialanalysis.ai pass rate with mean cost. The top-right corner is the sweet spot: higher performance for less money.

55 selected models
Providers

Chart loads in the browser.

Comparison Table

55 models · sort by performance or price

Sort comparison table
  • Claude Code - Opus 5 (xhigh)· Anthropic
    68.1%
    $0.120/pt
  • Claude Code - Fable 5 (max) (with fallback)· 43% pricier · 1.0% worse than Claude Code - Opus 5 (xhigh)
    67.2%
    $0.174/pt
  • Claude Code - Opus 5 (max)· 23% cheaper · 0.1% worse than Claude Code - Fable 5 (max) (with fallback)
    67.0%
    $0.133/pt
  • Claude Code - Opus 5 (high)· 56% cheaper · 1.4% worse than Claude Code - Opus 5 (max)
    65.6%
    $0.060/pt
  • Codex - GPT-5.6 Sol (max)· 64% pricier · 0.6% worse than Claude Code - Opus 5 (high)
    65.1%
    $0.099/pt
  • Codex - GPT-5.6 Sol (high)· 40% cheaper · 0.9% worse than Codex - GPT-5.6 Sol (max)
    64.1%
    $0.060/pt
  • Grok Build - Grok 4.5 (high)· 37% cheaper · 0.0% worse than Codex - GPT-5.6 Sol (high)
    64.1%
    $0.038/pt
  • Claude Code - Opus 5 (medium)· 30% pricier · 0.0% worse than Grok Build - Grok 4.5 (high)
    64.1%
    $0.050/pt
  • Codex - GPT-5.6 Sol (xhigh)· 51% pricier · 0.7% worse than Claude Code - Opus 5 (medium)
    63.3%
    $0.076/pt
  • Kimi Code CLI - Kimi K3· 36% cheaper · 0.7% worse than Codex - GPT-5.6 Sol (xhigh)
    62.6%
    $0.049/pt
  • Claude Code - Opus 4.8 (max)· 151% pricier · 0.5% worse than Kimi Code CLI - Kimi K3
    62.1%
    $0.124/pt
  • Muse Code - Muse Spark 1.2 (xhigh)· 73% cheaper · 0.5% worse than Claude Code - Opus 4.8 (max)
    61.6%
    $0.034/pt
  • Codex - GPT-5.6 Sol (medium)· 36% pricier · 0.0% worse than Muse Code - Muse Spark 1.2 (xhigh)
    61.6%
    $0.046/pt
  • Claude Code - Qwen3.8 Max· 15% pricier · 0.3% worse than Codex - GPT-5.6 Sol (medium)
    61.3%
    $0.053/pt
  • Codex - GPT-5.5 (xhigh)· 47% pricier · 0.3% worse than Claude Code - Qwen3.8 Max
    61.0%
    $0.078/pt
  • Codex - GPT-5.6 Terra (max)· 43% cheaper · 0.6% worse than Codex - GPT-5.5 (xhigh)
    60.4%
    $0.045/pt
  • Opencode - Gemini 3.7 Flash (high)· 53% cheaper · 0.8% worse than Codex - GPT-5.6 Terra (max)
    59.6%
    $0.021/pt
  • Claude Code - Opus 5 (low)· 81% pricier · 0.2% worse than Opencode - Gemini 3.7 Flash (high)
    59.4%
    $0.039/pt
  • Claude Code - Opus 4.8 (xhigh)· 147% pricier · 0.3% worse than Claude Code - Opus 5 (low)
    59.1%
    $0.096/pt
  • Opencode - Muse Spark 1.2 (xhigh)· 66% cheaper · 0.2% worse than Claude Code - Opus 4.8 (xhigh)
    58.9%
    $0.033/pt
  • Claude Code - Opus 4.8 (high)· 98% pricier · 1.3% worse than Opencode - Muse Spark 1.2 (xhigh)
    57.6%
    $0.066/pt
  • Codex - GPT-5.6 Luna (max)· 60% cheaper · 0.4% worse than Claude Code - Opus 4.8 (high)
    57.2%
    $0.026/pt
  • Antigravity SDK - Gemini 3.7 Flash (high)· 7% cheaper · 0.6% worse than Codex - GPT-5.6 Luna (max)
    56.6%
    $0.025/pt
  • Codex - GPT-5.6 Terra (xhigh)· 35% pricier · 0.5% worse than Antigravity SDK - Gemini 3.7 Flash (high)
    56.0%
    $0.034/pt
  • Claude Code - Opus 4.8 (medium)· 76% pricier · 0.3% worse than Codex - GPT-5.6 Terra (xhigh)
    55.8%
    $0.059/pt
  • Codex - GPT-5.5 (medium)· 20% cheaper · 0.5% worse than Claude Code - Opus 4.8 (medium)
    55.3%
    $0.048/pt
  • Codex - GPT-5.6 Sol (low)· 37% cheaper · 0.1% worse than Codex - GPT-5.5 (medium)
    55.2%
    $0.030/pt
  • Opencode - Muse Spark 1.1 (xhigh)· 14% cheaper · 0.3% worse than Codex - GPT-5.6 Sol (low)
    54.9%
    $0.026/pt
  • Codex - GPT-5.6 Terra (high)· 9% pricier · 0.3% worse than Opencode - Muse Spark 1.1 (xhigh)
    54.6%
    $0.029/pt
  • Codex - GPT-5.6 Luna (xhigh)· 23% cheaper · 1.7% worse than Codex - GPT-5.6 Terra (high)
    53.0%
    $0.023/pt
  • Codex - GPT-5.6 Luna (high)· 24% cheaper · 1.3% worse than Codex - GPT-5.6 Luna (xhigh)
    51.7%
    $0.018/pt
  • Claude Code - Opus 4.7 (max)· 545% pricier · 0.1% worse than Codex - GPT-5.6 Luna (high)
    51.6%
    $0.115/pt
  • Opencode - Opus 4.7 (medium)· 50% cheaper · 0.3% worse than Claude Code - Opus 4.7 (max)
    51.3%
    $0.057/pt
  • Codex - DeepSeek V4 Flash 0731 (max)· 96% cheaper · 1.5% worse than Opencode - Opus 4.7 (medium)
    49.8%
    0.239¢/pt
  • Claude Code - Opus 4.8 (low)· 1734% pricier · 0.7% worse than Codex - DeepSeek V4 Flash 0731 (max)
    49.0%
    $0.045/pt
  • Codex - GPT-5.6 Terra (medium)· 59% cheaper · 1.0% worse than Claude Code - Opus 4.8 (low)
    48.0%
    $0.018/pt
  • Opencode - Gemini 3.6 Flash (high)· 136% pricier · 0.8% worse than Codex - GPT-5.6 Terra (medium)
    47.2%
    $0.044/pt
  • Cursor CLI - GPT-5.5 (medium)· 4% cheaper · 0.2% worse than Opencode - Gemini 3.6 Flash (high)
    47.1%
    $0.042/pt
  • Cursor CLI - Opus 4.7 (medium)· 36% pricier · 0.4% worse than Cursor CLI - GPT-5.5 (medium)
    46.7%
    $0.058/pt
  • Codex - GPT-5.6 Sol (none)· 49% cheaper · 3.3% worse than Cursor CLI - Opus 4.7 (medium)
    43.4%
    $0.032/pt
  • Claude Code - GLM-5.2· 377% pricier · 0.1% worse than Codex - GPT-5.6 Sol (none)
    43.3%
    $0.154/pt
  • Claude Code - Opus 4.7 (medium)· 73% cheaper · 0.9% worse than Claude Code - GLM-5.2
    42.4%
    $0.042/pt
  • Codex - GPT-5.6 Luna (medium)· 75% cheaper · 0.4% worse than Claude Code - Opus 4.7 (medium)
    42.0%
    $0.011/pt
  • Claude Code - Sonnet 4.6 (medium)· 361% pricier · 3.3% worse than Codex - GPT-5.6 Luna (medium)
    38.6%
    $0.053/pt
  • Codex - GPT-5.6 Terra (low)· 76% cheaper · 0.0% worse than Claude Code - Sonnet 4.6 (medium)
    38.6%
    $0.013/pt
  • Cursor CLI - Composer 2.5· 83% cheaper · 0.3% worse than Codex - GPT-5.6 Terra (low)
    38.3%
    0.222¢/pt
  • Cursor CLI - Composer 2.5 Fast· 555% pricier · 0.0% better than Cursor CLI - Composer 2.5
    38.3%
    $0.015/pt
  • Claude Code - Qwen3.7 Plus (thinking)· 1030% pricier · 0.2% worse than Cursor CLI - Composer 2.5 Fast
    38.1%
    $0.165/pt
  • Claude Code - GLM-5.1· 32% cheaper · 1.2% worse than Claude Code - Qwen3.7 Plus (thinking)
    36.9%
    $0.116/pt
  • Claude Code - Kimi K2.6· 72% cheaper · 3.0% worse than Claude Code - GLM-5.1
    33.9%
    $0.036/pt
  • Gemini CLI - Gemini 3.1 Pro (high)· 15% cheaper · 1.0% worse than Claude Code - Kimi K2.6
    32.9%
    $0.032/pt
  • Claude Code - DeepSeek V4 Pro (high)· 51% cheaper · 0.1% worse than Gemini CLI - Gemini 3.1 Pro (high)
    32.8%
    $0.016/pt
  • Codex - GPT-5.6 Luna (low)· 62% cheaper · 7.8% worse than Claude Code - DeepSeek V4 Pro (high)
    25.1%
    0.766¢/pt
  • Codex - GPT-5.6 Terra (none)· 88% pricier · 2.0% worse than Codex - GPT-5.6 Luna (low)
    23.1%
    $0.016/pt
  • Codex - GPT-5.6 Luna (none)· 9% cheaper · 4.0% worse than Codex - GPT-5.6 Terra (none)
    19.1%
    $0.017/pt
PerformanceCost ($1 blocks, 10¢ blocks)Empty

Models in the same performance bracket are treated as similar-score alternatives in the comparison.

Model selector

Choose the model and reasoning effort rows to compare.

55 of 55 selected
ProvidersAll providers shown

Alibaba

Claude Code - Qwen3.8 Max

Alibaba

Claude Code - Qwen3.7 Plus

Alibaba

Anthropic

Claude Code - Opus 5

Anthropic

Claude Code - Fable 5 (with fallback)

Anthropic

Claude Code - Opus 4.8

Anthropic

Claude Code - Opus 4.7

Anthropic

Opencode - Opus 4.7

Anthropic

Claude Code - Sonnet 4.6

Anthropic

DeepSeek

Codex - DeepSeek V4 Flash 0731

DeepSeek

Claude Code - DeepSeek V4 Pro

DeepSeek

Google

Opencode - Gemini 3.7 Flash

Google

Antigravity SDK v0.1.8 - Gemini 3.7 Flash

Google

Opencode - Gemini 3.6 Flash

Google

Gemini CLI - Gemini 3.1 Pro

Google

Meta

Muse Code - Muse Spark 1.2

Meta

Opencode - Muse Spark 1.2

Meta

Opencode - Muse Spark 1.1

Meta

Moonshot

Kimi Code CLI - Kimi K3

Moonshot

Claude Code - Kimi K2.6

Moonshot

OpenAI

Codex - GPT-5.6 Sol

OpenAI

Codex - GPT-5.5

OpenAI

Codex - GPT-5.6 Terra

OpenAI

Codex - GPT-5.6 Luna

OpenAI

xAI

Grok Build - Grok 4.5

xAI

Cursor CLI - GPT-5.5

xAI

Cursor CLI - Opus 4.7

xAI

Cursor CLI - Composer 2.5

xAI

Cursor CLI - Composer 2.5 Fast

xAI

Zhipu

Claude Code - GLM-5.2

Zhipu

Claude Code - GLM-5.1

Zhipu