Skip to content
SOLVENCY

Head to head

GPT-4.1 vs Claude Opus 4

GPT-4.1: legacyClaude Opus 4: retiredheavy tier

Verdict · modelled basis

GPT-4.1 costs 3.6x less per solved task.

On output token price alone, GPT-4.1 looks 9.4x cheaper (7.5x on input). The ranking holds, but the margin changes.

Source: Aider polyglot benchmark · verified 2026-08-21 · prices from each provider's pricing page

Input $/M tokens

lower is better

  • GPT-4.1$2
  • Claude Opus 4$15

Output $/M tokens

lower is better

  • GPT-4.1$8
  • Claude Opus 4$75

Cost per solved task

modelled basis · lower is better

  • GPT-4.1$5.15
  • Claude Opus 4$18.75
GPT-4.1Claude Opus 4
Input $/Mtok$2$15
Output $/Mtok$8$75
Cached input $/Mtok$0.5$1.5
Pass rate52%72%
Pass rate sourceAiderAider
Cost basismodelledmodelled
Cost per solved task$5.15$18.75

verified 2026-08-21 · heavy task tier; measured rows ignore the tier· Methodology· GPT-4.1· Claude Opus 4