Skip to content
SOLVENCY

Head to head

GPT-4.1 vs Claude Sonnet 4

GPT-4.1: legacyClaude Sonnet 4: retiredheavy tier

Verdict · modelled basis

Claude Sonnet 4 costs 1.2x less per solved task.

On output token price alone, GPT-4.1 looks 1.9x cheaper (1.5x on input). The ranking reverses once you divide by pass rate — the cheaper tokens do not win the task.

Source: Aider polyglot benchmark · verified 2026-08-21 · prices from each provider's pricing page

Input $/M tokens

lower is better

  • GPT-4.1$2
  • Claude Sonnet 4$3

Output $/M tokens

lower is better

  • GPT-4.1$8
  • Claude Sonnet 4$15

Cost per solved task

modelled basis · lower is better

  • GPT-4.1$5.15
  • Claude Sonnet 4$4.40
GPT-4.1Claude Sonnet 4
Input $/Mtok$2$3
Output $/Mtok$8$15
Cached input $/Mtok$0.5$0.3
Pass rate52%61%
Pass rate sourceAiderAider
Cost basismodelledmodelled
Cost per solved task$5.15$4.40

verified 2026-08-21 · heavy task tier; measured rows ignore the tier· Methodology· GPT-4.1· Claude Sonnet 4