Head to head
GPT-4.1 vs Claude Sonnet 4
GPT-4.1: legacyClaude Sonnet 4: retiredheavy tier
Verdict · modelled basis
Claude Sonnet 4 costs 1.2x less per solved task.
On output token price alone, GPT-4.1 looks 1.9x cheaper (1.5x on input). The ranking reverses once you divide by pass rate — the cheaper tokens do not win the task.
Source: Aider polyglot benchmark · verified 2026-08-21 · prices from each provider's pricing page
Input $/M tokens
lower is better
Output $/M tokens
lower is better
Cost per solved task
modelled basis · lower is better
| GPT-4.1 | Claude Sonnet 4 | |
|---|---|---|
| Input $/Mtok | $2 | $3 |
| Output $/Mtok | $8 | $15 |
| Cached input $/Mtok | $0.5 | $0.3 |
| Pass rate | 52% | 61% |
| Pass rate source | Aider | Aider |
| Cost basis | modelled | modelled |
| Cost per solved task | $5.15 | $4.40 |
verified 2026-08-21 · heavy task tier; measured rows ignore the tier· Methodology· GPT-4.1· Claude Sonnet 4