Skip to content
SOLVENCY

Head to head

o3-pro vs GPT-4.1

o3-pro: legacyGPT-4.1: legacyheavy tier

Verdict · modelled basis

GPT-4.1 costs 3.7x less per solved task.

On output token price alone, GPT-4.1 looks 10x cheaper (10x on input). The ranking holds, but the margin changes.

Source: Aider polyglot benchmark · verified 2026-08-21 · prices from each provider's pricing page

Input $/M tokens

lower is better

  • o3-pro$20
  • GPT-4.1$2

Output $/M tokens

lower is better

  • o3-pro$80
  • GPT-4.1$8

Cost per solved task

modelled basis · lower is better

  • o3-pro$19.08
  • GPT-4.1$5.15
o3-proGPT-4.1
Input $/Mtok$20$2
Output $/Mtok$80$8
Cached input $/Mtokmissing$0.5
Pass rate85%52%
Pass rate sourceAiderAider
Cost basismodelledmodelled
Cost per solved task$19.08$5.15

verified 2026-08-21 · heavy task tier; measured rows ignore the tier· Methodology· o3-pro· GPT-4.1