Skip to content
SOLVENCY

Head to head

Gemini 3.1 Pro (preview) vs Claude Opus 4.5

Gemini 3.1 Pro (preview): currentClaude Opus 4.5: legacyheavy tier

Verdict · modelled basis

Gemini 3.1 Pro (preview) costs 2.3x less per solved task.

On output token price alone, Gemini 3.1 Pro (preview) looks 2.1x cheaper (2.5x on input). The ranking holds, but the margin changes.

Source: Scale SEAL leaderboard, SWE-bench Pro · verified 2026-08-21 · prices from each provider's pricing page

Input $/M tokens

lower is better

  • Gemini 3.1 Pro (preview)$2
  • Claude Opus 4.5$5

Output $/M tokens

lower is better

  • Gemini 3.1 Pro (preview)$12
  • Claude Opus 4.5$25

Cost per solved task

modelled basis · lower is better

  • Gemini 3.1 Pro (preview)$4.30
  • Claude Opus 4.5$9.81
Gemini 3.1 Pro (preview)Claude Opus 4.5
Input $/Mtok$2$5
Output $/Mtok$12$25
Cached input $/Mtok$0.2$0.5
Pass rate46%46%
Pass rate sourceSEALSEAL
Cost basismodelledmodelled
Cost per solved task$4.30$9.81

verified 2026-08-21 · heavy task tier; measured rows ignore the tier· Methodology· Gemini 3.1 Pro (preview)· Claude Opus 4.5