invokeable()

Claude Opus 4.8 vs Claude Opus 5

A custom comparison card. Numbers link back to their entries; data as of 2026-08-23. Build your own →

model
Claude Opus 4.8
Anthropic
model
Claude Opus 5
Anthropic
Context1M1M
Input $/M——
Output $/M——
Knowledge cutoff2026-012026-05
Available viaAnthropic APIAnthropic API
SWE-bench Pro69.2%79.2%
Terminal-Bench (success rate)74.6—
SWE-bench Verified (resolved)88.696
Humanity's Last Exam (accuracy)49.8—
OSWorld-Verified (success rate)83.4—
SWE-bench Multilingual—89.5%
SWE-bench Multimodal—59.4%
DeepSWE—68.8%
FrontierCode (mean@5)—53.4