Benchfolio

Leaderboard / Model

Claude Opus 4.7

Anthropic · Closed weights · Released Apr 16, 2026 · $5 in · $25 out per 1M tokens

59Overall · rank 12

Score by job

Coding

88 · rank 3 · 4 of 5 benchmarks

BenchmarkResultVariantz
Terminal-Bench80.2%claude-opus-4-7_unknown0.91
FrontierCode38.5%claude-opus-4-7_unknown-0.11
SWE-bench Verified83.5%claude-opus-4-7_max2.14
LMArena Coding1519 ratingclaude-opus-4-7-high1.38

Agents

41 · rank 10 · 2 of 4 benchmarks

BenchmarkResultVariantz
APEX-Agents49.2%claude-opus-4-7_max-0.30
OSWorld 2.018.2%claude-opus-4-7_max0.05

Reasoning

45 · rank 24 · 4 of 4 benchmarks

BenchmarkResultVariantz
GPQA Diamond90.2%claude-opus-4-7_xhigh-0.57
ARC-AGI-275.8%claude-opus-4-7_max0.55
SimpleBench61.7%claude-opus-4-7_unknown-0.37
Humanity’s Last Exam36.2%claude-opus-4-7_unknown-0.19

Math

52 · rank 16 · 5 of 5 benchmarks

BenchmarkResultVariantz
FrontierMath Tiers 1–370.2%claude-opus-4-7_max0.15
FrontierMath Tier 431.7%claude-opus-4-7_max-0.39
OTIS Mock AIME97.8%claude-opus-4-7_xhigh0.55
ProofBench54.0%claude-opus-4-7_max0.25
LMArena Math1498 ratingclaude-opus-4-7-high0.66

Writing

85 · rank 6 · 2 of 2 benchmarks

BenchmarkResultVariantz
LMArena Creative Writing1485 ratingclaude-opus-4-7-high1.02
LMArena Instruction Following1498 ratingclaude-opus-4-7-high1.24

Design

41 · rank 20 · 1 of 1 benchmarks

BenchmarkResultVariantz
LMArena WebDev1557 ratingclaude-opus-4-7-0.01