Benchfolio

Leaderboard / Model

Claude Sonnet 5

Anthropic · Closed weights · Released Jun 30, 2026 · $2 in · $10 out per 1M tokens

44Overall · rank 23

Score by job

Coding

57 · rank 18 · 3 of 5 benchmarks

BenchmarkResultVariantz
DeepSWE53.8%claude-sonnet-5_max-0.21
FrontierCode42.7%claude-sonnet-5_unknown0.33
LMArena Coding1485 ratingclaude-sonnet-5-high-0.29

Agents

Not enough data · 1 of 4 benchmarks

BenchmarkResultVariantz
APEX-Agents54.5%claude-sonnet-5_unknown0.21

Reasoning

36 · rank 28 · 2 of 4 benchmarks

BenchmarkResultVariantz
GPQA Diamond90.5%claude-sonnet-5_xhigh-0.41
SimpleBench60.6%claude-sonnet-5_unknown-0.48

Math

44 · rank 19 · 5 of 5 benchmarks

BenchmarkResultVariantz
FrontierMath Tiers 1–365.6%claude-sonnet-5_max-0.16
FrontierMath Tier 429.3%claude-sonnet-5_max-0.49
OTIS Mock AIME94.7%claude-sonnet-5_xhigh-0.21
ProofBench77.0%claude-sonnet-5_max1.16
LMArena Math1469 ratingclaude-sonnet-5-high-0.41

Writing

47 · rank 33 · 2 of 2 benchmarks

BenchmarkResultVariantz
LMArena Creative Writing1417 ratingclaude-sonnet-5-high-1.01
LMArena Instruction Following1450 ratingclaude-sonnet-5-high-0.53

Design

37 · rank 25 · 1 of 1 benchmarks

BenchmarkResultVariantz
LMArena WebDev1538 ratingclaude-sonnet-5-high-0.20