Benchfolio

Leaderboard / Model

GPT-5.2

OpenAI · Closed weights · Released Dec 11, 2025 · $1.75 in · $14 out per 1M tokens

24Overall · rank 32

Score by job

Coding

27 · rank 28 · 3 of 5 benchmarks

BenchmarkResultVariantz
Terminal-Bench64.9%gpt-5.2-2025-12-11_unknown-0.40
SWE-bench Verified73.8%gpt-5.2-2025-12-11_high-0.78
LMArena Coding1446 ratinggpt-5.2-chat-latest-20260210-2.12

Agents

28 · rank 12 · 2 of 4 benchmarks

BenchmarkResultVariantz
Remote Labor Index2.5%gpt-5.2-2025-12-11_medium-0.92
METR Time Horizons5.9 hgpt-5.2-2025-12-11_high-0.06

Reasoning

22 · rank 33 · 4 of 4 benchmarks

BenchmarkResultVariantz
GPQA Diamond91.4%gpt-5.2-2025-12-11_xhigh-0.07
ARC-AGI-252.9%gpt-5.2-2025-12-11_xhigh-0.51
SimpleBench45.8%gpt-5.2-2025-12-11_high-1.96
Humanity’s Last Exam27.8%gpt-5.2-2025-12-11_unknown-1.16

Math

26 · rank 31 · 5 of 5 benchmarks

BenchmarkResultVariantz
FrontierMath Tiers 1–367.4%gpt-5.2-2025-12-11_xhigh-0.04
FrontierMath Tier 431.7%gpt-5.2-2025-12-11_xhigh-0.39
OTIS Mock AIME96.1%gpt-5.2-2025-12-11_high0.13
ProofBench15.0%gpt-5.2-2025-12-11_xhigh-1.29
LMArena Math1441 ratinggpt-5.2-high-1.46

Writing

30 · rank 40 · 2 of 2 benchmarks

BenchmarkResultVariantz
LMArena Creative Writing1402 ratinggpt-5.2-chat-latest-20260210-1.48
LMArena Instruction Following1417 ratinggpt-5.2-chat-latest-20260210-1.77

Design

10 · rank 42 · 1 of 1 benchmarks

BenchmarkResultVariantz
LMArena WebDev1417 ratinggpt-5.2-1.40