Leaderboard / Model
GLM-5.1
Z.ai (Zhipu AI) · Open weights · Released Apr 7, 2026 · $1.40 in · $4.40 out per 1M tokens
32Overall · rank 28
Score by job
Coding
Not enough data · 2 of 5 benchmarks
| Benchmark | Result | Variant | z |
|---|---|---|---|
| SWE-bench Verified | 74.2% | glm-5.1 | -0.66 |
| LMArena Coding | 1486 rating | glm-5.1 | -0.24 |
Agents
Not enough data · 1 of 4 benchmarks
| Benchmark | Result | Variant | z |
|---|---|---|---|
| APEX-Agents | 40.9% | glm-5.1 | -1.09 |
Reasoning
24 · rank 32 · 2 of 4 benchmarks
| Benchmark | Result | Variant | z |
|---|---|---|---|
| GPQA Diamond | 89.9% | glm-5.1 | -0.67 |
| SimpleBench | 55.1% | glm-5.1 | -1.03 |
Math
15 · rank 36 · 4 of 5 benchmarks
| Benchmark | Result | Variant | z |
|---|---|---|---|
| FrontierMath Tiers 1–3 | 36.8% | glm-5.1 | -2.15 |
| OTIS Mock AIME | 93.3% | glm-5.1 | -0.55 |
| ProofBench | 22.2% | glm-5.1 | -1.01 |
| LMArena Math | 1473 rating | glm-5.1 | -0.26 |
Writing
57 · rank 26 · 2 of 2 benchmarks
| Benchmark | Result | Variant | z |
|---|---|---|---|
| LMArena Creative Writing | 1452 rating | glm-5.1 | 0.03 |
| LMArena Instruction Following | 1450 rating | glm-5.1 | -0.53 |
Design
30 · rank 33 · 1 of 1 benchmarks
| Benchmark | Result | Variant | z |
|---|---|---|---|
| LMArena WebDev | 1508 rating | glm-5.1 | -0.49 |