Measured over the last 30 days
- Models Tracked
- 11
- Avg Tokens / Second
- 12.70
- Avg Time to First Token (ms)
- 18284.62
- Last Updated
- Sep 1, 2026
All z-ai models
11 tracked · fastest first| Model | Avg Toks/Sec | Min | Max | Avg TTF (ms) |
|---|---|---|---|---|
| GLM 5.2 | 12.30 | 9.68 | 16.10 | 3900.00 |
| GLM 4.5 Air | 9.25 | 9.02 | 9.45 | 5750.00 |
| GLM 5 Turbo | 9.06 | 1.55 | 14.70 | 12500.00 |
| GLM 4.5V | 3.78 | 2.50 | 5.60 | 18000.00 |
| GLM 5V Turbo | 3.17 | 2.12 | 4.77 | 21600.00 |
| GLM 4.5 | 2.64 | 2.03 | 3.18 | 25600.00 |
| GLM 5 | 2.53 | 1.93 | 3.73 | 28500.00 |
| GLM 4.7 | 2.32 | 1.18 | 3.33 | 32500.00 |
| GLM 4.6 | 2.16 | 1.08 | 3.49 | 36400.00 |
| GLM 4.6V | 1.46 | 1.46 | 1.46 | 41800.00 |
| GLM 5.1 | 1.25 | 1.15 | 1.34 | 49400.00 |
Frequently Asked Questions
Which z-ai model is fastest?
Based on recent tests, GLM 5.2 shows the highest average throughput among tracked z-ai models.
How many recent measurements feed this dashboard?
This provider summary aggregates 2563 individual prompts measured across 2472 monitoring runs over the past month.