Measured over the last 30 days
- Models Tracked
- 5
- Avg Tokens / Second
- 23.68
- Avg Time to First Token (ms)
- 8228.00
- Last Updated
- Sep 12, 2026
All dekallm models
5 live · one row per model · fastest first| Model | Avg Toks/Sec | Min | Max | Avg TTF (ms) |
|---|---|---|---|---|
| Qwen3 30B A3B Instruct 2507 | 56.40 | 56.40 | 56.40 | 620.00 |
| Gemma 4 26B A4B | 43.30 | 43.30 | 43.30 | 840.00 |
| Qwen3.6 35B A3B | 9.09 | 9.09 | 9.09 | 7010.00 |
| gpt-oss-120b | 7.34 | 7.34 | 7.34 | 6970.00 |
| gpt-oss-20b | 2.29 | 2.29 | 2.29 | 25700.00 |
Frequently Asked Questions
Which dekallm model is fastest?
Based on recent tests, Qwen3 30B A3B Instruct 2507 shows the highest average throughput among tracked dekallm models.
How many recent measurements feed this dashboard?
This provider summary aggregates 1292 individual prompts measured across 1243 monitoring runs over the past month.