llm-benchmarks
githubdrose.io

azure Provider Benchmarks


Measured over the last 30 days

Models Tracked
17
Avg Tokens / Second
18.12
Avg Time to First Token (ms)
4446.63
Last Updated
Sep 1, 2026

All azure models

17 tracked · fastest first
azure site
ModelAvg Toks/SecMinMaxAvg TTF (ms)
Claude Haiku 4.538.8031.8045.60940.00
GPT-3.5 Turbo (older v0613)38.1027.0050.401380.00
GPT-4o (2024-08-06)36.3015.9051.201590.00
GPT-4o35.3027.3050.201570.00
GPT-4o-mini28.9023.0035.901870.00
GPT-5.1-Codex27.407.3945.702500.00
Claude Sonnet 526.6020.0029.601120.00
DeepSeek V4 Pro 042326.5022.6029.501890.00
Claude Sonnet 4.623.6022.0025.701480.00
DeepSeek V4 Flash 042323.608.3236.303520.00
Claude Opus 4.523.1019.7025.901330.00
Claude Opus 4.721.5019.0022.701440.00
Claude Opus 4.821.4011.1024.101770.00
GPT-5.2-Codex19.709.6726.703390.00
Claude Sonnet 4.519.2018.0020.501660.00
Claude Opus 4.613.906.1916.803890.00
GPT-4o (2024-05-13)13.0010.3036.305380.00

Frequently Asked Questions

Which azure model is fastest?
Based on recent tests, Claude Haiku 4.5 shows the highest average throughput among tracked azure models.
How many recent measurements feed this dashboard?
This provider summary aggregates 8749 individual prompts measured across 4431 monitoring runs over the past month.