llm-benchmarks
githubdrose.io

alibaba Provider Benchmarks


Measured over the last 30 days

Models Tracked
84
Avg Tokens / Second
16.25
Avg Time to First Token (ms)
10827.65
Last Updated
Sep 1, 2026

All alibaba models

84 tracked · fastest first
ModelAvg Toks/SecMinMaxAvg TTF (ms)
Qwen3 VL 30B A3B Instruct124.00124.00124.00870.00
Qwen3 VL 8B Instruct58.0056.0060.20670.00
Qwen3.5-122B-A10B51.5041.1059.40880.00
Qwen3.5-122B-A10B50.4045.3058.101040.00
Qwen3 VL 8B Instruct50.0027.00141.00950.00
Qwen3 30B A3B Instruct 250749.3046.9053.80650.00
Qwen3 Next 80B A3B Instruct48.9042.6051.80740.00
Qwen3 Coder 30B A3B Instruct47.505.62110.001470.00
Qwen3 VL 30B A3B Instruct47.2042.5050.40870.00
Qwen3 VL 30B A3B Instruct45.3030.10121.001020.00
Qwen3 VL 32B Instruct42.4038.1050.90850.00
Qwen3.5-Flash41.1013.3085.501350.00
Qwen3 Coder 30B A3B Instruct40.2037.0046.001080.00
Qwen3.5-Flash37.9013.9050.201830.00
Qwen3 Coder Flash36.3022.60108.001390.00
Qwen3 VL 32B Instruct35.906.2265.001240.00
Qwen Plus 072835.2034.2035.90760.00
Qwen3 Coder Flash35.0032.3038.401240.00
Qwen3 235B A22B Instruct 250734.0034.0034.00800.00
Qwen-Plus33.8032.6034.70760.00
Qwen3 235B A22B Instruct 250733.8032.2035.90830.00
Qwen3 VL 235B A22B Instruct33.8029.4036.00770.00
Qwen3 Next 80B A3B Instruct32.709.6044.902270.00
Qwen3 Coder 480B A35B32.1032.1032.101340.00
Qwen Plus 072831.2019.4058.501100.00
Qwen3 Coder Next30.8014.6045.802230.00
Qwen3 VL 235B A22B Instruct30.2019.1040.601070.00
DeepSeek V3.230.1026.2033.401070.00
Qwen3 Coder 480B A35B30.1029.6030.801340.00
Qwen-Plus29.6020.3054.001120.00
Qwen3 Coder Plus26.5021.2035.301310.00
Qwen3.5-35B-A3B25.404.3550.205940.00
Qwen3 Max Thinking24.7018.6031.001310.00
Qwen3 Coder Plus23.4012.9030.701530.00
Qwen3 Max Thinking22.9015.6033.801510.00
Qwen3 Max22.8015.9030.101460.00
Qwen3 Max21.4017.3024.501290.00
GLM 5.220.702.3232.205690.00
Qwen3 VL 8B Thinking16.2010.10113.004400.00
Qwen3 VL 30B A3B Thinking14.708.96104.004770.00
Qwen3 30B A3B14.4011.0015.803960.00
Qwen3 VL 8B Thinking14.1012.2015.804150.00
GLM 5.213.903.5225.808200.00
Qwen3 30B A3B Thinking 250713.508.9071.504960.00
Qwen3 30B A3B Thinking 250712.5012.2012.904650.00
Qwen3.8 Max12.2012.2012.203930.00
DeepSeek V4 Pro 042312.109.3115.504690.00
Qwen3 VL 30B A3B Thinking12.107.8314.105070.00
Qwen3 14B11.308.6814.205700.00
DeepSeek V4 Flash 042311.008.5313.105530.00
Qwen3 8B9.807.1511.305770.00
Qwen3 8B9.337.7011.006130.00
Qwen3 Next 80B A3B Thinking9.169.169.166510.00
Qwen3 VL 235B A22B Thinking8.985.5344.909040.00
Kimi K2.7 Code8.377.309.336930.00
Qwen3.8 2.4T A95B8.195.1611.807250.00
Qwen3.8 Max7.255.2811.107940.00
Qwen3 Next 80B A3B Thinking7.193.209.4511100.00
Qwen3 235B A22B Thinking 25076.746.746.748930.00
Qwen3 235B A22B Thinking 25076.623.429.399910.00
Qwen3 235B A22B6.302.2521.7010900.00
Qwen3.5 Plus 2026-02-154.902.9123.0015300.00
Qwen3.7 Flash4.764.315.0613300.00
Qwen3.6 Flash4.614.614.6113800.00
Qwen3 235B A22B4.583.685.3312100.00
Qwen3.5-27B4.554.434.6213600.00
Qwen3.6 Flash4.543.735.2514100.00
Qwen3.7 Flash4.483.525.1614100.00
Qwen3.5-27B4.442.425.4414100.00
Qwen3.5 397B A17B3.802.075.5516900.00
Qwen3 VL 235B A22B Thinking3.460.835.5433800.00
Qwen3.5 397B A17B3.312.803.7418800.00
Qwen3.5 Plus 2026-02-153.302.744.2819300.00
Qwen3.8 27B3.231.994.4722000.00
DeepSeek V4 Flash 07313.193.193.1920400.00
Qwen3.6 Plus2.562.562.5625100.00
Qwen3.7 Plus2.412.272.5826200.00
Qwen3.6 Plus2.351.872.8127300.00
Qwen3.7 Plus2.352.352.3526600.00
GLM 5.12.232.182.2827700.00
Qwen3.5 Plus 2026-04-201.991.991.9931500.00
Qwen3.5 Plus 2026-04-201.941.862.0032700.00
Qwen3.6 Max Preview1.891.202.6334600.00
Qwen3.6 Max Preview1.831.432.2035200.00

Frequently Asked Questions

Which alibaba model is fastest?
Based on recent tests, Qwen3 VL 30B A3B Instruct shows the highest average throughput among tracked alibaba models.
How many recent measurements feed this dashboard?
This provider summary aggregates 5779 individual prompts measured across 4655 monitoring runs over the past month.