llm-benchmarks
githubdrose.io

siliconflow Provider Benchmarks


Measured over the last 30 days

Models Tracked
47
Avg Tokens / Second
15.37
Avg Time to First Token (ms)
10911.85
Last Updated
Sep 1, 2026

All siliconflow models

47 tracked · fastest first
ModelAvg Toks/SecMinMaxAvg TTF (ms)
Gemma 4 26B A4B31.307.4047.602680.00
Hunyuan A13B Instruct29.105.1242.901870.00
Hunyuan A13B Instruct28.405.2537.803760.00
Gemma 4 31B22.9018.4027.601950.00
Qwen3 Coder 30B A3B Instruct22.9012.7027.301680.00
Qwen3 30B A3B Instruct 250720.2018.2021.601690.00
GLM 5.219.9017.3021.902410.00
Qwen3 Coder 30B A3B Instruct19.506.9031.402160.00
Nex-N2-Pro18.4015.8022.303110.00
DeepSeek V3 032417.306.5123.201260.00
Qwen3 30B A3B Instruct 250716.5012.3022.801500.00
DeepSeek V3 032416.3012.8017.901530.00
GLM 4.5 Air15.908.1531.004930.00
DeepSeek V3.215.3013.7016.801830.00
DeepSeek V3.2 Exp14.8013.0016.402000.00
Step 3.5 Flash14.7014.7014.703450.00
DeepSeek V3.1 Terminus14.1013.3014.701280.00
DeepSeek V4 Flash 073113.804.4718.305830.00
DeepSeek V3.1 Terminus13.407.3515.601720.00
Step 3.5 Flash12.3010.7014.504480.00
DeepSeek V3.112.104.2416.204000.00
Qwen3 VL 30B A3B Instruct11.402.1423.8010100.00
Qwen3 VL 30B A3B Thinking11.0010.7011.305330.00
Kimi K2.7 Code10.407.6413.505670.00
Qwen3.5-122B-A10B7.873.8517.2013600.00
DeepSeek V4 Flash 04237.253.8013.209830.00
gpt-oss-120b7.113.1214.1010100.00
DeepSeek V4 Pro 04235.201.608.7816800.00
Qwen3.5-122B-A10B5.013.236.9712800.00
Kimi K2.54.852.608.9116100.00
Kimi K2.64.793.086.1213300.00
gpt-oss-20b4.581.597.9618900.00
MiniMax M2.54.093.185.2815000.00
Kimi K2.54.051.517.4517500.00
Qwen3.8 2.4T A95B3.883.883.8814800.00
Qwen3 32B3.431.266.8125700.00
Qwen3.6 35B A3B3.391.234.8026100.00
Qwen3.5-9B2.971.514.7524600.00
GLM 52.802.682.9522000.00
R1 05282.621.357.8322100.00
Qwen3.5-35B-A3B2.572.123.0124600.00
GLM 5.12.512.113.1525200.00
R1 05282.371.882.5924100.00
Qwen3.5-9B2.231.902.6628200.00
Qwen3.5-27B1.591.342.3440200.00
Qwen3.6 27B1.571.401.7439900.00
Qwen3.5-27B1.561.371.8539800.00

Frequently Asked Questions

Which siliconflow model is fastest?
Based on recent tests, Gemma 4 26B A4B shows the highest average throughput among tracked siliconflow models.
How many recent measurements feed this dashboard?
This provider summary aggregates 7968 individual prompts measured across 5977 monitoring runs over the past month.