LIVE
Models: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:09 PMModels: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:09 PM
Marketplace
Providers Models
S

SiliconFlow

AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating

30-Day Uptime

100%
2026-07-212026-08-19

Inference Latency

Nex AGI: Nex-N2-Pro (free)1673ms TTFT · 74 TPS
Tencent: Hy3 preview (free)3863ms TTFT · 47 TPS
OpenAI: gpt-oss-20b1338ms TTFT · 18 TPS
OpenAI: gpt-oss-120b1610ms TTFT · 18 TPS
Qwen: Qwen3 Coder 30B A3B Instruct1452ms TTFT · 27 TPS
Qwen: Qwen3 30B A3B Instruct 25072572ms TTFT · 12 TPS
Qwen: Qwen3.5-9B1937ms TTFT · 11 TPS
StepFun: Step 3.5 Flash1098ms TTFT · 45 TPS
Google: Gemma 4 26B A4B 1497ms TTFT · 29 TPS
Google: Gemma 4 31B2942ms TTFT · 17 TPS
DeepSeek: DeepSeek V4 Flash 04231467ms TTFT · 61 TPS
Nex AGI: DeepSeek V3.1 Nex N12319ms TTFT · 32 TPS
Tencent: Hunyuan A13B Instruct990ms TTFT · 2 TPS
Qwen: Qwen3 32B2079ms TTFT · 13 TPS
Z.ai: GLM 4.5 Air1528ms TTFT · 15 TPS
DeepSeek: DeepSeek V4 Flash 07311655ms TTFT · 59 TPS
Qwen: QwQ 32B1325ms TTFT · 44 TPS
Qwen: Qwen3.6 35B A3B2073ms TTFT · 28 TPS
Qwen: Qwen3.5-35B-A3B1342ms TTFT · 50 TPS
Qwen: Qwen3.5-27B2079ms TTFT · 18 TPS

Inference Models

ModelInput $/MOutput $/MTTFTTPS
Nex AGI: Nex-N2-Pro (free)$0.00$0.001673ms74
Tencent: Hy3 preview (free)$0.00$0.003863ms47
OpenAI: gpt-oss-20b$0.04$0.181338ms18
OpenAI: gpt-oss-120b$0.05$0.451610ms18
Qwen: Qwen3 Coder 30B A3B Instruct$0.07$0.281452ms27
Qwen: Qwen3 30B A3B Instruct 2507$0.09$0.302572ms12
Qwen: Qwen3.5-9B$0.10$0.151937ms11
StepFun: Step 3.5 Flash$0.10$0.301098ms45
Google: Gemma 4 26B A4B $0.12$0.401497ms29
Google: Gemma 4 31B$0.13$0.402942ms17
DeepSeek: DeepSeek V4 Flash 0423$0.13$0.281467ms61
Nex AGI: DeepSeek V3.1 Nex N1$0.14$0.502319ms32
Tencent: Hunyuan A13B Instruct$0.14$0.57990ms2
Qwen: Qwen3 32B$0.14$0.572079ms13
Z.ai: GLM 4.5 Air$0.14$0.861528ms15
DeepSeek: DeepSeek V4 Flash 0731$0.14$0.281655ms59
Qwen: QwQ 32B$0.15$0.581325ms44
Qwen: Qwen3.6 35B A3B$0.20$1.602073ms28
Qwen: Qwen3.5-35B-A3B$0.24$1.801342ms50
Qwen: Qwen3.5-27B$0.25$2.002079ms18
DeepSeek: DeepSeek V3 0324$0.25$1.001691ms15
DeepSeek: DeepSeek V3.2$0.26$0.421865ms21
Qwen: Qwen3.5-122B-A10B$0.26$2.081209ms26
DeepSeek: DeepSeek V3.1$0.27$1.002206ms4
DeepSeek: DeepSeek V3.1 Terminus$0.27$1.002070ms4
DeepSeek: DeepSeek V3.2 Exp$0.27$0.411657ms14
Qwen: Qwen3 VL 30B A3B Thinking$0.29$1.001134ms53
Qwen: Qwen3 VL 30B A3B Instruct$0.29$1.002427ms9
Qwen: Qwen3.6 27B$0.30$3.203247ms16
MiniMax: MiniMax M2.5$0.30$1.201438ms45
MoonshotAI: Kimi K2.5$0.45$2.251635ms41
DeepSeek: R1 0528$0.50$2.181652ms18
Nex AGI: Nex-N2-Pro$0.50$2.501234ms94
MoonshotAI: Kimi K2.6$0.77$3.401069ms50
MoonshotAI: Kimi K2.7 Code$0.86$3.801179ms56
Z.ai: GLM 5$0.95$2.552799ms47
Z.ai: GLM 5.2$1.19$3.741965ms41
Z.ai: GLM 5.1$1.19$3.741800ms41
DeepSeek: DeepSeek V4 Pro 0813$1.32$3.962027ms54
DeepSeek: DeepSeek V4 Pro 0423$1.50$3.141960ms41
Qwen: Qwen3.8 2.4T A95B$2.00$6.001558ms41

Community Reviews

4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15

Reliable service, great API documentation.

mlresearcher
★★★★2025-06-10

Good performance but support could be faster.