LIVE
Models: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:10 PMModels: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:10 PM
Marketplace
Providers Models
A

Alibaba

AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating

30-Day Uptime

100%
2026-07-212026-08-19

Inference Latency

Qwen: Qwen3.6 Plus (free)1481ms TTFT · 44 TPS
Qwen: Qwen3.6 Plus Preview (free)903ms TTFT · 34 TPS
Qwen: Qwen3.7 Flash824ms TTFT · 41 TPS
Qwen: Qwen-Turbo534ms TTFT · 29 TPS
Qwen: Qwen3.5-Flash588ms TTFT · 53 TPS
Qwen: Qwen3 Next 80B A3B Instruct418ms TTFT · 56 TPS
Qwen: Qwen3 VL 32B Instruct827ms TTFT · 39 TPS
Qwen: Qwen3 8B629ms TTFT · 48 TPS
Qwen: Qwen3 VL 8B Instruct356ms TTFT · 50 TPS
Qwen: Qwen3 30B A3B477ms TTFT · 75 TPS
Qwen: Qwen3 VL 30B A3B Instruct634ms TTFT · 28 TPS
Qwen: Qwen3 30B A3B Instruct 2507331ms TTFT · 66 TPS
DeepSeek: DeepSeek V4 Flash 0423847ms TTFT · 83 TPS
Qwen: Qwen VL Plus221ms TTFT · 102 TPS
Qwen: Qwen3 235B A22B Instruct 2507463ms TTFT · 44 TPS
Qwen: Qwen3 Next 80B A3B Thinking508ms TTFT · 239 TPS
Qwen: Qwen3.5-35B-A3B592ms TTFT · 127 TPS
Qwen: Qwen3 VL 8B Thinking408ms TTFT · 140 TPS
Qwen: Qwen3.6 Flash366ms TTFT · 81 TPS
Qwen: Qwen3 Coder Flash1419ms TTFT · 43 TPS

Inference Models

ModelInput $/MOutput $/MTTFTTPS
Qwen: Qwen3.6 Plus (free)$0.00$0.001481ms44
Qwen: Qwen3.6 Plus Preview (free)$0.00$0.00903ms34
Qwen: Qwen3.7 Flash$0.03$0.13824ms41
Qwen: Qwen-Turbo$0.03$0.13534ms29
Qwen: Qwen3.5-Flash$0.07$0.26588ms53
Qwen: Qwen3 Next 80B A3B Instruct$0.10$0.78418ms56
Qwen: Qwen3 VL 32B Instruct$0.10$0.42827ms39
Qwen: Qwen3 8B$0.12$0.45629ms48
Qwen: Qwen3 VL 8B Instruct$0.12$0.45356ms50
Qwen: Qwen3 30B A3B$0.13$0.52477ms75
Qwen: Qwen3 VL 30B A3B Instruct$0.13$0.52634ms28
Qwen: Qwen3 30B A3B Instruct 2507$0.13$0.52331ms66
DeepSeek: DeepSeek V4 Flash 0423$0.13$0.27847ms83
Qwen: Qwen VL Plus$0.14$0.41221ms102
Qwen: Qwen3 235B A22B Instruct 2507$0.15$0.60463ms44
Qwen: Qwen3 Next 80B A3B Thinking$0.15$1.20508ms239
Qwen: Qwen3.5-35B-A3B$0.16$1.30592ms127
Qwen: Qwen3 VL 8B Thinking$0.18$2.10408ms140
Qwen: Qwen3.6 Flash$0.19$1.13366ms81
Qwen: Qwen3 Coder Flash$0.20$0.981419ms43
Qwen: Qwen3.5-27B$0.20$1.56795ms30
Qwen: Qwen3 VL 30B A3B Thinking$0.20$2.40851ms99
Qwen: Qwen3 30B A3B Thinking 2507$0.20$2.40329ms161
Qwen: Qwen3 14B$0.23$0.91211ms60
Qwen: Qwen3 235B A22B Thinking 2507$0.23$2.30736ms43
Qwen: Qwen Plus 0728 (thinking)$0.26$0.78403ms76
Qwen: Qwen3.5 Plus 2026-02-15$0.26$1.562550ms62
Qwen: Qwen3 VL 235B A22B Instruct$0.26$1.04621ms30
Qwen: Qwen Plus 0728$0.26$0.78513ms55
Qwen: Qwen-Plus$0.26$0.78304ms49
Qwen: Qwen3.5-122B-A10B$0.26$2.08646ms60
Qwen: Qwen3 Coder 30B A3B Instruct$0.29$1.46877ms73
Qwen: Qwen3 Coder Next$0.30$1.502534ms26
Qwen: Qwen3.5 Plus 2026-04-20$0.30$1.802111ms37
Qwen: Qwen3.7 Plus$0.32$1.28748ms13
Qwen: Qwen3.6 Plus$0.33$1.951112ms32
DeepSeek: DeepSeek V3.2$0.37$1.11980ms46
Qwen: Qwen3.5 397B A17B$0.39$2.341276ms43
Qwen: Qwen3 VL 235B A22B Thinking$0.40$4.00781ms53
Qwen: Qwen3.6 27B$0.45$2.70791ms23
Qwen: Qwen3 235B A22B$0.45$1.82544ms44
Qwen: Qwen VL Max$0.52$2.081111ms37
Qwen: Qwen3 Coder Plus$0.65$3.251329ms34
Qwen: Qwen3 Max$0.78$3.90701ms15
Qwen: Qwen3 Max Thinking$0.78$3.901054ms36
MoonshotAI: Kimi K2.7 Code$0.95$4.003323ms30
Z.ai: GLM 5.2$0.97$3.041279ms48
Qwen: Qwen3 Coder 480B A35B$0.98$4.881129ms28
Qwen: Qwen3.6 Max Preview$1.03$6.161977ms51
Qwen: Qwen-Max $1.04$4.16520ms51
DeepSeek: DeepSeek V4 Pro 0813$1.32$3.961246ms54
Z.ai: GLM 5.1$1.33$4.182129ms42
DeepSeek: DeepSeek V4 Pro 0423$1.42$2.832105ms48
Qwen: Qwen3.7 Max$1.48$4.431127ms49
Qwen: Qwen3.8 Max$2.00$6.002410ms38
Qwen: Qwen3.8 2.4T A95B$2.00$6.001267ms42
Z.ai: GLM 5.2$2.31$7.261494ms38

Community Reviews

4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15

Reliable service, great API documentation.

mlresearcher
★★★★2025-06-10

Good performance but support could be faster.