A
Alibaba
AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating
30-Day Uptime
100%2026-07-212026-08-19
Inference Latency
Qwen: Qwen3.6 Plus (free)1481ms TTFT · 44 TPS
Qwen: Qwen3.6 Plus Preview (free)903ms TTFT · 34 TPS
Qwen: Qwen3.7 Flash824ms TTFT · 41 TPS
Qwen: Qwen-Turbo534ms TTFT · 29 TPS
Qwen: Qwen3.5-Flash588ms TTFT · 53 TPS
Qwen: Qwen3 Next 80B A3B Instruct418ms TTFT · 56 TPS
Qwen: Qwen3 VL 32B Instruct827ms TTFT · 39 TPS
Qwen: Qwen3 8B629ms TTFT · 48 TPS
Qwen: Qwen3 VL 8B Instruct356ms TTFT · 50 TPS
Qwen: Qwen3 30B A3B477ms TTFT · 75 TPS
Qwen: Qwen3 VL 30B A3B Instruct634ms TTFT · 28 TPS
Qwen: Qwen3 30B A3B Instruct 2507331ms TTFT · 66 TPS
DeepSeek: DeepSeek V4 Flash 0423847ms TTFT · 83 TPS
Qwen: Qwen VL Plus221ms TTFT · 102 TPS
Qwen: Qwen3 235B A22B Instruct 2507463ms TTFT · 44 TPS
Qwen: Qwen3 Next 80B A3B Thinking508ms TTFT · 239 TPS
Qwen: Qwen3.5-35B-A3B592ms TTFT · 127 TPS
Qwen: Qwen3 VL 8B Thinking408ms TTFT · 140 TPS
Qwen: Qwen3.6 Flash366ms TTFT · 81 TPS
Qwen: Qwen3 Coder Flash1419ms TTFT · 43 TPS
Inference Models
| Model | Input $/M | Output $/M | TTFT | TPS |
|---|---|---|---|---|
| Qwen: Qwen3.6 Plus (free) | $0.00 | $0.00 | 1481ms | 44 |
| Qwen: Qwen3.6 Plus Preview (free) | $0.00 | $0.00 | 903ms | 34 |
| Qwen: Qwen3.7 Flash | $0.03 | $0.13 | 824ms | 41 |
| Qwen: Qwen-Turbo | $0.03 | $0.13 | 534ms | 29 |
| Qwen: Qwen3.5-Flash | $0.07 | $0.26 | 588ms | 53 |
| Qwen: Qwen3 Next 80B A3B Instruct | $0.10 | $0.78 | 418ms | 56 |
| Qwen: Qwen3 VL 32B Instruct | $0.10 | $0.42 | 827ms | 39 |
| Qwen: Qwen3 8B | $0.12 | $0.45 | 629ms | 48 |
| Qwen: Qwen3 VL 8B Instruct | $0.12 | $0.45 | 356ms | 50 |
| Qwen: Qwen3 30B A3B | $0.13 | $0.52 | 477ms | 75 |
| Qwen: Qwen3 VL 30B A3B Instruct | $0.13 | $0.52 | 634ms | 28 |
| Qwen: Qwen3 30B A3B Instruct 2507 | $0.13 | $0.52 | 331ms | 66 |
| DeepSeek: DeepSeek V4 Flash 0423 | $0.13 | $0.27 | 847ms | 83 |
| Qwen: Qwen VL Plus | $0.14 | $0.41 | 221ms | 102 |
| Qwen: Qwen3 235B A22B Instruct 2507 | $0.15 | $0.60 | 463ms | 44 |
| Qwen: Qwen3 Next 80B A3B Thinking | $0.15 | $1.20 | 508ms | 239 |
| Qwen: Qwen3.5-35B-A3B | $0.16 | $1.30 | 592ms | 127 |
| Qwen: Qwen3 VL 8B Thinking | $0.18 | $2.10 | 408ms | 140 |
| Qwen: Qwen3.6 Flash | $0.19 | $1.13 | 366ms | 81 |
| Qwen: Qwen3 Coder Flash | $0.20 | $0.98 | 1419ms | 43 |
| Qwen: Qwen3.5-27B | $0.20 | $1.56 | 795ms | 30 |
| Qwen: Qwen3 VL 30B A3B Thinking | $0.20 | $2.40 | 851ms | 99 |
| Qwen: Qwen3 30B A3B Thinking 2507 | $0.20 | $2.40 | 329ms | 161 |
| Qwen: Qwen3 14B | $0.23 | $0.91 | 211ms | 60 |
| Qwen: Qwen3 235B A22B Thinking 2507 | $0.23 | $2.30 | 736ms | 43 |
| Qwen: Qwen Plus 0728 (thinking) | $0.26 | $0.78 | 403ms | 76 |
| Qwen: Qwen3.5 Plus 2026-02-15 | $0.26 | $1.56 | 2550ms | 62 |
| Qwen: Qwen3 VL 235B A22B Instruct | $0.26 | $1.04 | 621ms | 30 |
| Qwen: Qwen Plus 0728 | $0.26 | $0.78 | 513ms | 55 |
| Qwen: Qwen-Plus | $0.26 | $0.78 | 304ms | 49 |
| Qwen: Qwen3.5-122B-A10B | $0.26 | $2.08 | 646ms | 60 |
| Qwen: Qwen3 Coder 30B A3B Instruct | $0.29 | $1.46 | 877ms | 73 |
| Qwen: Qwen3 Coder Next | $0.30 | $1.50 | 2534ms | 26 |
| Qwen: Qwen3.5 Plus 2026-04-20 | $0.30 | $1.80 | 2111ms | 37 |
| Qwen: Qwen3.7 Plus | $0.32 | $1.28 | 748ms | 13 |
| Qwen: Qwen3.6 Plus | $0.33 | $1.95 | 1112ms | 32 |
| DeepSeek: DeepSeek V3.2 | $0.37 | $1.11 | 980ms | 46 |
| Qwen: Qwen3.5 397B A17B | $0.39 | $2.34 | 1276ms | 43 |
| Qwen: Qwen3 VL 235B A22B Thinking | $0.40 | $4.00 | 781ms | 53 |
| Qwen: Qwen3.6 27B | $0.45 | $2.70 | 791ms | 23 |
| Qwen: Qwen3 235B A22B | $0.45 | $1.82 | 544ms | 44 |
| Qwen: Qwen VL Max | $0.52 | $2.08 | 1111ms | 37 |
| Qwen: Qwen3 Coder Plus | $0.65 | $3.25 | 1329ms | 34 |
| Qwen: Qwen3 Max | $0.78 | $3.90 | 701ms | 15 |
| Qwen: Qwen3 Max Thinking | $0.78 | $3.90 | 1054ms | 36 |
| MoonshotAI: Kimi K2.7 Code | $0.95 | $4.00 | 3323ms | 30 |
| Z.ai: GLM 5.2 | $0.97 | $3.04 | 1279ms | 48 |
| Qwen: Qwen3 Coder 480B A35B | $0.98 | $4.88 | 1129ms | 28 |
| Qwen: Qwen3.6 Max Preview | $1.03 | $6.16 | 1977ms | 51 |
| Qwen: Qwen-Max | $1.04 | $4.16 | 520ms | 51 |
| DeepSeek: DeepSeek V4 Pro 0813 | $1.32 | $3.96 | 1246ms | 54 |
| Z.ai: GLM 5.1 | $1.33 | $4.18 | 2129ms | 42 |
| DeepSeek: DeepSeek V4 Pro 0423 | $1.42 | $2.83 | 2105ms | 48 |
| Qwen: Qwen3.7 Max | $1.48 | $4.43 | 1127ms | 49 |
| Qwen: Qwen3.8 Max | $2.00 | $6.00 | 2410ms | 38 |
| Qwen: Qwen3.8 2.4T A95B | $2.00 | $6.00 | 1267ms | 42 |
| Z.ai: GLM 5.2 | $2.31 | $7.26 | 1494ms | 38 |
Community Reviews
4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15
Reliable service, great API documentation.
mlresearcher
★★★★☆2025-06-10
Good performance but support could be faster.