LIVE
Models: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:11 PMModels: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:11 PM
Marketplace
Providers Models
G

GMICloud

AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating

30-Day Uptime

96.7%
2026-07-212026-08-19

Inference Latency

DeepSeek: DeepSeek V4 Flash 04232631ms TTFT · 41 TPS
DeepSeek: DeepSeek V4 Flash 07312915ms TTFT · 47 TPS
Xiaomi: MiMo-V2.54442ms TTFT · 2 TPS
Tencent: Hy32203ms TTFT · 14 TPS
Tencent: Hy3 preview3095ms TTFT · 53 TPS
DeepSeek: DeepSeek V3.22167ms TTFT · 24 TPS
MiniMax: MiniMax M33362ms TTFT · 34 TPS
MiniMax: MiniMax M2.74167ms TTFT · 5 TPS
Xiaomi: MiMo-V2.5-Pro3864ms TTFT · 23 TPS
Z.ai: GLM 51526ms TTFT · 37 TPS
DeepSeek: DeepSeek V4 Pro 04233410ms TTFT · 33 TPS
Z.ai: GLM 5.22192ms TTFT · 30 TPS
Z.ai: GLM 5.12841ms TTFT · 60 TPS
DeepSeek: DeepSeek V4 Pro 08134083ms TTFT · 38 TPS

Inference Models

ModelInput $/MOutput $/MTTFTTPS
DeepSeek: DeepSeek V4 Flash 0423$0.08$0.172631ms41
DeepSeek: DeepSeek V4 Flash 0731$0.11$0.222915ms47
Xiaomi: MiMo-V2.5$0.12$0.244442ms2
Tencent: Hy3$0.13$0.522203ms14
Tencent: Hy3 preview$0.18$0.603095ms53
DeepSeek: DeepSeek V3.2$0.21$0.312167ms24
MiniMax: MiniMax M3$0.24$0.963362ms34
MiniMax: MiniMax M2.7$0.24$0.964167ms5
Xiaomi: MiMo-V2.5-Pro$0.30$0.613864ms23
Qwen: Qwen3.5 397B A17B$0.60$3.60
Z.ai: GLM 5$0.60$1.921526ms37
DeepSeek: DeepSeek V4 Pro 0423$0.70$1.393410ms33
Z.ai: GLM 5.2$0.74$2.332192ms30
Z.ai: GLM 5.1$0.91$2.862841ms60
DeepSeek: DeepSeek V4 Pro 0813$1.19$3.564083ms38

Community Reviews

4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15

Reliable service, great API documentation.

mlresearcher
★★★★2025-06-10

Good performance but support could be faster.