LIVE
Models: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:11 PMModels: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:11 PM
Marketplace
Providers Models
Z

Z.AI

AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating

30-Day Uptime

96.7%
2026-07-212026-08-19

Inference Latency

Z.ai: GLM 4.5 Air (free)4441ms TTFT · 29 TPS
Z.ai: GLM 4 32B 1307ms TTFT · 2 TPS
Z.ai: GLM 4.5 Air1558ms TTFT · 27 TPS
Z.ai: GLM 4.6V5826ms TTFT · 31 TPS
Z.ai: GLM 4.59274ms TTFT · 36 TPS
Z.ai: GLM 4.6 (exacto)2519ms TTFT · 78 TPS
Z.ai: GLM 4.715590ms TTFT · 25 TPS
Z.ai: GLM 4.63743ms TTFT · 34 TPS
Z.ai: GLM 4.5V2220ms TTFT · 34 TPS
Z.ai: GLM 57802ms TTFT · 71 TPS
Z.ai: GLM 5 Turbo9750ms TTFT · 11 TPS
Z.ai: GLM 5V Turbo5490ms TTFT · 33 TPS
Z.ai: GLM 5.35777ms TTFT · 27 TPS
Z.ai: GLM 5.18698ms TTFT · 20 TPS
Z.ai: GLM 5.25212ms TTFT · 44 TPS

Inference Models

ModelInput $/MOutput $/MTTFTTPS
Z.ai: GLM 4.5 Air (free)$0.00$0.004441ms29
Z.ai: GLM 4 32B $0.10$0.101307ms2
Z.ai: GLM 4.5 Air$0.20$1.101558ms27
Z.ai: GLM 4.6V$0.30$0.905826ms31
Z.ai: GLM 4.5$0.60$2.209274ms36
Z.ai: GLM 4.6 (exacto)$0.60$2.202519ms78
Z.ai: GLM 4.7$0.60$2.2015590ms25
Z.ai: GLM 4.6$0.60$2.203743ms34
Z.ai: GLM 4.5V$0.60$1.802220ms34
Z.ai: GLM 5$1.00$3.207802ms71
Z.ai: GLM 5 Turbo$1.20$4.009750ms11
Z.ai: GLM 5V Turbo$1.20$4.005490ms33
Z.ai: GLM 5.3$1.40$4.405777ms27
Z.ai: GLM 5.1$1.40$4.408698ms20
Z.ai: GLM 5.2$1.40$4.405212ms44

Community Reviews

4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15

Reliable service, great API documentation.

mlresearcher
★★★★2025-06-10

Good performance but support could be faster.