LIVE
Models: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:07 PMModels: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:07 PM
Marketplace
Providers Models
C

CoreWeave

AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating

30-Day Uptime

100%
2026-07-212026-08-19

Inference Latency

OpenAI: gpt-oss-20b301ms TTFT · 88 TPS
OpenAI: gpt-oss-120b431ms TTFT · 32 TPS
IBM: Granite 4.1 8B79ms TTFT · 113 TPS
Qwen: Qwen3 30B A3B Instruct 2507387ms TTFT · 31 TPS
Google: Gemma 4 31B760ms TTFT · 29 TPS
NVIDIA: Nemotron 3.5 Lightning269ms TTFT · 58 TPS
DeepSeek: DeepSeek V4 Flash 07311198ms TTFT · 43 TPS
DeepSeek: DeepSeek V4 Flash 0423512ms TTFT · 46 TPS
Meta: Llama 3.1 8B Instruct160ms TTFT · 100 TPS
MiniMax: MiniMax M31382ms TTFT · 10 TPS
Qwen: Qwen3.6 35B A3B391ms TTFT · 106 TPS
Qwen: Qwen3.5-35B-A3B304ms TTFT · 211 TPS
DeepSeek: DeepSeek V3.1364ms TTFT · 44 TPS
Qwen: Qwen3.6 27B462ms TTFT · 56 TPS
MoonshotAI: Kimi K2.6542ms TTFT · 118 TPS
Meta: Llama 3.3 70B Instruct227ms TTFT · 40 TPS
MoonshotAI: Kimi K2.7 Code613ms TTFT · 187 TPS
Z.ai: GLM 5.2719ms TTFT · 84 TPS
Meta: Llama 3.1 70B Instruct223ms TTFT · 27 TPS
DeepSeek: DeepSeek V4 Pro 0423745ms TTFT · 51 TPS

Inference Models

ModelInput $/MOutput $/MTTFTTPS
OpenAI: gpt-oss-20b$0.03$0.13301ms88
OpenAI: gpt-oss-120b$0.03$0.17431ms32
IBM: Granite 4.1 8B$0.05$0.1079ms113
Qwen: Qwen3 30B A3B Instruct 2507$0.10$0.30387ms31
Google: Gemma 4 31B$0.10$0.34760ms29
NVIDIA: Nemotron 3.5 Lightning$0.10$0.25269ms58
DeepSeek: DeepSeek V4 Flash 0731$0.13$0.281198ms43
DeepSeek: DeepSeek V4 Flash 0423$0.14$0.28512ms46
Meta: Llama 3.1 8B Instruct$0.22$0.22160ms100
MiniMax: MiniMax M3$0.23$0.961382ms10
Qwen: Qwen3.6 35B A3B$0.25$1.25391ms106
Qwen: Qwen3.5-35B-A3B$0.25$1.25304ms211
DeepSeek: DeepSeek V3.1$0.55$1.65364ms44
Qwen: Qwen3.6 27B$0.60$3.60462ms56
MoonshotAI: Kimi K2.6$0.65$3.41542ms118
Meta: Llama 3.3 70B Instruct$0.71$0.71227ms40
MoonshotAI: Kimi K2.7 Code$0.71$3.50613ms187
Z.ai: GLM 5.2$0.76$2.42719ms84
Meta: Llama 3.1 70B Instruct$0.80$0.80223ms27
DeepSeek: DeepSeek V4 Pro 0423$1.15$2.55745ms51

Community Reviews

4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15

Reliable service, great API documentation.

mlresearcher
★★★★2025-06-10

Good performance but support could be faster.