C
CoreWeave
AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating
30-Day Uptime
100%2026-07-212026-08-19
Inference Latency
OpenAI: gpt-oss-20b301ms TTFT · 88 TPS
OpenAI: gpt-oss-120b431ms TTFT · 32 TPS
IBM: Granite 4.1 8B79ms TTFT · 113 TPS
Qwen: Qwen3 30B A3B Instruct 2507387ms TTFT · 31 TPS
Google: Gemma 4 31B760ms TTFT · 29 TPS
NVIDIA: Nemotron 3.5 Lightning269ms TTFT · 58 TPS
DeepSeek: DeepSeek V4 Flash 07311198ms TTFT · 43 TPS
DeepSeek: DeepSeek V4 Flash 0423512ms TTFT · 46 TPS
Meta: Llama 3.1 8B Instruct160ms TTFT · 100 TPS
MiniMax: MiniMax M31382ms TTFT · 10 TPS
Qwen: Qwen3.6 35B A3B391ms TTFT · 106 TPS
Qwen: Qwen3.5-35B-A3B304ms TTFT · 211 TPS
DeepSeek: DeepSeek V3.1364ms TTFT · 44 TPS
Qwen: Qwen3.6 27B462ms TTFT · 56 TPS
MoonshotAI: Kimi K2.6542ms TTFT · 118 TPS
Meta: Llama 3.3 70B Instruct227ms TTFT · 40 TPS
MoonshotAI: Kimi K2.7 Code613ms TTFT · 187 TPS
Z.ai: GLM 5.2719ms TTFT · 84 TPS
Meta: Llama 3.1 70B Instruct223ms TTFT · 27 TPS
DeepSeek: DeepSeek V4 Pro 0423745ms TTFT · 51 TPS
Inference Models
| Model | Input $/M | Output $/M | TTFT | TPS |
|---|---|---|---|---|
| OpenAI: gpt-oss-20b | $0.03 | $0.13 | 301ms | 88 |
| OpenAI: gpt-oss-120b | $0.03 | $0.17 | 431ms | 32 |
| IBM: Granite 4.1 8B | $0.05 | $0.10 | 79ms | 113 |
| Qwen: Qwen3 30B A3B Instruct 2507 | $0.10 | $0.30 | 387ms | 31 |
| Google: Gemma 4 31B | $0.10 | $0.34 | 760ms | 29 |
| NVIDIA: Nemotron 3.5 Lightning | $0.10 | $0.25 | 269ms | 58 |
| DeepSeek: DeepSeek V4 Flash 0731 | $0.13 | $0.28 | 1198ms | 43 |
| DeepSeek: DeepSeek V4 Flash 0423 | $0.14 | $0.28 | 512ms | 46 |
| Meta: Llama 3.1 8B Instruct | $0.22 | $0.22 | 160ms | 100 |
| MiniMax: MiniMax M3 | $0.23 | $0.96 | 1382ms | 10 |
| Qwen: Qwen3.6 35B A3B | $0.25 | $1.25 | 391ms | 106 |
| Qwen: Qwen3.5-35B-A3B | $0.25 | $1.25 | 304ms | 211 |
| DeepSeek: DeepSeek V3.1 | $0.55 | $1.65 | 364ms | 44 |
| Qwen: Qwen3.6 27B | $0.60 | $3.60 | 462ms | 56 |
| MoonshotAI: Kimi K2.6 | $0.65 | $3.41 | 542ms | 118 |
| Meta: Llama 3.3 70B Instruct | $0.71 | $0.71 | 227ms | 40 |
| MoonshotAI: Kimi K2.7 Code | $0.71 | $3.50 | 613ms | 187 |
| Z.ai: GLM 5.2 | $0.76 | $2.42 | 719ms | 84 |
| Meta: Llama 3.1 70B Instruct | $0.80 | $0.80 | 223ms | 27 |
| DeepSeek: DeepSeek V4 Pro 0423 | $1.15 | $2.55 | 745ms | 51 |
Community Reviews
4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15
Reliable service, great API documentation.
mlresearcher
★★★★☆2025-06-10
Good performance but support could be faster.