LIVE
Models: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:11 PMModels: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:11 PM
Marketplace
Providers Models
P

Parasail

AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating

30-Day Uptime

100%
2026-07-212026-08-19

Inference Latency

OpenAI: gpt-oss-20b635ms TTFT · 73 TPS
Mistral: Mistral Nemo525ms TTFT · 29 TPS
Sao10K: Llama 3 8B Lunaris500ms TTFT · 57 TPS
Meta: Llama 3.2 3B Instruct322ms TTFT · 73 TPS
MythoMax 13B356ms TTFT · 53 TPS
Google: Gemma 3 27B528ms TTFT · 24 TPS
Mistral: Mistral Small 3.2 24B1176ms TTFT · 20 TPS
ByteDance: UI-TARS 7B 1528ms TTFT · 8 TPS
AllenAI: Olmo 3 7B Instruct187ms TTFT · 44 TPS
Qwen: Qwen3.5-9B617ms TTFT · 37 TPS
OpenAI: gpt-oss-120b408ms TTFT · 105 TPS
Qwen: Qwen3 Next 80B A3B Instruct967ms TTFT · 42 TPS
Qwen: Qwen3 Coder Next809ms TTFT · 52 TPS
AllenAI: Olmo 3 7B Think183ms TTFT · 78 TPS
Google: Gemma 4 26B A4B 748ms TTFT · 22 TPS
DeepSeek: DeepSeek V4 Flash 0423671ms TTFT · 59 TPS
DeepSeek: DeepSeek V4 Flash 0731844ms TTFT · 57 TPS
Xiaomi: MiMo-V2.5729ms TTFT · 47 TPS
Qwen: Qwen3 235B A22B Instruct 2507720ms TTFT · 23 TPS
Qwen: Qwen3.6 35B A3B919ms TTFT · 33 TPS

Inference Models

ModelInput $/MOutput $/MTTFTTPS
OpenAI: gpt-oss-20b$0.03$0.15635ms73
Mistral: Mistral Nemo$0.03$0.03525ms29
Sao10K: Llama 3 8B Lunaris$0.04$0.05500ms57
Meta: Llama 3.2 3B Instruct$0.05$0.33322ms73
MythoMax 13B$0.08$0.11356ms53
Google: Gemma 3 27B$0.08$0.45528ms24
Mistral: Mistral Small 3.2 24B$0.09$0.301176ms20
ByteDance: UI-TARS 7B $0.10$0.201528ms8
AllenAI: Olmo 3 7B Instruct$0.10$0.20187ms44
Qwen: Qwen3.5-9B$0.10$0.25617ms37
OpenAI: gpt-oss-120b$0.10$0.75408ms105
Qwen: Qwen3 Next 80B A3B Instruct$0.10$1.10967ms42
Qwen: Qwen3 Coder Next$0.12$0.80809ms52
AllenAI: Olmo 3 7B Think$0.12$0.20183ms78
Google: Gemma 4 26B A4B $0.13$0.40748ms22
DeepSeek: DeepSeek V4 Flash 0423$0.14$0.28671ms59
DeepSeek: DeepSeek V4 Flash 0731$0.14$0.28844ms57
Xiaomi: MiMo-V2.5$0.14$0.28729ms47
Qwen: Qwen3 235B A22B Instruct 2507$0.14$0.80720ms23
Qwen: Qwen3.6 35B A3B$0.15$1.00919ms33
AllenAI: Olmo 3.1 32B Think$0.15$0.50244ms81
Qwen: Qwen3.5-35B-A3B$0.15$1.00458ms142
AllenAI: Olmo 3 32B Think$0.15$0.50263ms79
Google: Gemma 4 31B$0.15$0.40762ms31
AllenAI: Molmo2 8B$0.20$0.20283ms39
Qwen: Qwen3 VL 235B A22B Instruct$0.21$1.90886ms18
Meta: Llama 3.3 70B Instruct$0.22$0.50747ms19
Arcee AI: Trinity Large Thinking$0.22$0.85198ms62
TheDrummer: Rocinante 12B$0.25$0.50461ms56
Qwen: Qwen3 VL 8B Instruct$0.25$0.75770ms28
Meta: Muse Glimmer 30B$0.30$1.101903ms40
TheDrummer: Cydonia 24B V4.1$0.30$0.50851ms34
MiniMax: MiniMax M3$0.30$1.20802ms89
Meta: Llama 4 Maverick$0.35$1.00559ms54
TheDrummer: UnslopNemo 12B$0.40$0.40892ms86
Qwen: Qwen3.5 397B A17B$0.50$3.60420ms60
TheDrummer: Skyfall 36B V2$0.55$0.80429ms63
MoonshotAI: Kimi K2.6$0.75$3.50648ms42
MoonshotAI: Kimi K2.7 Code$0.76$3.501423ms49
Qwen: Qwen2.5 VL 72B Instruct$0.80$1.00639ms23
DeepSeek: DeepSeek V4 Pro 0813$1.32$3.961077ms44
Z.ai: GLM 5.2$1.40$4.40804ms116
Z.ai: GLM 5.1$1.40$4.40458ms137
DeepSeek: DeepSeek V4 Pro 0423$1.74$3.48961ms44

Community Reviews

4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15

Reliable service, great API documentation.

mlresearcher
★★★★2025-06-10

Good performance but support could be faster.