P
Parasail
AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating
30-Day Uptime
100%2026-07-212026-08-19
Inference Latency
OpenAI: gpt-oss-20b635ms TTFT · 73 TPS
Mistral: Mistral Nemo525ms TTFT · 29 TPS
Sao10K: Llama 3 8B Lunaris500ms TTFT · 57 TPS
Meta: Llama 3.2 3B Instruct322ms TTFT · 73 TPS
MythoMax 13B356ms TTFT · 53 TPS
Google: Gemma 3 27B528ms TTFT · 24 TPS
Mistral: Mistral Small 3.2 24B1176ms TTFT · 20 TPS
ByteDance: UI-TARS 7B 1528ms TTFT · 8 TPS
AllenAI: Olmo 3 7B Instruct187ms TTFT · 44 TPS
Qwen: Qwen3.5-9B617ms TTFT · 37 TPS
OpenAI: gpt-oss-120b408ms TTFT · 105 TPS
Qwen: Qwen3 Next 80B A3B Instruct967ms TTFT · 42 TPS
Qwen: Qwen3 Coder Next809ms TTFT · 52 TPS
AllenAI: Olmo 3 7B Think183ms TTFT · 78 TPS
Google: Gemma 4 26B A4B 748ms TTFT · 22 TPS
DeepSeek: DeepSeek V4 Flash 0423671ms TTFT · 59 TPS
DeepSeek: DeepSeek V4 Flash 0731844ms TTFT · 57 TPS
Xiaomi: MiMo-V2.5729ms TTFT · 47 TPS
Qwen: Qwen3 235B A22B Instruct 2507720ms TTFT · 23 TPS
Qwen: Qwen3.6 35B A3B919ms TTFT · 33 TPS
Inference Models
| Model | Input $/M | Output $/M | TTFT | TPS |
|---|---|---|---|---|
| OpenAI: gpt-oss-20b | $0.03 | $0.15 | 635ms | 73 |
| Mistral: Mistral Nemo | $0.03 | $0.03 | 525ms | 29 |
| Sao10K: Llama 3 8B Lunaris | $0.04 | $0.05 | 500ms | 57 |
| Meta: Llama 3.2 3B Instruct | $0.05 | $0.33 | 322ms | 73 |
| MythoMax 13B | $0.08 | $0.11 | 356ms | 53 |
| Google: Gemma 3 27B | $0.08 | $0.45 | 528ms | 24 |
| Mistral: Mistral Small 3.2 24B | $0.09 | $0.30 | 1176ms | 20 |
| ByteDance: UI-TARS 7B | $0.10 | $0.20 | 1528ms | 8 |
| AllenAI: Olmo 3 7B Instruct | $0.10 | $0.20 | 187ms | 44 |
| Qwen: Qwen3.5-9B | $0.10 | $0.25 | 617ms | 37 |
| OpenAI: gpt-oss-120b | $0.10 | $0.75 | 408ms | 105 |
| Qwen: Qwen3 Next 80B A3B Instruct | $0.10 | $1.10 | 967ms | 42 |
| Qwen: Qwen3 Coder Next | $0.12 | $0.80 | 809ms | 52 |
| AllenAI: Olmo 3 7B Think | $0.12 | $0.20 | 183ms | 78 |
| Google: Gemma 4 26B A4B | $0.13 | $0.40 | 748ms | 22 |
| DeepSeek: DeepSeek V4 Flash 0423 | $0.14 | $0.28 | 671ms | 59 |
| DeepSeek: DeepSeek V4 Flash 0731 | $0.14 | $0.28 | 844ms | 57 |
| Xiaomi: MiMo-V2.5 | $0.14 | $0.28 | 729ms | 47 |
| Qwen: Qwen3 235B A22B Instruct 2507 | $0.14 | $0.80 | 720ms | 23 |
| Qwen: Qwen3.6 35B A3B | $0.15 | $1.00 | 919ms | 33 |
| AllenAI: Olmo 3.1 32B Think | $0.15 | $0.50 | 244ms | 81 |
| Qwen: Qwen3.5-35B-A3B | $0.15 | $1.00 | 458ms | 142 |
| AllenAI: Olmo 3 32B Think | $0.15 | $0.50 | 263ms | 79 |
| Google: Gemma 4 31B | $0.15 | $0.40 | 762ms | 31 |
| AllenAI: Molmo2 8B | $0.20 | $0.20 | 283ms | 39 |
| Qwen: Qwen3 VL 235B A22B Instruct | $0.21 | $1.90 | 886ms | 18 |
| Meta: Llama 3.3 70B Instruct | $0.22 | $0.50 | 747ms | 19 |
| Arcee AI: Trinity Large Thinking | $0.22 | $0.85 | 198ms | 62 |
| TheDrummer: Rocinante 12B | $0.25 | $0.50 | 461ms | 56 |
| Qwen: Qwen3 VL 8B Instruct | $0.25 | $0.75 | 770ms | 28 |
| Meta: Muse Glimmer 30B | $0.30 | $1.10 | 1903ms | 40 |
| TheDrummer: Cydonia 24B V4.1 | $0.30 | $0.50 | 851ms | 34 |
| MiniMax: MiniMax M3 | $0.30 | $1.20 | 802ms | 89 |
| Meta: Llama 4 Maverick | $0.35 | $1.00 | 559ms | 54 |
| TheDrummer: UnslopNemo 12B | $0.40 | $0.40 | 892ms | 86 |
| Qwen: Qwen3.5 397B A17B | $0.50 | $3.60 | 420ms | 60 |
| TheDrummer: Skyfall 36B V2 | $0.55 | $0.80 | 429ms | 63 |
| MoonshotAI: Kimi K2.6 | $0.75 | $3.50 | 648ms | 42 |
| MoonshotAI: Kimi K2.7 Code | $0.76 | $3.50 | 1423ms | 49 |
| Qwen: Qwen2.5 VL 72B Instruct | $0.80 | $1.00 | 639ms | 23 |
| DeepSeek: DeepSeek V4 Pro 0813 | $1.32 | $3.96 | 1077ms | 44 |
| Z.ai: GLM 5.2 | $1.40 | $4.40 | 804ms | 116 |
| Z.ai: GLM 5.1 | $1.40 | $4.40 | 458ms | 137 |
| DeepSeek: DeepSeek V4 Pro 0423 | $1.74 | $3.48 | 961ms | 44 |
Community Reviews
4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15
Reliable service, great API documentation.
mlresearcher
★★★★☆2025-06-10
Good performance but support could be faster.