LIVE
Models: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:10 PMModels: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:10 PM
Marketplace
Providers Models
G

Groq

AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating

30-Day Uptime

100%
2026-07-212026-08-19

Inference Latency

Meta: Llama 3.1 8B Instruct414ms TTFT · 70 TPS
OpenAI: gpt-oss-safeguard-20b297ms TTFT · 347 TPS
OpenAI: gpt-oss-20b760ms TTFT · 201 TPS
Meta: Llama 4 Scout522ms TTFT · 88 TPS
OpenAI: gpt-oss-120b (exacto)183ms TTFT · 439 TPS
OpenAI: gpt-oss-120b251ms TTFT · 338 TPS
Qwen: Qwen3 32B347ms TTFT · 235 TPS
Meta: Llama 3.3 70B Instruct263ms TTFT · 179 TPS
MiniMax: MiniMax M2.7253ms TTFT · 259 TPS
MoonshotAI: Kimi K2 0905 (exacto)114ms TTFT · 192 TPS

Inference Models

ModelInput $/MOutput $/MTTFTTPS
Meta: Llama 3.1 8B Instruct$0.05$0.08414ms70
OpenAI: gpt-oss-safeguard-20b$0.08$0.30297ms347
OpenAI: gpt-oss-20b$0.08$0.30760ms201
Meta: Llama 4 Scout$0.11$0.34522ms88
OpenAI: gpt-oss-120b (exacto)$0.15$0.60183ms439
OpenAI: gpt-oss-120b$0.15$0.60251ms338
Qwen: Qwen3 32B$0.29$0.59347ms235
Meta: Llama 3.3 70B Instruct$0.59$0.79263ms179
MiniMax: MiniMax M2.7$0.60$1.80253ms259
MoonshotAI: Kimi K2 0905 (exacto)$1.00$3.00114ms192

Community Reviews

4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15

Reliable service, great API documentation.

mlresearcher
★★★★2025-06-10

Good performance but support could be faster.