LIVE
Models: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:08 PMModels: —+Providers: —+Cheapest H100: $2.49/hrUpdated: 01:08 PM
Marketplace
Providers Models
N

NextBit

AGGREGATEDINFERENCE
N/A
Uptime
N/A
Rating

30-Day Uptime

93.3%
2026-07-212026-08-19

Inference Latency

MythoMax 13B552ms TTFT · 52 TPS
NeverSleep: Lumimaid v0.2 8B366ms TTFT · 95 TPS
Qwen: Qwen3 14B743ms TTFT · 53 TPS
Google: Gemma 4 26B A4B 754ms TTFT · 41 TPS
DeepSeek: R1 Distill Qwen 32B753ms TTFT · 23 TPS
TheDrummer: UnslopNemo 12B2002ms TTFT · 76 TPS
ReMM SLERP 13B774ms TTFT · 21 TPS
Google: Gemma 2 27B756ms TTFT · 34 TPS
Sao10K: Llama 3.3 Euryale 70B3533ms TTFT · 7 TPS
Noromaid 20B773ms TTFT · 31 TPS

Inference Models

ModelInput $/MOutput $/MTTFTTPS
MythoMax 13B$0.06$0.06552ms52
NeverSleep: Lumimaid v0.2 8B$0.09$0.60366ms95
Qwen: Qwen3 14B$0.10$0.22743ms53
Google: Gemma 4 26B A4B $0.10$0.40754ms41
DeepSeek: R1 Distill Qwen 32B$0.29$0.29753ms23
TheDrummer: UnslopNemo 12B$0.40$0.402002ms76
ReMM SLERP 13B$0.45$0.65774ms21
Google: Gemma 2 27B$0.65$0.65756ms34
Sao10K: Llama 3.3 Euryale 70B$0.65$0.753533ms7
Noromaid 20B$1.00$1.75773ms31

Community Reviews

4.5★★★★★(2 reviews)
clouduser42
★★★★★2025-06-15

Reliable service, great API documentation.

mlresearcher
★★★★2025-06-10

Good performance but support could be faster.