Providers/Wafer
Wafer logo

Wafer

Inference providerwafer.ai ↗
MODELS
9
ENDPOINTS
12
MIN INPUT
$0.024
MEDIAN BLENDED
$0.978
AVG UPTIME
99.7%
CHEAPEST FOR
2 models
Models on Wafer · prices & measurements for models served by Wafer’s APIUSD / MTOK · VERIFIED 23 MINUTES AGO
MODELINPUTOUTPUTCONTEXTQUANTTTFTTPSSMOKEVS BEST ELSEWHERE
Qwen logoQwen3.8 27BQwenBEST PRICE$0.024$4.35262K—✕✕—cheapest here
DeepSeek logoDeepSeek V4 Flash 0423DeepSeek$0.043$0.171.05M————$0.017 elsewhere
DeepSeek logoDeepSeek V4.1 FlashDeepSeek$0.045$1.201.05M—0.79s°94° tok/s—$0.018 elsewhere
Z.ai logoGLM 5.3Z.ai$0.049$3.391.05M—✕✕—$0.039 elsewhere
Z.ai logoGLM 5.2Z.ai$0.084$4.301.05M—✕✕—$0.03 elsewhere
Z.ai logoGLM 5.3 FlashZ.ai$0.10$0.501.05M—✕✕—$0.032 elsewhere
DeepSeek logoDeepSeek V4 Flash 0731DeepSeek$0.13$0.231.05M—0.74s°100° tok/s—$0.01 elsewhere
DeepSeek logoDeepSeek V4 Pro 0813DeepSeek$0.175$3.401.05M—✕✕—$0.158 elsewhere
Moonshot AI logoKimi K3Moonshot AIBEST PRICE$0.68$15.001.05M—0.87s°69° tok/s0/5cheapest here
TTFT/TPS: ModelIndex-measured medians (P50, trailing 21d) for Wafer’s endpoints · ° = measured via OpenRouter routing · ✕ = probed, no measurable stream · SMOKE: of 5 capability probes passed · methodology on each model page