Providers/Venice
Venice logo

Venice

Inference providervenice.ai
MODELS
31
ENDPOINTS
31
MIN INPUT
$0.06
MEDIAN BLENDED
$0.637
AVG UPTIME
98.0%
CHEAPEST FOR
5 models
Models on Venice · prices & measurements for models served by Venice’s APIUSD / MTOK · VERIFIED 4 MINUTES AGO
MODELINPUTOUTPUTCONTEXTQUANTTTFTTPSSMOKEVS BEST ELSEWHERE
Z.ai logoGLM 4.7 FlashZ.aiBEST PRICE$0.06$0.40128Kfp80.99s°39° tok/scheapest here
Qwen logoQwen3.6 35B A3BQwen$0.10$1.00256Kfp80.89s°242° tok/s1/5$0.07 elsewhere
Qwen logoQwen3.5-9BQwenBEST PRICE$0.10$0.15256Kfp81.4s°149° tok/scheapest here
Google logoGemma 4 31BGoogle$0.12$0.36256Kbf161.5s°81° tok/s5/5$0.08 elsewhere
Google logoGemma 4 26B A4B Google$0.13$0.40256Kbf161.4s°47° tok/s$0.042 elsewhere
DeepSeek logoDeepSeek V4 Flash 0423DeepSeek$0.138$0.2751M2.2s°120° tok/s$0.056 elsewhere
Qwen logoQwen3 235B A22B Instruct 2507Qwen$0.15$0.75128Kfp80.84s°30° tok/s5/5$0.087 elsewhere
DeepSeek logoDeepSeek V4 Flash 0731DeepSeek$0.175$0.351M1.1s°76° tok/s$0.04 elsewhere
Mistral logoMistral Small 4Mistral$0.188$0.75256Kfp81s°61° tok/s$0.15 elsewhere
CCUncensoredCognitive Computations$0.20$0.90128Kfp161.4s°100° tok/sonly provider
Qwen logoQwen3 VL 235B A22B InstructQwen$0.21$1.90128Kfp81.1s°20° tok/s$0.20 elsewhere
MiniMax logoMiniMax M2.5MiniMaxBEST PRICE$0.27$0.95198K1.3s°59° tok/s2/5cheapest here
MiniMax logoMiniMax M3MiniMax$0.30$1.20524Kfp80.82s°173° tok/s$0.23 elsewhere
Qwen logoQwen3.5-35B-A3BQwen$0.313$1.25256K1.2s°204° tok/s$0.14 elsewhere
Qwen logoQwen3.6 27BQwen$0.325$3.25256Kfp80.68s°30° tok/s2/5$0.30 elsewhere
DeepSeek logoDeepSeek V3.2DeepSeek$0.33$0.48160K2.3s°6° tok/s$0.209 elsewhere
Qwen logoQwen3 Coder 480B A35BQwen$0.35$1.50256Kfp80.65s°147° tok/s$0.22 elsewhere
Z.ai logoGLM 4.6Z.aiBEST PRICE$0.43$1.75198Kfp41.2s°12° tok/s3/5cheapest here
Qwen logoQwen3.8 27BQwen$0.45$3.20262Kfp81.7s°93° tok/s4/5$0.35 elsewhere
Qwen logoQwen3 235B A22B Thinking 2507Qwen$0.45$3.50128Kfp81.4s°40° tok/s$0.23 elsewhere
Moonshot AI logoKimi K2.5Moonshot AI$0.532$3.33256K2.3s°446° tok/s3/5$0.45 elsewhere
Z.ai logoGLM 4.7Z.ai$0.55$2.65198Kfp42.4s°27° tok/s3/5$0.40 elsewhere
NVIDIA logoNemotron 3 UltraNVIDIA$0.625$3.13256Kfp83.6s°$0.50 elsewhere
Moonshot AI logoKimi K2.7 CodeMoonshot AI$0.75$3.50256Kint40.89s°62° tok/s5/5$0.67 elsewhere
Moonshot AI logoKimi K2.6Moonshot AI$0.75$3.50256Kint41.4s°27° tok/s$0.58 elsewhere
Qwen logoQwen3.5 397B A17BQwen$0.75$4.50128K1.1s°108° tok/s$0.39 elsewhere
Z.ai logoGLM 5Z.ai$1.00$3.20198Kfp81.2s°122° tok/s$0.60 elsewhere
Z.ai logoGLM 5.2Z.ai$1.40$4.401Mfp81.5s°77° tok/s$0.50 elsewhere
Z.ai logoGLM 5.1Z.ai$1.54$4.84200Kfp81s°21° tok/s$0.91 elsewhere
DeepSeek logoDeepSeek V4 Pro 0423DeepSeek$1.65$3.301M2s°55° tok/s$0.522 elsewhere
Qwen logoQwen3.8 2.4T A95BQwen$2.50$7.50262K1.5s°168° tok/s3/5$2.00 elsewhere
TTFT/TPS: ModelIndex-measured medians (P50, trailing 72h) for Venice’s endpoints · ° = measured via OpenRouter routing · ✕ = probed, no measurable stream · SMOKE: of 5 capability probes passed · methodology on each model page