Gemma 4 31B vs GLM 5.1
API pricing, context, and independently measured performance, side by side. Gemma 4 31B starts 91% cheaper on input than GLM 5.1 at list prices.
Gemma 4 31B
Google · released Apr 2, 2026
Best input$0.08 / MTok
Best output$0.34 / MTok
Context262K
Providers18
Fastest measured0.31s° TTFT · 205 tok/s
Open weightsVisionToolsReasoningStructured outputPrompt caching
GLM 5.1
Z.ai · released Apr 7, 2026
Best input$0.91 / MTok
Best output$2.86 / MTok
Context205K
Providers17
Fastest measured0.66s° TTFT · 190 tok/s
Open weightsToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
| MODEL | PROVIDER | INPUT | OUTPUT | TTFT | TPS | SMOKE |
|---|---|---|---|---|---|---|
| Gemma 4 31B | OPOpenInference | $0.08 | $0.35 | 2.3s° | 21° tok/s | 3/5 |
| Gemma 4 31B | $0.09 | $0.34 | 0.84s° | 56° tok/s | 5/5 | |
| Gemma 4 31B | CWCoreWeave | $0.10 | $0.34 | 1.6s° | 38° tok/s | 5/5 |
| GLM 5.1 | GMIGMICloud | $0.91 | $2.86 | 1.1s° | 87° tok/s | 3/5 |
| GLM 5.1 | STStreamLake | $0.966 | $3.04 | 1.1s° | 48° tok/s | 2/5 |
| GLM 5.1 | CHChutes | $0.98 | $3.08 | 1.9s° | 79° tok/s | 3/5 |
TTFT/TPS: ModelIndex-measured medians (P50, trailing 72h) · chat10k profile (~10K in / 200 out) · ° = measured via OpenRouter routing (adds a hop) · SMOKE: of 5 programmatic capability probes passed · methodology v1.1 — full details on each model page