Models/Gemma 4 26B A4B vs Gemma 4 31B

Gemma 4 26B A4B vs Gemma 4 31B

API pricing, context, and independently measured performance, side by side. Gemma 4 26B A4B starts 53% cheaper on input than Gemma 4 31B at list prices.

Gemma 4 26B A4B
Google · released Apr 3, 2026
Best input$0.042 / MTok
Best output$0.22 / MTok
Context262K
Providers13
Fastest measured0.28s° TTFT · 87 tok/s
Open weightsVisionToolsReasoningStructured outputPrompt caching
Gemma 4 31B
Google · released Apr 2, 2026
Best input$0.09 / MTok
Best output$0.34 / MTok
Context262K
Providers15
Fastest measured1.4s° TTFT · 20 tok/s
Open weightsVisionToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
MODELPROVIDERINPUTOUTPUTTTFTTPSSMOKE
Gemma 4 26B A4B Darkbloom logoDarkbloom$0.042$0.22——5/5
Gemma 4 26B A4B Io Net logoIo Net$0.052$0.225———
Gemma 4 26B A4B DEDekaLLM$0.06$0.331.7s°78° tok/s—
Gemma 4 31BDeepInfra logoDeepInfra$0.09$0.34——5/5
Gemma 4 31BCoreWeave logoCoreWeave$0.10$0.343s°46° tok/s5/5
Gemma 4 31BVenice logoVenice$0.12$0.36——5/5
TTFT/TPS: ModelIndex-measured medians (P50, trailing 21d) · chat10k profile (~10K in / 200 out) · ° = measured via OpenRouter routing (adds a hop) · SMOKE: of 5 programmatic capability probes passed · methodology v1.1 — full details on each model page
All 13 providers for Gemma 4 26B A4B All 15 providers for Gemma 4 31BOpen in comparator