Gemma 4 31B vs Kimi K2.7 Code
API pricing, context, and independently measured performance, side by side. Gemma 4 31B starts 86% cheaper on input than Kimi K2.7 Code at list prices.
Gemma 4 31B
Google · released Apr 2, 2026
Best input$0.09 / MTok
Best output$0.34 / MTok
Context262K
Providers16
Fastest measured0.31s° TTFT · 205 tok/s
Open weightsVisionToolsReasoningStructured outputPrompt caching
Kimi K2.7 Code
Moonshot AI · released Jun 12, 2026
Best input$0.66 / MTok
Best output$3.40 / MTok
Context262K
Providers15
Fastest measured0.39s° TTFT · 114 tok/s
Open weightsVisionToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
| MODEL | PROVIDER | INPUT | OUTPUT | TTFT | TPS | SMOKE |
|---|---|---|---|---|---|---|
| Gemma 4 31B | $0.09 | $0.34 | 0.84s° | 56° tok/s | 5/5 | |
| Gemma 4 31B | CWCoreWeave | $0.10 | $0.34 | 1.6s° | 38° tok/s | 5/5 |
| Gemma 4 31B | $0.12 | $0.36 | 1.5s° | 81° tok/s | 5/5 | |
| Kimi K2.7 Code | INInceptron | $0.66 | $3.40 | 1.1s° | 165° tok/s | 5/5 |
| Kimi K2.7 Code | $0.68 | $3.40 | 0.4s° | 58° tok/s | 5/5 | |
| Kimi K2.7 Code | AMAmbient | $0.69 | $3.49 | 0.76s° | 108° tok/s | 5/5 |
TTFT/TPS: ModelIndex-measured medians (P50, trailing 21d) · chat10k profile (~10K in / 200 out) · ° = measured via OpenRouter routing (adds a hop) · SMOKE: of 5 programmatic capability probes passed · methodology v1.1 — full details on each model page