Models/gpt-oss-120b vs GLM 5.3 Flash

gpt-oss-120b vs GLM 5.3 Flash

API pricing, context, and independently measured performance, side by side. gpt-oss-120b starts 60% cheaper on input than GLM 5.3 Flash at list prices.

gpt-oss-120b
OpenAI · released Aug 5, 2025
Best input$0.03 / MTok
Best output$0.17 / MTok
Context131K
Providers22
Fastest measured0.24s° TTFT · 293 tok/s
Open weightsToolsReasoningStructured outputPrompt caching
GLM 5.3 Flash
Z.ai · released Aug 26, 2026
Best input$0.075 / MTok
Best output$0.25 / MTok
Context1.31M
Providers23
Fastest measured0.97s° TTFT · 6 tok/s
Open weightsVisionToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
MODELPROVIDERINPUTOUTPUTTTFTTPSSMOKE
gpt-oss-120bAKAkashML$0.03$0.171.6s°68° tok/s4/5
gpt-oss-120bCWCoreWeave$0.03$0.170.76s°51° tok/s3/5
gpt-oss-120bDeepInfra logoDeepInfra$0.037$0.170.55s°53° tok/s4/5
GLM 5.3 FlashGMIGMICloud$0.075$0.25
GLM 5.3 FlashNovita logoNovita$0.075$0.251.6s°89° tok/s
GLM 5.3 FlashDeepInfra logoDeepInfra$0.075$0.25
TTFT/TPS: ModelIndex-measured medians (P50, trailing 21d) · chat10k profile (~10K in / 200 out) · ° = measured via OpenRouter routing (adds a hop) · SMOKE: of 5 programmatic capability probes passed · methodology v1.1 — full details on each model page
All 22 providers for gpt-oss-120bAll 23 providers for GLM 5.3 FlashOpen in comparator