Models/Qwen3.8 Max (0902) vs GLM 5.3 FlashX

Qwen3.8 Max (0902) vs GLM 5.3 FlashX

API pricing, context, and independently measured performance, side by side. GLM 5.3 FlashX starts 82% cheaper on input than Qwen3.8 Max (0902) at list prices.

Qwen3.8 Max (0902)
Qwen · released Sep 3, 2026
Best input$2.00 / MTok
Best output$6.00 / MTok
Context1M
Providers1
Fastest measured1.3s° TTFT · 40 tok/s
VisionToolsReasoningStructured outputPrompt caching
GLM 5.3 FlashX
Z.ai · released Sep 18, 2026
Best input$0.37 / MTok
Best output$1.25 / MTok
Context1.05M
Providers1
Fastest measured
VisionToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
MODELPROVIDERINPUTOUTPUTTTFTTPSSMOKE
Qwen3.8 Max (0902)Alibaba logoAlibaba$2.00$6.001.3s°40° tok/s
GLM 5.3 FlashXZ.AI logoZ.AI$0.37$1.25
TTFT/TPS: ModelIndex-measured medians (P50, trailing 21d) · chat10k profile (~10K in / 200 out) · ° = measured via OpenRouter routing (adds a hop) · SMOKE: of 5 programmatic capability probes passed · methodology v1.1 — full details on each model page
All 1 providers for Qwen3.8 Max (0902)All 1 providers for GLM 5.3 FlashXOpen in comparator