Models/Kimi K3 vs Qwen3.8 2.4T A95B

Kimi K3 vs Qwen3.8 2.4T A95B

API pricing, context, and independently measured performance, side by side. Qwen3.8 2.4T A95B starts 23% cheaper on input than Kimi K3 at list prices.

Kimi K3
Moonshot AI · released Jul 16, 2026
Best input$2.60 / MTok
Best output$13.00 / MTok
Context1.05M
Providers15
Fastest measured0.61s° TTFT · 84 tok/s
Open weightsVisionToolsReasoningStructured outputPrompt caching
Qwen3.8 2.4T A95B
Qwen · released Aug 12, 2026
Best input$2.00 / MTok
Best output$6.00 / MTok
Context1.05M
Providers6
Fastest measured1s° TTFT · 122 tok/s
Open weightsToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
MODELPROVIDERINPUTOUTPUTTTFTTPSSMOKE
Kimi K3SRSail Research$2.60$13.001.5s°144° tok/s2/5
Kimi K3MOMorph$2.80$14.001.7s°17° tok/s1/5
Kimi K3DeepInfra logoDeepInfra$2.85$14.252s°25° tok/s4/5
Qwen3.8 2.4T A95BDeepInfra logoDeepInfra$2.00$6.001.3s°76° tok/s4/5
Qwen3.8 2.4T A95BSiliconFlow logoSiliconFlow$2.00$6.002.7s°49° tok/s5/5
Qwen3.8 2.4T A95BMOModal$2.00$6.001s°122° tok/s4/5
TTFT/TPS: ModelIndex-measured medians (P50, trailing 72h) · chat10k profile (~10K in / 200 out) · ° = measured via OpenRouter routing (adds a hop) · SMOKE: of 5 programmatic capability probes passed · methodology v1.1 — full details on each model page
All 15 providers for Kimi K3All 6 providers for Qwen3.8 2.4T A95BOpen in comparator