GPT-5.6 Sol vs Qwen3.8 2.4T A95B
API pricing, context, and independently measured performance, side by side. Qwen3.8 2.4T A95B starts 50% cheaper on input than GPT-5.6 Sol at list prices.
GPT-5.6 Sol
OpenAI · released Jul 9, 2026
Best input$4.00 / MTok
Best output$20.00 / MTok
Context1.05M
Providers7
Fastest measured3.2s° TTFT · 179 tok/s
VisionToolsReasoningStructured outputPrompt caching
Qwen3.8 2.4T A95B
Qwen · released Aug 12, 2026
Best input$2.00 / MTok
Best output$6.00 / MTok
Context1.05M
Providers6
Fastest measured1s° TTFT · 122 tok/s
Open weightsToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
| MODEL | PROVIDER | INPUT | OUTPUT | TTFT | TPS | SMOKE |
|---|---|---|---|---|---|---|
| GPT-5.6 Sol | $1.00 | $5.00 | 3.4s° | 100° tok/s | — | |
| GPT-5.6 Sol | $5.00 | $30.00 | 3.2s° | 179° tok/s | — | |
| GPT-5.6 Sol | $5.50 | $33.00 | — | — | — | |
| Qwen3.8 2.4T A95B | $2.00 | $6.00 | 1.3s° | 76° tok/s | 4/5 | |
| Qwen3.8 2.4T A95B | $2.00 | $6.00 | 2.7s° | 49° tok/s | 5/5 | |
| Qwen3.8 2.4T A95B | MOModal | $2.00 | $6.00 | 1s° | 122° tok/s | 4/5 |
TTFT/TPS: ModelIndex-measured medians (P50, trailing 72h) · chat10k profile (~10K in / 200 out) · ° = measured via OpenRouter routing (adds a hop) · SMOKE: of 5 programmatic capability probes passed · methodology v1.1 — full details on each model page