Models/Llama 3.3 70B Instruct vs gpt-oss-20b

Llama 3.3 70B Instruct vs gpt-oss-20b

API pricing, context, and independently measured performance, side by side. gpt-oss-20b starts 80% cheaper on input than Llama 3.3 70B Instruct at list prices.

Llama 3.3 70B Instruct
Meta · released Dec 6, 2024
Best input$0.10 / MTok
Best output$0.32 / MTok
Context131K
Providers13
Fastest measured
Open weightsToolsStructured outputPrompt caching
gpt-oss-20b
OpenAI · released Aug 5, 2025
Best input$0.02 / MTok
Best output$0.10 / MTok
Context131K
Providers13
Fastest measured1s° TTFT · 54 tok/s
Open weightsToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
MODELPROVIDERINPUTOUTPUTTTFTTPSSMOKE
Llama 3.3 70B InstructDeepInfra logoDeepInfra$0.10$0.325/5
Llama 3.3 70B InstructNebius logoNebius$0.13$0.405/5
Llama 3.3 70B InstructNovita logoNovita$0.135$0.405/5
gpt-oss-20bDADarkbloom$0.02$0.10
gpt-oss-20bCWCoreWeave$0.03$0.135/5
gpt-oss-20bDeepInfra logoDeepInfra$0.03$0.142/5
All 13 providers for Llama 3.3 70B InstructAll 13 providers for gpt-oss-20bOpen in comparator