Models/Llama 3.3 70B Instruct vs Mistral Large 4

Llama 3.3 70B Instruct vs Mistral Large 4

API pricing, context, and independently measured performance, side by side. Llama 3.3 70B Instruct starts 85% cheaper on input than Mistral Large 4 at list prices.

Llama 3.3 70B Instruct
Meta · released Dec 6, 2024
Best input$0.10 / MTok
Best output$0.32 / MTok
Context131K
Providers11
Fastest measured0.61s° TTFT · 83 tok/s
Open weightsToolsStructured outputPrompt caching
Mistral Large 4
Mistral · released Oct 6, 2026
Best input$0.68 / MTok
Best output$2.09 / MTok
Context524K
Providers1
Fastest measured—
VisionToolsReasoningStructured outputPrompt caching
Cheapest providers, measuredUSD / MTOK
MODELPROVIDERINPUTOUTPUTTTFTTPSSMOKE
Llama 3.3 70B InstructDeepInfra logoDeepInfra$0.10$0.321.7s°39° tok/s5/5
Llama 3.3 70B InstructNovita logoNovita$0.135$0.40——5/5
Llama 3.3 70B InstructAkashML logoAkashML$0.20$0.522.9s°46° tok/s5/5
Mistral Large 4Mistral logoMistral$0.68$2.09———
TTFT/TPS: ModelIndex-measured medians (P50, trailing 21d) · chat10k profile (~10K in / 200 out) · ° = measured via OpenRouter routing (adds a hop) · SMOKE: of 5 programmatic capability probes passed · methodology v1.1 — full details on each model page
All 11 providers for Llama 3.3 70B InstructAll 1 providers for Mistral Large 4Open in comparator