Models/Google/Gemini 2.5 Flash Lite

Gemini 2.5 Flash Lite

Google · Proprietary · Released Jul 22, 2025 · google/gemini-2.5-flash-lite
CompareEstimate cost
1.05M contextVisionToolsReasoningStructured outputPrompt cachingAudio input
Available from 5 providersUSD / MTOK · VERIFIED 4 MINUTES AGO
EST. MONTHLY COSTclick a row for detail · click headers to sort
PROVIDERINPUTOUTPUTCACHECONTEXTQUANTTTFTTPSUPTIME
TTFT/TPS: median (P50) over trailing 72h · chat10k profile (~10K in / 200 out) · measured via OpenRouter routing · methodology v1.1 · measured 44 hours ago
Pricing variants · USD / MTok in / out
STANDARD
$0.05 / $0.20
per MTok in / out
BATCH
$0.05 / $0.20
async batch
CACHE READ $0.005CACHE WRITE $0.042WEB SEARCH $0.014 / search
About

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Specifications
Context window1,048,576
Max output65,535
Modalities intext, image, file, audio, video
Modalities outtext
LicenseProprietary
ReleasedJul 22, 2025
Knowledge cutoff2025-01-31
TokenizerGemini
Deprecation2026-10-20
Embed badge
Gemini 2.5 Flash Lite price and speed badge[![Gemini 2.5 Flash Lite](https://modelindex.ai/badge/google/gemini-2.5-flash-lite)](https://modelindex.ai/models/google/gemini-2.5-flash-lite)
Sources
OpenRouter API4 minutes ago
AGGREGATOR
LiteLLM dataset4 minutes ago
AGGREGATOR
ModelIndex benchmarks44 hours ago
MEASURED
Verified 4 minutes ago · list prices, not negotiated rates.