Models/Google/Gemini 2.5 Flash Lite

Gemini 2.5 Flash Lite

Google · Proprietary · Released Jul 22, 2025 · google/gemini-2.5-flash-lite
Best $0.10 in / $0.40 out via Google
CompareEstimate cost
1.05M contextVisionToolsReasoningStructured outputPrompt cachingAudio input
Available from 5 providersUSD / MTOK · PRICES 25 MINUTES AGO · SPEED 18 DAYS AGO
EST. MONTHLY COSTclick a row for detail · click headers to sort
PROVIDERINPUTOUTPUTCACHECONTEXTQUANTTTFTTPSUPTIME
TTFT/TPS: median (P50) over trailing 504h · chat10k profile (~10K in / 200 out) · measured via OpenRouter routing · methodology v1.1 · measured 18 days ago
SERVE THIS MODEL AND NOT LISTED? LIST YOUR INFERENCE →
Pricing variants · USD / MTok in / out
STANDARD
$0.10 / $0.40
per MTok in / out
BATCH
$0.05 / $0.20
async batch
CACHE READ $0.01CACHE WRITE $0.083WEB SEARCH $0.014 / search
About

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Specifications
Context window1,048,576
Max output65,535
Modalities intext, image, file, audio, video
Modalities outtext
LicenseProprietary
ReleasedJul 22, 2025
Knowledge cutoff2025-01-31
TokenizerGemini
Deprecation2026-10-20
Embed badge
Gemini 2.5 Flash Lite price and speed badge
[![Gemini 2.5 Flash Lite](https://modelindex.ai/badge/google/gemini-2.5-flash-lite)](https://modelindex.ai/models/google/gemini-2.5-flash-lite)
Sources
OpenRouter API25 minutes ago
AGGREGATOR
LiteLLM dataset25 minutes ago
AGGREGATOR
ModelIndex benchmarks20 days ago
MEASURED
Verified 25 minutes ago · list prices, not negotiated rates.