Home/Models/Gemini 2.5 Flash-Lite
Verified against Google Cloud / AI Studio Pricing
GooglebudgetGenerally Available

Gemini 2.5 Flash-Lite Token Counter & Cost Calculator

Ultra-economical 1M context model for automated high-volume bulk pipelines

Standard Input / 1M
$0.10
Prompt tokens
Cached Input / 1M
$0.0250
Prompt caching rate
Output / 1M
$0.40
Generation completion
Context Window
1.05M
Max out: 8.2k

Interactive Cost & Token Simulator for Gemini 2.5 Flash-Lite

Live Calculation
Input Tokens2,500
Output Tokens800
Requests / Day5,000
Prompt Caching Ratio (50%)$0.025/M cached rate
Cost / Request$0.00048
Daily Spend (5,000 reqs)$2.3813
Monthly Run-Rate (30d)$71.4375

Standard Workload Cost Scenarios

ScenarioInput TokensOutput TokensUncached CostWith Prompt Caching
Short Chat Query1,000500$0.00030$0.00023
Document Summarization10,0002,000$0.00180$0.00105
Codebase & Context Analysis100,00020,000$0.0180$0.0105
Batch Corpus Processing1,000,000100,000$0.1400$0.0650
Technical Architecture & Pricing VerificationVerified: September 8, 2026
Model ArchitectureGemini 2.5 Flash-Lite
Provider OrganizationGoogle
Tokenizer EncodingGoogle Gemini SentencePiece (256k vocabulary)
API ConnectivityGoogle AI Studio & Vertex AI API. Optimized for high-frequency micro-queries.
Batch API 50% DiscountSupported (50% off input & output)
Tier 1 Rate Quota4,000 RPM · 4M TPM
Blended 3:1 Cost / 1M Tokens$0.18
Cheapest frontier API from a hyperscaler. $0.075/1M input.Google Cloud / AI Studio Pricing

Verified Pricing History

June 2026: $0.075/M input · $0.3/M output ($0.02/M cached)
Flash-Lite launched to compete with open-source serverless endpoints.

When to Choose Gemini 2.5 Flash-Lite

Ideal for production workloads demanding budget capabilities, deep context depth (1.05M tokens), and reliability from Google. Excellent when predictable tokenomics and prompt caching support are paramount.

When Another Model May Be Better

If your use-case requires sub-second streaming latency or ultra-high frequency classification at micro-cent pricing, consider lighter budget options such as Gemini Flash-Lite or Claude Haiku. For deep formal logic, consider dedicated reasoning models like o3.

Frequently Asked Questions About Gemini 2.5 Flash-Lite

How much does 1 million tokens cost with Gemini 2.5 Flash-Lite?

For Gemini 2.5 Flash-Lite, 1 million input tokens costs $0.10, while 1 million output tokens costs $0.40. If using prompt caching, repetitive input prefixes are discounted to $0.03 per million.

What is the context window for Gemini 2.5 Flash-Lite?

Gemini 2.5 Flash-Lite features a maximum context window of 1,048,576 tokens (~786,432 words), with a maximum output limit of 8,192 tokens per completion.

Which tokenizer does Gemini 2.5 Flash-Lite use?

Gemini 2.5 Flash-Lite utilizes the Google Gemini SentencePiece (256k vocabulary). Token counting on TokenMath runs client-side to ensure maximum privacy.

Does Gemini 2.5 Flash-Lite support prompt caching discounts?

Yes. Gemini 2.5 Flash-Lite supports prompt caching with a cached input rate of $0.03/1M (saving up to 75% on repeated input context).