G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M Kontext65.5K AusgabeReasoningToolsParallele ToolsVisionAudio (Eingang)VideoDateienCacheStrukturiertWebsucheURL-KontextSystem-Msg
Veröffentlicht Jul 22, 2025Wissensstand Jan 2025Aktualisiert Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Modus chatTokenizer GeminiAbkündigung Oct 2026Ablauf Oct 2026
Preise
Input-Preis
$0.09/ 1 Mio. Tokens7% Rabatt
Output-Preis
$0.37/ 1 Mio. Tokens7% Rabatt
Kompatible Endpunkte openaiAnbieter Google
Verfügbarkeit
Leistung
Lade Leistungsdaten...
Nutzung & Rang
Nutzung wird geladen...
Unterstützte Parameter
Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.
| Parameter | Anbieter | Standard |
|---|---|---|
| frequency_penalty | Einige Anbieter | Standardmäßig nicht gesendet |
| include_reasoning | Alle Anbieter | - |
| max_tokens | Alle Anbieter | - |
| reasoning | Alle Anbieter | - |
| response_format | Alle Anbieter | - |
| seed | Alle Anbieter | - |
| stop | Alle Anbieter | - |
| structured_outputs | Alle Anbieter | - |
| temperature | Alle Anbieter | Standardmäßig nicht gesendet |
| tool_choice | Alle Anbieter | - |
| tools | Alle Anbieter | - |
| top_p | Alle Anbieter | Standardmäßig nicht gesendet |