G

Google: gemini-2.5-flash-lite

gemini-2.5-flash-lite
1M Kontext65.5K AusgabeReasoningToolsParallele ToolsVisionAudio (Eingang)VideoDateienCacheStrukturiertWebsucheURL-KontextSystem-Msg
Veröffentlicht Jul 22, 2025Wissensstand Jan 2025Aktualisiert Sep 22, 2026

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.

Modus chatTokenizer GeminiAbkündigung Oct 2026Ablauf Oct 2026

Preise

Input-Preis
$0.09/ 1 Mio. Tokens7% Rabatt
Output-Preis
$0.37/ 1 Mio. Tokens7% Rabatt
Kompatible Endpunkte openaiAnbieter Google

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyEinige AnbieterStandardmäßig nicht gesendet
include_reasoningAlle Anbieter-
max_tokensAlle Anbieter-
reasoningAlle Anbieter-
response_formatAlle Anbieter-
seedAlle Anbieter-
stopAlle Anbieter-
structured_outputsAlle Anbieter-
temperatureAlle AnbieterStandardmäßig nicht gesendet
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_pAlle AnbieterStandardmäßig nicht gesendet

Häufige Fragen

Ähnliche Modelle