G

Google: gemini-2.5-flash-lite

gemini-2.5-flash-lite
1M contesto65.5K outputRagionamentoStrumentiStrumenti paralleliVisioneAudio inVideoFileCacheStrutturatoRicerca webContesto URLMsg sistema
Rilasciato Jul 22, 2025Limite delle conoscenze Jan 2025Aggiornato Sep 22, 2026

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.

Modalità chatTokenizer GeminiDeprecazione Oct 2026Scadenza Oct 2026

Prezzi

Prezzo di input
$0.09/ 1 M token7% di sconto
Prezzo di output
$0.37/ 1 M token7% di sconto
Endpoint compatibili openaiProvider Google

Disponibilità

Performance

Caricamento dati di performance...

Utilizzo e classifica

Caricamento utilizzo...

Parametri supportati

Tutti i provider = supportato da ogni upstream che serve questo modello. Alcuni provider = dipende dall'upstream che gestisce la richiesta. Predefinito = il valore inviato quando non lo imposti.

ParametroProviderPredefinito
frequency_penaltyAlcuni providerNon inviato per impostazione predefinita
include_reasoningTutti i provider-
max_tokensTutti i provider-
reasoningTutti i provider-
response_formatTutti i provider-
seedTutti i provider-
stopTutti i provider-
structured_outputsTutti i provider-
temperatureTutti i providerNon inviato per impostazione predefinita
tool_choiceTutti i provider-
toolsTutti i provider-
top_pTutti i providerNon inviato per impostazione predefinita

Domande frequenti

Modelli simili