G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M contesto65.5K outputRagionamentoStrumentiStrumenti paralleliVisioneAudio inVideoFileCacheStrutturatoRicerca webContesto URLMsg sistema
Rilasciato Jul 22, 2025Limite delle conoscenze Jan 2025Aggiornato Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Modalità chatTokenizer GeminiDeprecazione Oct 2026Scadenza Oct 2026
Prezzi
Prezzo di input
$0.09/ 1 M token7% di sconto
Prezzo di output
$0.37/ 1 M token7% di sconto
Endpoint compatibili openaiProvider Google
Disponibilità
Performance
Caricamento dati di performance...
Utilizzo e classifica
Caricamento utilizzo...
Parametri supportati
Tutti i provider = supportato da ogni upstream che serve questo modello. Alcuni provider = dipende dall'upstream che gestisce la richiesta. Predefinito = il valore inviato quando non lo imposti.
| Parametro | Provider | Predefinito |
|---|---|---|
| frequency_penalty | Alcuni provider | Non inviato per impostazione predefinita |
| include_reasoning | Tutti i provider | - |
| max_tokens | Tutti i provider | - |
| reasoning | Tutti i provider | - |
| response_format | Tutti i provider | - |
| seed | Tutti i provider | - |
| stop | Tutti i provider | - |
| structured_outputs | Tutti i provider | - |
| temperature | Tutti i provider | Non inviato per impostazione predefinita |
| tool_choice | Tutti i provider | - |
| tools | Tutti i provider | - |
| top_p | Tutti i provider | Non inviato per impostazione predefinita |