G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M contexto65.5K saídaRaciocínioFerramentasFerramentas paralelasVisãoÁudio entradaVídeoArquivosCacheEstruturadoBusca webContexto URLMsg sistema
Lançado Jul 22, 2025Corte de conhecimento Jan 2025Atualizado Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Modo chatTokenizador GeminiDescontinuação Oct 2026Expiração Oct 2026
Preços
Preço de entrada
$0.09/ 1 M tokens7% de desconto
Preço de saída
$0.37/ 1 M tokens7% de desconto
Endpoints compatíveis openaiFornecedor Google
Tempo de atividade
Desempenho
Carregando dados de desempenho...
Uso e classificação
Carregando uso...
Parâmetros suportados
Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.
| Parâmetro | Provedores | Padrão |
|---|---|---|
| frequency_penalty | Alguns provedores | Não enviado por padrão |
| include_reasoning | Todos os provedores | - |
| max_tokens | Todos os provedores | - |
| reasoning | Todos os provedores | - |
| response_format | Todos os provedores | - |
| seed | Todos os provedores | - |
| stop | Todos os provedores | - |
| structured_outputs | Todos os provedores | - |
| temperature | Todos os provedores | Não enviado por padrão |
| tool_choice | Todos os provedores | - |
| tools | Todos os provedores | - |
| top_p | Todos os provedores | Não enviado por padrão |