G

Google: gemini-2.5-flash-lite

gemini-2.5-flash-lite
1M contexto65.5K saídaRaciocínioFerramentasFerramentas paralelasVisãoÁudio entradaVídeoArquivosCacheEstruturadoBusca webContexto URLMsg sistema
Lançado Jul 22, 2025Corte de conhecimento Jan 2025Atualizado Sep 22, 2026

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.

Modo chatTokenizador GeminiDescontinuação Oct 2026Expiração Oct 2026

Preços

Preço de entrada
$0.09/ 1 M tokens7% de desconto
Preço de saída
$0.37/ 1 M tokens7% de desconto
Endpoints compatíveis openaiFornecedor Google

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
frequency_penaltyAlguns provedoresNão enviado por padrão
include_reasoningTodos os provedores-
max_tokensTodos os provedores-
reasoningTodos os provedores-
response_formatTodos os provedores-
seedTodos os provedores-
stopTodos os provedores-
structured_outputsTodos os provedores-
temperatureTodos os provedoresNão enviado por padrão
tool_choiceTodos os provedores-
toolsTodos os provedores-
top_pTodos os provedoresNão enviado por padrão

Perguntas frequentes

Modelos similares