G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M contexto65.5K salidaRazonamientoHerramientasHerramientas paralelasVisiónAudio entradaVideoArchivosCachéEstructuradoBúsqueda webContexto URLMsg sistema
Lanzado Jul 22, 2025Corte de conocimiento Jan 2025Actualizado Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Modo chatTokenizador GeminiObsolescencia Oct 2026Expiración Oct 2026
Precios
Precio de entrada
$0.09/ 1 M tokens7% desc.
Precio de salida
$0.37/ 1 M tokens7% desc.
Endpoints compatibles openaiProveedor Google
Tiempo de actividad
Rendimiento
Cargando datos de rendimiento...
Uso y clasificación
Cargando uso...
Parámetros compatibles
Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.
| Parámetro | Proveedores | Predeterminado |
|---|---|---|
| frequency_penalty | Algunos proveedores | No se envía por defecto |
| include_reasoning | Todos los proveedores | - |
| max_tokens | Todos los proveedores | - |
| reasoning | Todos los proveedores | - |
| response_format | Todos los proveedores | - |
| seed | Todos los proveedores | - |
| stop | Todos los proveedores | - |
| structured_outputs | Todos los proveedores | - |
| temperature | Todos los proveedores | No se envía por defecto |
| tool_choice | Todos los proveedores | - |
| tools | Todos los proveedores | - |
| top_p | Todos los proveedores | No se envía por defecto |