G

Google: gemini-2.5-flash-lite

gemini-2.5-flash-lite
1M contexto65.5K salidaRazonamientoHerramientasHerramientas paralelasVisiónAudio entradaVideoArchivosCachéEstructuradoBúsqueda webContexto URLMsg sistema
Lanzado Jul 22, 2025Corte de conocimiento Jan 2025Actualizado Sep 22, 2026

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.

Modo chatTokenizador GeminiObsolescencia Oct 2026Expiración Oct 2026

Precios

Precio de entrada
$0.09/ 1 M tokens7% desc.
Precio de salida
$0.37/ 1 M tokens7% desc.
Endpoints compatibles openaiProveedor Google

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyAlgunos proveedoresNo se envía por defecto
include_reasoningTodos los proveedores-
max_tokensTodos los proveedores-
reasoningTodos los proveedores-
response_formatTodos los proveedores-
seedTodos los proveedores-
stopTodos los proveedores-
structured_outputsTodos los proveedores-
temperatureTodos los proveedoresNo se envía por defecto
tool_choiceTodos los proveedores-
toolsTodos los proveedores-
top_pTodos los proveedoresNo se envía por defecto

Preguntas frecuentes

Modelos similares