G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M контекст65.5K выводРассуждениеИнструментыПараллельные инструментыЗрениеАудио (вход)ВидеоФайлыКэшСтруктурир.Веб-поискURL-контекстСист. сообщ.
Выпущено Jul 22, 2025Граница знаний Jan 2025Обновлено Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Режим chatТокенизатор GeminiУстаревание Oct 2026Истечение Oct 2026
Тарифы
Цена за вход
$0.09/ 1 млн токеновскидка 7%
Цена за выход
$0.37/ 1 млн токеновскидка 7%
Совместимые эндпоинты openaiВендор Google
Время работы
Производительность
Загрузка данных производительности...
Использование и рейтинг
Загрузка использования...
Поддерж. параметры
Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.
| Параметр | Провайдеры | По умолчанию |
|---|---|---|
| frequency_penalty | Некоторые провайдеры | По умолчанию не отправляется |
| include_reasoning | Все провайдеры | - |
| max_tokens | Все провайдеры | - |
| reasoning | Все провайдеры | - |
| response_format | Все провайдеры | - |
| seed | Все провайдеры | - |
| stop | Все провайдеры | - |
| structured_outputs | Все провайдеры | - |
| temperature | Все провайдеры | По умолчанию не отправляется |
| tool_choice | Все провайдеры | - |
| tools | Все провайдеры | - |
| top_p | Все провайдеры | По умолчанию не отправляется |