G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M kontekst65.5K wyjścieRozumowanieNarzędziaRównoległe narzędziaWizjaAudio weWideoPlikiCacheStrukturalneWyszukiwanie webKontekst URLWiad. systemowa
Wydano Jul 22, 2025Granica wiedzy Jan 2025Zaktualizowano Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Tryb chatTokenizer GeminiWycofanie Oct 2026Wygaśnięcie Oct 2026
Cennik
Cena wejścia
$0.09/ 1 mln tokenów7% taniej
Cena wyjścia
$0.37/ 1 mln tokenów7% taniej
Kompatybilne endpointy openaiDostawca Google
Czas dostępności
Wydajność
Ładowanie danych wydajności...
Użycie i ranking
Ładowanie użycia...
Obsługiwane parametry
Wszyscy dostawcy = obsługiwany przez każdy upstream serwujący ten model. Niektórzy dostawcy = zależy od upstreamu obsługującego żądanie. Domyślnie = wartość wysyłana, gdy nic nie ustawisz.
| Parametr | Dostawcy | Domyślne |
|---|---|---|
| frequency_penalty | Niektórzy dostawcy | Domyślnie niewysyłany |
| include_reasoning | Wszyscy dostawcy | - |
| max_tokens | Wszyscy dostawcy | - |
| reasoning | Wszyscy dostawcy | - |
| response_format | Wszyscy dostawcy | - |
| seed | Wszyscy dostawcy | - |
| stop | Wszyscy dostawcy | - |
| structured_outputs | Wszyscy dostawcy | - |
| temperature | Wszyscy dostawcy | Domyślnie niewysyłany |
| tool_choice | Wszyscy dostawcy | - |
| tools | Wszyscy dostawcy | - |
| top_p | Wszyscy dostawcy | Domyślnie niewysyłany |