G

Google: gemini-2.5-flash-lite

gemini-2.5-flash-lite
1M kontekst65.5K wyjścieRozumowanieNarzędziaRównoległe narzędziaWizjaAudio weWideoPlikiCacheStrukturalneWyszukiwanie webKontekst URLWiad. systemowa
Wydano Jul 22, 2025Granica wiedzy Jan 2025Zaktualizowano Sep 22, 2026

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.

Tryb chatTokenizer GeminiWycofanie Oct 2026Wygaśnięcie Oct 2026

Cennik

Cena wejścia
$0.09/ 1 mln tokenów7% taniej
Cena wyjścia
$0.37/ 1 mln tokenów7% taniej
Kompatybilne endpointy openaiDostawca Google

Czas dostępności

Wydajność

Ładowanie danych wydajności...

Użycie i ranking

Ładowanie użycia...

Obsługiwane parametry

Wszyscy dostawcy = obsługiwany przez każdy upstream serwujący ten model. Niektórzy dostawcy = zależy od upstreamu obsługującego żądanie. Domyślnie = wartość wysyłana, gdy nic nie ustawisz.

ParametrDostawcyDomyślne
frequency_penaltyNiektórzy dostawcyDomyślnie niewysyłany
include_reasoningWszyscy dostawcy-
max_tokensWszyscy dostawcy-
reasoningWszyscy dostawcy-
response_formatWszyscy dostawcy-
seedWszyscy dostawcy-
stopWszyscy dostawcy-
structured_outputsWszyscy dostawcy-
temperatureWszyscy dostawcyDomyślnie niewysyłany
tool_choiceWszyscy dostawcy-
toolsWszyscy dostawcy-
top_pWszyscy dostawcyDomyślnie niewysyłany

Często zadawane pytania

Podobne modele