G

Google: gemini-2.5-flash-lite

gemini-2.5-flash-lite
1M konteks65.5K keluaranPenalaranAlatAlat paralelVisiAudio masukVideoFileCacheTerstrukturPencarian webKonteks URLPesan system
Dirilis Jul 22, 2025Batas pengetahuan Jan 2025Diperbarui Sep 22, 2026

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.

Mode chatTokenizer GeminiDeprecation Oct 2026Kedaluwarsa Oct 2026

Harga

Harga input
$0.09/ 1 J tokenDiskon 7%
Harga output
$0.37/ 1 J tokenDiskon 7%
Endpoint kompatibel openaiVendor Google

Waktu aktif

Performa

Memuat data performa...

Penggunaan & Peringkat

Memuat penggunaan...

Parameter didukung

Semua penyedia = didukung oleh setiap upstream yang melayani model ini. Sebagian penyedia = tergantung upstream yang menangani permintaan. Bawaan = nilai yang dikirim saat Anda tidak mengaturnya.

ParameterPenyediaDefault
frequency_penaltySebagian penyediaTidak dikirim secara bawaan
include_reasoningSemua penyedia-
max_tokensSemua penyedia-
reasoningSemua penyedia-
response_formatSemua penyedia-
seedSemua penyedia-
stopSemua penyedia-
structured_outputsSemua penyedia-
temperatureSemua penyediaTidak dikirim secara bawaan
tool_choiceSemua penyedia-
toolsSemua penyedia-
top_pSemua penyediaTidak dikirim secara bawaan

Pertanyaan yang sering diajukan

Model serupa