G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M konteks65.5K keluaranPenalaranAlatAlat paralelVisiAudio masukVideoFileCacheTerstrukturPencarian webKonteks URLPesan system
Dirilis Jul 22, 2025Batas pengetahuan Jan 2025Diperbarui Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Mode chatTokenizer GeminiDeprecation Oct 2026Kedaluwarsa Oct 2026
Harga
Harga input
$0.09/ 1 J tokenDiskon 7%
Harga output
$0.37/ 1 J tokenDiskon 7%
Endpoint kompatibel openaiVendor Google
Waktu aktif
Performa
Memuat data performa...
Penggunaan & Peringkat
Memuat penggunaan...
Parameter didukung
Semua penyedia = didukung oleh setiap upstream yang melayani model ini. Sebagian penyedia = tergantung upstream yang menangani permintaan. Bawaan = nilai yang dikirim saat Anda tidak mengaturnya.
| Parameter | Penyedia | Default |
|---|---|---|
| frequency_penalty | Sebagian penyedia | Tidak dikirim secara bawaan |
| include_reasoning | Semua penyedia | - |
| max_tokens | Semua penyedia | - |
| reasoning | Semua penyedia | - |
| response_format | Semua penyedia | - |
| seed | Semua penyedia | - |
| stop | Semua penyedia | - |
| structured_outputs | Semua penyedia | - |
| temperature | Semua penyedia | Tidak dikirim secara bawaan |
| tool_choice | Semua penyedia | - |
| tools | Semua penyedia | - |
| top_p | Semua penyedia | Tidak dikirim secara bawaan |