G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M ngữ cảnh65.5K đầu raSuy luậnCông cụCông cụ song songThị giácÂm thanh vàoVideoTệpBộ nhớ đệmCó cấu trúcTìm kiếm webURL contextTin nhắn HT
Phát hành Jul 22, 2025Giới hạn kiến thức Jan 2025Đã cập nhật Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Chế độ chatTokenizer GeminiNgừng hỗ trợ Oct 2026Hết hạn Oct 2026
Giá cả
Giá đầu vào
$0.09/ 1 triệu tokengiảm 7%
Giá đầu ra
$0.37/ 1 triệu tokengiảm 7%
Endpoint tương thích openaiNhà cung cấp Google
Thời gian hoạt động
Hiệu năng
Đang tải dữ liệu hiệu năng...
Sử dụng & Xếp hạng
Đang tải mức sử dụng...
Tham số hỗ trợ
Tất cả nhà cung cấp = mọi upstream phục vụ mô hình này đều hỗ trợ. Một số nhà cung cấp = tùy thuộc upstream xử lý yêu cầu. Mặc định = giá trị được gửi khi bạn không thiết lập.
| Tham số | Nhà cung cấp | Mặc định |
|---|---|---|
| frequency_penalty | Một số nhà cung cấp | Mặc định không gửi |
| include_reasoning | Tất cả nhà cung cấp | - |
| max_tokens | Tất cả nhà cung cấp | - |
| reasoning | Tất cả nhà cung cấp | - |
| response_format | Tất cả nhà cung cấp | - |
| seed | Tất cả nhà cung cấp | - |
| stop | Tất cả nhà cung cấp | - |
| structured_outputs | Tất cả nhà cung cấp | - |
| temperature | Tất cả nhà cung cấp | Mặc định không gửi |
| tool_choice | Tất cả nhà cung cấp | - |
| tools | Tất cả nhà cung cấp | - |
| top_p | Tất cả nhà cung cấp | Mặc định không gửi |