G
Google: gemini-2.5-flash-lite
gemini-2.5-flash-lite
1M contexte65.5K sortieRaisonnementOutilsOutils parallèlesVisionAudio (entrée)VidéoFichiersCacheStructuréRecherche webContexte URLMsg système
Publié Jul 22, 2025Limite des connaissances Jan 2025Mis à jour Sep 22, 2026
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.
Mode chatTokenizer GeminiDépréciation Oct 2026Expiration Oct 2026
Tarification
Prix en entrée
$0.09/ 1 M jetons7% de réduction
Prix en sortie
$0.37/ 1 M jetons7% de réduction
Points d'accès compatibles openaiÉditeur Google
Disponibilité
Performance
Chargement des performances...
Utilisation et classement
Chargement de l'utilisation...
Paramètres supportés
Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.
| Paramètre | Fournisseurs | Par défaut |
|---|---|---|
| frequency_penalty | Certains fournisseurs | Non envoyé par défaut |
| include_reasoning | Tous les fournisseurs | - |
| max_tokens | Tous les fournisseurs | - |
| reasoning | Tous les fournisseurs | - |
| response_format | Tous les fournisseurs | - |
| seed | Tous les fournisseurs | - |
| stop | Tous les fournisseurs | - |
| structured_outputs | Tous les fournisseurs | - |
| temperature | Tous les fournisseurs | Non envoyé par défaut |
| tool_choice | Tous les fournisseurs | - |
| tools | Tous les fournisseurs | - |
| top_p | Tous les fournisseurs | Non envoyé par défaut |