G

Google: gemini-2.5-flash-lite

gemini-2.5-flash-lite
1M contexte65.5K sortieRaisonnementOutilsOutils parallèlesVisionAudio (entrée)VidéoFichiersCacheStructuréRecherche webContexte URLMsg système
Publié Jul 22, 2025Limite des connaissances Jan 2025Mis à jour Sep 22, 2026

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance across common benchmarks compared to earlier Flash models. By default, "thinking" (i.e. multi-pass reasoning) is disabled to prioritize speed, but developers can enable it via the Reasoning API parameter to selectively trade off cost for intelligence.

Mode chatTokenizer GeminiDépréciation Oct 2026Expiration Oct 2026

Tarification

Prix en entrée
$0.09/ 1 M jetons7% de réduction
Prix en sortie
$0.37/ 1 M jetons7% de réduction
Points d'accès compatibles openaiÉditeur Google

Disponibilité

Performance

Chargement des performances...

Utilisation et classement

Chargement de l'utilisation...

Paramètres supportés

Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.

ParamètreFournisseursPar défaut
frequency_penaltyCertains fournisseursNon envoyé par défaut
include_reasoningTous les fournisseurs-
max_tokensTous les fournisseurs-
reasoningTous les fournisseurs-
response_formatTous les fournisseurs-
seedTous les fournisseurs-
stopTous les fournisseurs-
structured_outputsTous les fournisseurs-
temperatureTous les fournisseursNon envoyé par défaut
tool_choiceTous les fournisseurs-
toolsTous les fournisseurs-
top_pTous les fournisseursNon envoyé par défaut

Questions fréquentes

Modèles similaires