I

InclusionAI: ling-3.0-flash-fin:free

ling-3.0-flash-fin:free
262.1K contexte32.8K sortieRaisonnementOutilsCacheStructuré
Publié Jul 23, 2026Mis à jour Aug 31, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Mode chatTokenizer OtherQuantification bf16inclusionAI/Ling-3.0-flash

Tarification

Prix en entrée
$0.00/ 1 M jetons
Prix en sortie
$0.00/ 1 M jetons
Fenêtre de contexte 262.1K jetonsPoints d'accès compatibles openaiÉditeur InclusionAI

Disponibilité

Performance

Chargement des performances...

Utilisation et classement

Chargement de l'utilisation...

Paramètres supportés

Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.

ParamètreFournisseursPar défaut
frequency_penaltyTous les fournisseurs-
include_reasoningTous les fournisseurs-
logit_biasTous les fournisseurs-
logprobsTous les fournisseurs-
max_tokensTous les fournisseurs-
min_pTous les fournisseurs-
presence_penaltyTous les fournisseurs-
reasoningTous les fournisseurs-
repetition_penaltyTous les fournisseurs-
response_formatTous les fournisseurs-
seedTous les fournisseurs-
stopTous les fournisseurs-
temperatureTous les fournisseurs-
tool_choiceTous les fournisseurs-
toolsTous les fournisseurs-
top_kTous les fournisseurs-
top_logprobsTous les fournisseurs-
top_pTous les fournisseurs-

Questions fréquentes

Modèles similaires