InclusionAI: ling-3.0-flash-vl:free
Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.
Tous les fournisseurs de ce modèle sont occupés en ce moment
Chaque fournisseur amont a atteint sa limite de débit. Le modèle revient automatiquement dès que les limites se lèvent, généralement en quelques heures. Réessayez dans un moment ou passez à un autre modèle.
Demander ce modèle sur DiscordTarification
Disponibilité
Performance
Utilisation et classement
Paramètres supportés
Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.
| Paramètre | Fournisseurs | Par défaut |
|---|---|---|
| frequency_penalty | Tous les fournisseurs | - |
| include_reasoning | Tous les fournisseurs | - |
| logit_bias | Tous les fournisseurs | - |
| max_tokens | Tous les fournisseurs | - |
| min_p | Tous les fournisseurs | - |
| presence_penalty | Tous les fournisseurs | - |
| reasoning | Tous les fournisseurs | - |
| repetition_penalty | Tous les fournisseurs | - |
| response_format | Tous les fournisseurs | - |
| seed | Tous les fournisseurs | - |
| stop | Tous les fournisseurs | - |
| structured_outputs | Tous les fournisseurs | - |
| temperature | Tous les fournisseurs | - |
| tool_choice | Tous les fournisseurs | - |
| tools | Tous les fournisseurs | - |
| top_k | Tous les fournisseurs | - |
| top_p | Tous les fournisseurs | - |