InclusionAI: ling-3.0-flash-vl:free
Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.
Todos os provedores deste modelo estão ocupados agora
Cada provedor upstream atingiu seu limite de taxa. O modelo volta automaticamente quando os limites caem, geralmente em questão de horas. Tente novamente daqui a pouco ou mude para outro modelo.
Solicitar este modelo no DiscordPreços
Tempo de atividade
Desempenho
Uso e classificação
Parâmetros suportados
Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.
| Parâmetro | Provedores | Padrão |
|---|---|---|
| frequency_penalty | Todos os provedores | - |
| include_reasoning | Todos os provedores | - |
| logit_bias | Todos os provedores | - |
| max_tokens | Todos os provedores | - |
| min_p | Todos os provedores | - |
| presence_penalty | Todos os provedores | - |
| reasoning | Todos os provedores | - |
| repetition_penalty | Todos os provedores | - |
| response_format | Todos os provedores | - |
| seed | Todos os provedores | - |
| stop | Todos os provedores | - |
| structured_outputs | Todos os provedores | - |
| temperature | Todos os provedores | - |
| tool_choice | Todos os provedores | - |
| tools | Todos os provedores | - |
| top_k | Todos os provedores | - |
| top_p | Todos os provedores | - |