I

InclusionAI: ling-3.0-flash-fin:free

ling-3.0-flash-fin:free
262.1K contexto32.8K saídaRaciocínioFerramentasCacheEstruturado
Lançado Jul 23, 2026Atualizado Aug 31, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Modo chatTokenizador OtherQuantização bf16inclusionAI/Ling-3.0-flash

Preços

Preço de entrada
$0.00/ 1 M tokens
Preço de saída
$0.00/ 1 M tokens
Janela de contexto 262.1K tokensEndpoints compatíveis openaiFornecedor InclusionAI

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
frequency_penaltyTodos os provedores-
include_reasoningTodos os provedores-
logit_biasTodos os provedores-
logprobsTodos os provedores-
max_tokensTodos os provedores-
min_pTodos os provedores-
presence_penaltyTodos os provedores-
reasoningTodos os provedores-
repetition_penaltyTodos os provedores-
response_formatTodos os provedores-
seedTodos os provedores-
stopTodos os provedores-
temperatureTodos os provedores-
tool_choiceTodos os provedores-
toolsTodos os provedores-
top_kTodos os provedores-
top_logprobsTodos os provedores-
top_pTodos os provedores-

Perguntas frequentes

Modelos similares