I

InclusionAI: ling-3.0-flash-fin:free

ling-3.0-flash-fin:free
262.1K contexto32.8K salidaRazonamientoHerramientasCachéEstructurado
Lanzado Jul 23, 2026Actualizado Aug 31, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Modo chatTokenizador OtherCuantización bf16inclusionAI/Ling-3.0-flash

Precios

Precio de entrada
$0.00/ 1 M tokens
Precio de salida
$0.00/ 1 M tokens
Ventana de contexto 262.1K tokensEndpoints compatibles openaiProveedor InclusionAI

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyTodos los proveedores-
include_reasoningTodos los proveedores-
logit_biasTodos los proveedores-
logprobsTodos los proveedores-
max_tokensTodos los proveedores-
min_pTodos los proveedores-
presence_penaltyTodos los proveedores-
reasoningTodos los proveedores-
repetition_penaltyTodos los proveedores-
response_formatTodos los proveedores-
seedTodos los proveedores-
stopTodos los proveedores-
temperatureTodos los proveedores-
tool_choiceTodos los proveedores-
toolsTodos los proveedores-
top_kTodos los proveedores-
top_logprobsTodos los proveedores-
top_pTodos los proveedores-

Preguntas frecuentes

Modelos similares