I

InclusionAI: ling-3.0-flash-vl:free

ling-3.0-flash-vl:free
262.1K contesto32.8K outputRagionamentoStrumentiVideoCacheStrutturato
Rilasciato Sep 10, 2026Aggiornato Sep 11, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Modalità chatTokenizer OtherQuantizzazione fp16inclusionAI/Ling-3.0-flash-VL

Tutti i provider di questo modello sono occupati al momento

Ogni provider a monte ha raggiunto il suo limite di velocità. Il modello torna automaticamente quando i limiti si allentano, di solito entro poche ore. Riprova tra poco o passa a un altro modello.

Richiedi questo modello su Discord

Prezzi

Prezzo di input
$0.00/ 1 M token
Prezzo di output
$0.00/ 1 M token
Finestra di contesto 262.1K tokenEndpoint compatibili -Provider InclusionAI

Disponibilità

Performance

Caricamento dati di performance...

Utilizzo e classifica

Caricamento utilizzo...

Parametri supportati

Tutti i provider = supportato da ogni upstream che serve questo modello. Alcuni provider = dipende dall'upstream che gestisce la richiesta. Predefinito = il valore inviato quando non lo imposti.

ParametroProviderPredefinito
frequency_penaltyTutti i provider-
include_reasoningTutti i provider-
logit_biasTutti i provider-
max_tokensTutti i provider-
min_pTutti i provider-
presence_penaltyTutti i provider-
reasoningTutti i provider-
repetition_penaltyTutti i provider-
response_formatTutti i provider-
seedTutti i provider-
stopTutti i provider-
structured_outputsTutti i provider-
temperatureTutti i provider-
tool_choiceTutti i provider-
toolsTutti i provider-
top_kTutti i provider-
top_pTutti i provider-

Domande frequenti

Modelli simili