I

InclusionAI: ling-3.0-flash-fin:free

ling-3.0-flash-fin:free
262.1K Kontext32.8K AusgabeReasoningToolsCacheStrukturiert
Veröffentlicht Jul 23, 2026Aktualisiert Aug 31, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Modus chatTokenizer OtherQuantisierung bf16inclusionAI/Ling-3.0-flash

Preise

Input-Preis
$0.00/ 1 Mio. Tokens
Output-Preis
$0.00/ 1 Mio. Tokens
Kontextfenster 262.1K TokensKompatible Endpunkte openaiAnbieter InclusionAI

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle Anbieter-
include_reasoningAlle Anbieter-
logit_biasAlle Anbieter-
logprobsAlle Anbieter-
max_tokensAlle Anbieter-
min_pAlle Anbieter-
presence_penaltyAlle Anbieter-
reasoningAlle Anbieter-
repetition_penaltyAlle Anbieter-
response_formatAlle Anbieter-
seedAlle Anbieter-
stopAlle Anbieter-
temperatureAlle Anbieter-
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_kAlle Anbieter-
top_logprobsAlle Anbieter-
top_pAlle Anbieter-

Häufige Fragen

Ähnliche Modelle