I

InclusionAI: ling-3.0-flash-vl:free

ling-3.0-flash-vl:free
262.1K Kontext32.8K AusgabeReasoningToolsVideoCacheStrukturiert
Veröffentlicht Sep 10, 2026Aktualisiert Sep 11, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Modus chatTokenizer OtherQuantisierung fp16inclusionAI/Ling-3.0-flash-VL

Alle Anbieter für dieses Modell sind gerade ausgelastet

Jeder Upstream-Anbieter hat sein Ratenlimit erreicht. Das Modell kommt automatisch zurück, sobald die Limits fallen, meist innerhalb von Stunden. Versuche es später erneut oder wechsle zu einem anderen Modell.

Dieses Modell auf Discord anfragen

Preise

Input-Preis
$0.00/ 1 Mio. Tokens
Output-Preis
$0.00/ 1 Mio. Tokens
Kontextfenster 262.1K TokensKompatible Endpunkte -Anbieter InclusionAI

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle Anbieter-
include_reasoningAlle Anbieter-
logit_biasAlle Anbieter-
max_tokensAlle Anbieter-
min_pAlle Anbieter-
presence_penaltyAlle Anbieter-
reasoningAlle Anbieter-
repetition_penaltyAlle Anbieter-
response_formatAlle Anbieter-
seedAlle Anbieter-
stopAlle Anbieter-
structured_outputsAlle Anbieter-
temperatureAlle Anbieter-
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_kAlle Anbieter-
top_pAlle Anbieter-

Häufige Fragen

Ähnliche Modelle