I
InclusionAI: ling-3.0-flash-fin:free
ling-3.0-flash-fin:free
262.1K Kontext32.8K AusgabeReasoningToolsCacheStrukturiert
Veröffentlicht Jul 23, 2026Aktualisiert Aug 31, 2026
Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.
Preise
Input-Preis
$0.00/ 1 Mio. Tokens
Output-Preis
$0.00/ 1 Mio. Tokens
Kontextfenster 262.1K TokensKompatible Endpunkte openaiAnbieter InclusionAI
Verfügbarkeit
Leistung
Lade Leistungsdaten...
Nutzung & Rang
Nutzung wird geladen...
Unterstützte Parameter
Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.
| Parameter | Anbieter | Standard |
|---|---|---|
| frequency_penalty | Alle Anbieter | - |
| include_reasoning | Alle Anbieter | - |
| logit_bias | Alle Anbieter | - |
| logprobs | Alle Anbieter | - |
| max_tokens | Alle Anbieter | - |
| min_p | Alle Anbieter | - |
| presence_penalty | Alle Anbieter | - |
| reasoning | Alle Anbieter | - |
| repetition_penalty | Alle Anbieter | - |
| response_format | Alle Anbieter | - |
| seed | Alle Anbieter | - |
| stop | Alle Anbieter | - |
| temperature | Alle Anbieter | - |
| tool_choice | Alle Anbieter | - |
| tools | Alle Anbieter | - |
| top_k | Alle Anbieter | - |
| top_logprobs | Alle Anbieter | - |
| top_p | Alle Anbieter | - |