InclusionAI: ling-3.0-flash-vl:free
Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.
Alle Anbieter für dieses Modell sind gerade ausgelastet
Jeder Upstream-Anbieter hat sein Ratenlimit erreicht. Das Modell kommt automatisch zurück, sobald die Limits fallen, meist innerhalb von Stunden. Versuche es später erneut oder wechsle zu einem anderen Modell.
Dieses Modell auf Discord anfragenPreise
Verfügbarkeit
Leistung
Nutzung & Rang
Unterstützte Parameter
Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.
| Parameter | Anbieter | Standard |
|---|---|---|
| frequency_penalty | Alle Anbieter | - |
| include_reasoning | Alle Anbieter | - |
| logit_bias | Alle Anbieter | - |
| max_tokens | Alle Anbieter | - |
| min_p | Alle Anbieter | - |
| presence_penalty | Alle Anbieter | - |
| reasoning | Alle Anbieter | - |
| repetition_penalty | Alle Anbieter | - |
| response_format | Alle Anbieter | - |
| seed | Alle Anbieter | - |
| stop | Alle Anbieter | - |
| structured_outputs | Alle Anbieter | - |
| temperature | Alle Anbieter | - |
| tool_choice | Alle Anbieter | - |
| tools | Alle Anbieter | - |
| top_k | Alle Anbieter | - |
| top_p | Alle Anbieter | - |