I

InclusionAI: ling-3.0-flash-vl:free

ling-3.0-flash-vl:free
262.1K kontekst32.8K wyjścieRozumowanieNarzędziaWideoCacheStrukturalne
Wydano Sep 10, 2026Zaktualizowano Sep 11, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Tryb chatTokenizer OtherKwantyzacja fp16inclusionAI/Ling-3.0-flash-VL

Wszyscy dostawcy tego modelu są teraz zajęci

Każdy dostawca nadrzędny osiągnął swój limit szybkości. Model wraca automatycznie, gdy limity ustąpią, zwykle w ciągu kilku godzin. Spróbuj ponownie za chwilę albo przełącz się na inny model.

Poproś o ten model na Discordzie

Cennik

Cena wejścia
$0.00/ 1 mln tokenów
Cena wyjścia
$0.00/ 1 mln tokenów
Okno kontekstu 262.1K tokenówKompatybilne endpointy -Dostawca InclusionAI

Czas dostępności

Wydajność

Ładowanie danych wydajności...

Użycie i ranking

Ładowanie użycia...

Obsługiwane parametry

Wszyscy dostawcy = obsługiwany przez każdy upstream serwujący ten model. Niektórzy dostawcy = zależy od upstreamu obsługującego żądanie. Domyślnie = wartość wysyłana, gdy nic nie ustawisz.

ParametrDostawcyDomyślne
frequency_penaltyWszyscy dostawcy-
include_reasoningWszyscy dostawcy-
logit_biasWszyscy dostawcy-
max_tokensWszyscy dostawcy-
min_pWszyscy dostawcy-
presence_penaltyWszyscy dostawcy-
reasoningWszyscy dostawcy-
repetition_penaltyWszyscy dostawcy-
response_formatWszyscy dostawcy-
seedWszyscy dostawcy-
stopWszyscy dostawcy-
structured_outputsWszyscy dostawcy-
temperatureWszyscy dostawcy-
tool_choiceWszyscy dostawcy-
toolsWszyscy dostawcy-
top_kWszyscy dostawcy-
top_pWszyscy dostawcy-

Często zadawane pytania

Podobne modele