I

InclusionAI: ling-3.0-flash-fin:free

ling-3.0-flash-fin:free
262.1K kontekst32.8K wyjścieRozumowanieNarzędziaCacheStrukturalne
Wydano Jul 23, 2026Zaktualizowano Aug 31, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Tryb chatTokenizer OtherKwantyzacja bf16inclusionAI/Ling-3.0-flash

Cennik

Cena wejścia
$0.00/ 1 mln tokenów
Cena wyjścia
$0.00/ 1 mln tokenów
Okno kontekstu 262.1K tokenówKompatybilne endpointy openaiDostawca InclusionAI

Czas dostępności

Wydajność

Ładowanie danych wydajności...

Użycie i ranking

Ładowanie użycia...

Obsługiwane parametry

Wszyscy dostawcy = obsługiwany przez każdy upstream serwujący ten model. Niektórzy dostawcy = zależy od upstreamu obsługującego żądanie. Domyślnie = wartość wysyłana, gdy nic nie ustawisz.

ParametrDostawcyDomyślne
frequency_penaltyWszyscy dostawcy-
include_reasoningWszyscy dostawcy-
logit_biasWszyscy dostawcy-
logprobsWszyscy dostawcy-
max_tokensWszyscy dostawcy-
min_pWszyscy dostawcy-
presence_penaltyWszyscy dostawcy-
reasoningWszyscy dostawcy-
repetition_penaltyWszyscy dostawcy-
response_formatWszyscy dostawcy-
seedWszyscy dostawcy-
stopWszyscy dostawcy-
temperatureWszyscy dostawcy-
tool_choiceWszyscy dostawcy-
toolsWszyscy dostawcy-
top_kWszyscy dostawcy-
top_logprobsWszyscy dostawcy-
top_pWszyscy dostawcy-

Często zadawane pytania

Podobne modele