I

InclusionAI: ling-3.0-flash-fin:free

ling-3.0-flash-fin:free
262.1K bağlam32.8K çıktıAkıl yürütmeAraçlarÖnbellekYapılandırılmış
Yayınlandı Jul 23, 2026Güncellendi Aug 31, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Mod chatTokenizer OtherKuantizasyon bf16inclusionAI/Ling-3.0-flash

Fiyatlandırma

Girdi fiyatı
$0.00/ 1 M jeton
Çıktı fiyatı
$0.00/ 1 M jeton
Context penceresi 262.1K tokenUyumlu endpointler openaiSağlayıcı InclusionAI

Çalışma süresi

Performans

Performans verileri yükleniyor...

Kullanım ve Sıralama

Kullanım yükleniyor...

Desteklenen parametreler

Tüm sağlayıcılar = bu modeli sunan her upstream destekler. Bazı sağlayıcılar = isteği işleyen upstream'e bağlıdır. Varsayılan = ayarlamadığınızda gönderilen değer.

ParametreSağlayıcılarVarsayılan
frequency_penaltyTüm sağlayıcılar-
include_reasoningTüm sağlayıcılar-
logit_biasTüm sağlayıcılar-
logprobsTüm sağlayıcılar-
max_tokensTüm sağlayıcılar-
min_pTüm sağlayıcılar-
presence_penaltyTüm sağlayıcılar-
reasoningTüm sağlayıcılar-
repetition_penaltyTüm sağlayıcılar-
response_formatTüm sağlayıcılar-
seedTüm sağlayıcılar-
stopTüm sağlayıcılar-
temperatureTüm sağlayıcılar-
tool_choiceTüm sağlayıcılar-
toolsTüm sağlayıcılar-
top_kTüm sağlayıcılar-
top_logprobsTüm sağlayıcılar-
top_pTüm sağlayıcılar-

Sık sorulan sorular

Benzer modeller