I

InclusionAI: ling-3.0-flash-vl:free

ling-3.0-flash-vl:free
262.1K bağlam32.8K çıktıAkıl yürütmeAraçlarVideoÖnbellekYapılandırılmış
Yayınlandı Sep 10, 2026Güncellendi Sep 11, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Mod chatTokenizer OtherKuantizasyon fp16inclusionAI/Ling-3.0-flash-VL

Bu modelin tüm sağlayıcıları şu anda meşgul

Her üst akış sağlayıcısı hız sınırına ulaştı. Sınırlar kalkınca model otomatik olarak geri gelir, genellikle birkaç saat içinde. Biraz sonra tekrar deneyin ya da başka bir modele geçin.

Bu modeli Discord'da iste

Fiyatlandırma

Girdi fiyatı
$0.00/ 1 M jeton
Çıktı fiyatı
$0.00/ 1 M jeton
Context penceresi 262.1K tokenUyumlu endpointler -Sağlayıcı InclusionAI

Çalışma süresi

Performans

Performans verileri yükleniyor...

Kullanım ve Sıralama

Kullanım yükleniyor...

Desteklenen parametreler

Tüm sağlayıcılar = bu modeli sunan her upstream destekler. Bazı sağlayıcılar = isteği işleyen upstream'e bağlıdır. Varsayılan = ayarlamadığınızda gönderilen değer.

ParametreSağlayıcılarVarsayılan
frequency_penaltyTüm sağlayıcılar-
include_reasoningTüm sağlayıcılar-
logit_biasTüm sağlayıcılar-
max_tokensTüm sağlayıcılar-
min_pTüm sağlayıcılar-
presence_penaltyTüm sağlayıcılar-
reasoningTüm sağlayıcılar-
repetition_penaltyTüm sağlayıcılar-
response_formatTüm sağlayıcılar-
seedTüm sağlayıcılar-
stopTüm sağlayıcılar-
structured_outputsTüm sağlayıcılar-
temperatureTüm sağlayıcılar-
tool_choiceTüm sağlayıcılar-
toolsTüm sağlayıcılar-
top_kTüm sağlayıcılar-
top_pTüm sağlayıcılar-

Sık sorulan sorular

Benzer modeller