I

InclusionAI: ling-3.0-flash-vl:free

ling-3.0-flash-vl:free
262.1K konteks32.8K keluaranPenalaranAlatVideoCacheTerstruktur
Dirilis Sep 10, 2026Diperbarui Sep 11, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Mode chatTokenizer OtherKuantisasi fp16inclusionAI/Ling-3.0-flash-VL

Semua penyedia model ini sedang sibuk saat ini

Setiap penyedia upstream telah mencapai batas lajunya. Model kembali otomatis begitu batasnya longgar, biasanya dalam hitungan jam. Coba lagi sebentar lagi atau beralih ke model lain.

Minta model ini di Discord

Harga

Harga input
$0.00/ 1 J token
Harga output
$0.00/ 1 J token
Jendela konteks 262.1K tokenEndpoint kompatibel -Vendor InclusionAI

Waktu aktif

Performa

Memuat data performa...

Penggunaan & Peringkat

Memuat penggunaan...

Parameter didukung

Semua penyedia = didukung oleh setiap upstream yang melayani model ini. Sebagian penyedia = tergantung upstream yang menangani permintaan. Bawaan = nilai yang dikirim saat Anda tidak mengaturnya.

ParameterPenyediaDefault
frequency_penaltySemua penyedia-
include_reasoningSemua penyedia-
logit_biasSemua penyedia-
max_tokensSemua penyedia-
min_pSemua penyedia-
presence_penaltySemua penyedia-
reasoningSemua penyedia-
repetition_penaltySemua penyedia-
response_formatSemua penyedia-
seedSemua penyedia-
stopSemua penyedia-
structured_outputsSemua penyedia-
temperatureSemua penyedia-
tool_choiceSemua penyedia-
toolsSemua penyedia-
top_kSemua penyedia-
top_pSemua penyedia-

Pertanyaan yang sering diajukan

Model serupa