I

InclusionAI: ling-3.0-flash-fin:free

ling-3.0-flash-fin:free
262.1K konteks32.8K keluaranPenalaranAlatCacheTerstruktur
Dirilis Jul 23, 2026Diperbarui Aug 31, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Mode chatTokenizer OtherKuantisasi bf16inclusionAI/Ling-3.0-flash

Harga

Harga input
$0.00/ 1 J token
Harga output
$0.00/ 1 J token
Jendela konteks 262.1K tokenEndpoint kompatibel openaiVendor InclusionAI

Waktu aktif

Performa

Memuat data performa...

Penggunaan & Peringkat

Memuat penggunaan...

Parameter didukung

Semua penyedia = didukung oleh setiap upstream yang melayani model ini. Sebagian penyedia = tergantung upstream yang menangani permintaan. Bawaan = nilai yang dikirim saat Anda tidak mengaturnya.

ParameterPenyediaDefault
frequency_penaltySemua penyedia-
include_reasoningSemua penyedia-
logit_biasSemua penyedia-
logprobsSemua penyedia-
max_tokensSemua penyedia-
min_pSemua penyedia-
presence_penaltySemua penyedia-
reasoningSemua penyedia-
repetition_penaltySemua penyedia-
response_formatSemua penyedia-
seedSemua penyedia-
stopSemua penyedia-
temperatureSemua penyedia-
tool_choiceSemua penyedia-
toolsSemua penyedia-
top_kSemua penyedia-
top_logprobsSemua penyedia-
top_pSemua penyedia-

Pertanyaan yang sering diajukan

Model serupa