N

NVIDIA: nemotron-3-super-120b-a12b-free:free

nemotron-3-super-120b-a12b-free:free
262.1K konteks16.4K keluaranPenalaranAlatTerstruktur
Dirilis Mar 11, 2026Diperbarui Sep 4, 2026

NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer Mixture-of-Experts architecture with multi-token prediction (MTP), it delivers over 50% higher token generation compared to leading open models. The model features a 1M token context window for long-term agent coherence, cross-document reasoning, and multi-step task planning. Latent MoE enables calling 4 experts for the inference cost of only one, improving intelligence and generalization. Multi-environment RL training across 10+ environments delivers leading accuracy on benchmarks including AIME 2025, TerminalBench, and SWE-Bench Verified. Fully open with weights, datasets, and recipes under the NVIDIA Open License, Nemotron 3 Super allows easy customization and secure deployment anywhere — from workstation to cloud.

Mode chatTokenizer OtherKuantisasi bf16nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8

Semua penyedia model ini sedang sibuk saat ini

Setiap penyedia upstream telah mencapai batas lajunya. Model kembali otomatis begitu batasnya longgar, biasanya dalam hitungan jam. Coba lagi sebentar lagi atau beralih ke model lain.

Minta model ini di Discord

Harga

Harga input
$0.00/ 1 J token
Harga output
$0.00/ 1 J token
Jendela konteks 262.1K tokenEndpoint kompatibel -Vendor NVIDIA

Waktu aktif

Performa

Memuat data performa...

Penggunaan & Peringkat

Memuat penggunaan...

Parameter didukung

Semua penyedia = didukung oleh setiap upstream yang melayani model ini. Sebagian penyedia = tergantung upstream yang menangani permintaan. Bawaan = nilai yang dikirim saat Anda tidak mengaturnya.

ParameterPenyediaDefault
frequency_penaltySemua penyediaTidak dikirim secara bawaan
include_reasoningSemua penyedia-
logit_biasSemua penyedia-
max_tokensSemua penyedia-
min_pSemua penyedia-
presence_penaltySemua penyediaTidak dikirim secara bawaan
reasoningSemua penyedia-
reasoning_effortSemua penyedia-
repetition_penaltySemua penyediaTidak dikirim secara bawaan
response_formatSemua penyedia-
seedSemua penyedia-
stopSemua penyedia-
temperatureSemua penyedia1
tool_choiceSemua penyedia-
toolsSemua penyedia-
top_kSemua penyediaTidak dikirim secara bawaan
top_pSemua penyedia0.95

Pertanyaan yang sering diajukan

Model serupa