N

NVIDIA: nemotron-3-super-120b-a12b-free:free

nemotron-3-super-120b-a12b-free:free
262.1K Kontext16.4K AusgabeReasoningToolsStrukturiert
Veröffentlicht Mar 11, 2026Aktualisiert Sep 4, 2026

NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer Mixture-of-Experts architecture with multi-token prediction (MTP), it delivers over 50% higher token generation compared to leading open models. The model features a 1M token context window for long-term agent coherence, cross-document reasoning, and multi-step task planning. Latent MoE enables calling 4 experts for the inference cost of only one, improving intelligence and generalization. Multi-environment RL training across 10+ environments delivers leading accuracy on benchmarks including AIME 2025, TerminalBench, and SWE-Bench Verified. Fully open with weights, datasets, and recipes under the NVIDIA Open License, Nemotron 3 Super allows easy customization and secure deployment anywhere — from workstation to cloud.

Modus chatTokenizer OtherQuantisierung bf16nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8

Alle Anbieter für dieses Modell sind gerade ausgelastet

Jeder Upstream-Anbieter hat sein Ratenlimit erreicht. Das Modell kommt automatisch zurück, sobald die Limits fallen, meist innerhalb von Stunden. Versuche es später erneut oder wechsle zu einem anderen Modell.

Dieses Modell auf Discord anfragen

Preise

Input-Preis
$0.00/ 1 Mio. Tokens
Output-Preis
$0.00/ 1 Mio. Tokens
Kontextfenster 262.1K TokensKompatible Endpunkte -Anbieter NVIDIA

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle AnbieterStandardmäßig nicht gesendet
include_reasoningAlle Anbieter-
logit_biasAlle Anbieter-
max_tokensAlle Anbieter-
min_pAlle Anbieter-
presence_penaltyAlle AnbieterStandardmäßig nicht gesendet
reasoningAlle Anbieter-
reasoning_effortAlle Anbieter-
repetition_penaltyAlle AnbieterStandardmäßig nicht gesendet
response_formatAlle Anbieter-
seedAlle Anbieter-
stopAlle Anbieter-
temperatureAlle Anbieter1
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_kAlle AnbieterStandardmäßig nicht gesendet
top_pAlle Anbieter0.95

Häufige Fragen

Ähnliche Modelle