N

NVIDIA: nemotron-3-super-120b-a12b-free:free

nemotron-3-super-120b-a12b-free:free
262.1K contexto16.4K salidaRazonamientoHerramientasEstructurado
Lanzado Mar 11, 2026Actualizado Sep 4, 2026

NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer Mixture-of-Experts architecture with multi-token prediction (MTP), it delivers over 50% higher token generation compared to leading open models. The model features a 1M token context window for long-term agent coherence, cross-document reasoning, and multi-step task planning. Latent MoE enables calling 4 experts for the inference cost of only one, improving intelligence and generalization. Multi-environment RL training across 10+ environments delivers leading accuracy on benchmarks including AIME 2025, TerminalBench, and SWE-Bench Verified. Fully open with weights, datasets, and recipes under the NVIDIA Open License, Nemotron 3 Super allows easy customization and secure deployment anywhere — from workstation to cloud.

Modo chatTokenizador OtherCuantización bf16nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8

Todos los proveedores de este modelo están ocupados ahora mismo

Cada proveedor ascendente alcanzó su límite de velocidad. El modelo vuelve automáticamente cuando los límites se levantan, normalmente en cuestión de horas. Inténtalo de nuevo en un rato o cambia a otro modelo.

Solicitar este modelo en Discord

Precios

Precio de entrada
$0.00/ 1 M tokens
Precio de salida
$0.00/ 1 M tokens
Ventana de contexto 262.1K tokensEndpoints compatibles -Proveedor NVIDIA

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyTodos los proveedoresNo se envía por defecto
include_reasoningTodos los proveedores-
logit_biasTodos los proveedores-
max_tokensTodos los proveedores-
min_pTodos los proveedores-
presence_penaltyTodos los proveedoresNo se envía por defecto
reasoningTodos los proveedores-
reasoning_effortTodos los proveedores-
repetition_penaltyTodos los proveedoresNo se envía por defecto
response_formatTodos los proveedores-
seedTodos los proveedores-
stopTodos los proveedores-
temperatureTodos los proveedores1
tool_choiceTodos los proveedores-
toolsTodos los proveedores-
top_kTodos los proveedoresNo se envía por defecto
top_pTodos los proveedores0.95

Preguntas frecuentes

Modelos similares