N

NVIDIA: nemotron-3-ultra-550b-a55b:free

nemotron-3-ultra-550b-a55b:free
262.1K contexto32.8K saídaRaciocínioFerramentasCacheEstruturado
Lançado Jun 4, 2026Atualizado Jun 18, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Preços

Preço de entrada
$0.00/ 1 M tokens
Preço de saída
$0.00/ 1 M tokens
Janela de contexto 512.3K tokensEndpoints compatíveis openaiFornecedor NVIDIA

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
frequency_penaltyTodos os provedoresNão enviado por padrão
include_reasoningTodos os provedores-
logit_biasTodos os provedores-
max_tokensTodos os provedores-
min_pTodos os provedores-
presence_penaltyTodos os provedoresNão enviado por padrão
reasoningTodos os provedores-
reasoning_effortTodos os provedores-
repetition_penaltyTodos os provedoresNão enviado por padrão
response_formatTodos os provedores-
seedAlguns provedores-
stopTodos os provedores-
structured_outputsTodos os provedores-
temperatureTodos os provedores1
tool_choiceTodos os provedores-
toolsTodos os provedores-
top_kTodos os provedoresNão enviado por padrão
top_pTodos os provedores0.95

Perguntas frequentes

Modelos similares