UNOROUTER
UNOROUTER
ModelosClassificaçõesPreçosChat
  • Inspetor
  • Documentação
Entrar
ModelosNVIDIAnemotron-3-ultra-550b-a55b
N

NVIDIA: nemotron-3-ultra-550b-a55b

nemotron-3-ultra-550b-a55b
1M contextoRaciocínioFerramentasCacheEstruturado
Lançado Jun 4, 2026Atualizado Jun 4, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Tokenizador Othernvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16
UNOROUTER

Plataforma unificada de API de IA fornecendo acesso a centenas de modelos de múltiplos provedores através de um único endpoint inteligente.

Produto

  • Modelos
  • Preços
  • Documentação
  • Blog
  • Status

Legal

  • Termos e condições
  • Política de privacidade
  • Política de uso aceitável
  • Política de reembolso

Contato

Perguntas ou preocupações?

[email protected]
Destaque em Startup FameVerificado em DANG!Destaque em Twelve ToolsDestaque em FazierDestaque em Product HuntDestaque em TheSaaSDirDestaque em Turbo0Destaque em CodeTrendyDestaque em SitePatentDestaque em MediaProNetDestaque em LaunchBoosts

© 2026 UnoRouter. Todos os direitos reservados.

Preços

Preço de entrada
$0.90/ 1 M tokens
Preço de saída
$5.40/ 1 M tokens
Endpoints compatíveis openaiFornecedor NVIDIA

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
frequency_penaltyTodos os provedoresNão enviado por padrão
include_reasoningTodos os provedores-
logit_biasAlguns provedores-
max_tokensTodos os provedores-
min_pAlguns provedores-
presence_penaltyTodos os provedoresNão enviado por padrão
reasoningTodos os provedores-
reasoning_effortTodos os provedores-
repetition_penaltyAlguns provedoresNão enviado por padrão
response_formatAlguns provedores-
seedAlguns provedores-
stopTodos os provedores-
structured_outputsAlguns provedores-
temperatureTodos os provedores1
tool_choiceAlguns provedores-
toolsAlguns provedores-
top_kTodos os provedoresNão enviado por padrão
top_pTodos os provedores0.95

Perguntas frequentes

Modelos similares

N
llama-3.1-nemotron-nano-8b-v1:free
NVIDIA
N
llama-3.1-nemotron-nano-vl-8b-v1:free
NVIDIA
N
llama-3.3-nemotron-super-49b-v1:free
NVIDIA
A
aion-1.0-mini:free
Aion Labs
S
allam-2-7b:free
SDAIA
S
bielik-11b-v3.0-instruct:free
SpeakLeash
Entrar