UNOROUTER
UNOROUTER
ModelosClasificacionesPreciosChat
  • Inspector
  • Documentación
Iniciar sesión
ModelosNVIDIAnemotron-3-ultra-550b-a55b
N

NVIDIA: nemotron-3-ultra-550b-a55b

nemotron-3-ultra-550b-a55b
1M contextoRazonamientoHerramientasCachéEstructurado
Lanzado Jun 4, 2026Actualizado Jun 4, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Tokenizador Othernvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16
UNOROUTER

Plataforma unificada de API de IA que proporciona acceso a cientos de modelos de múltiples proveedores a través de un único endpoint inteligente.

Producto

  • Modelos
  • Precios
  • Documentación
  • Blog
  • Estado

Legal

  • Términos y condiciones
  • Política de privacidad
  • Política de uso aceptable
  • Política de reembolsos

Contacto

¿Preguntas o inquietudes?

[email protected]
Destacado en Startup FameVerificado en DANG!Destacado en Twelve ToolsDestacado en FazierDestacado en Product HuntDestacado en TheSaaSDirDestacado en Turbo0Destacado en CodeTrendyDestacado en SitePatentDestacado en MediaProNetDestacado en LaunchBoosts

© 2026 UnoRouter. Todos los derechos reservados.

Precios

Precio de entrada
$0.90/ 1 M tokens
Precio de salida
$5.40/ 1 M tokens
Endpoints compatibles openaiProveedor NVIDIA

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyTodos los proveedoresNo se envía por defecto
include_reasoningTodos los proveedores-
logit_biasAlgunos proveedores-
max_tokensTodos los proveedores-
min_pAlgunos proveedores-
presence_penaltyTodos los proveedoresNo se envía por defecto
reasoningTodos los proveedores-
reasoning_effortTodos los proveedores-
repetition_penaltyAlgunos proveedoresNo se envía por defecto
response_formatAlgunos proveedores-
seedAlgunos proveedores-
stopTodos los proveedores-
structured_outputsAlgunos proveedores-
temperatureTodos los proveedores1
tool_choiceAlgunos proveedores-
toolsAlgunos proveedores-
top_kTodos los proveedoresNo se envía por defecto
top_pTodos los proveedores0.95

Preguntas frecuentes

Modelos similares

N
llama-3.1-nemotron-nano-8b-v1:free
NVIDIA
N
llama-3.1-nemotron-nano-vl-8b-v1:free
NVIDIA
N
llama-3.3-nemotron-super-49b-v1:free
NVIDIA
A
aion-1.0-mini:free
Aion Labs
S
allam-2-7b:free
SDAIA
S
bielik-11b-v3.0-instruct:free
SpeakLeash
Iniciar sesión