UNOROUTER
UNOROUTER
ModelliClassifichePrezziChat
  • Ispettore
  • Documentazione
Accedi
ModelliNVIDIAnemotron-3-ultra-550b-a55b
N

NVIDIA: nemotron-3-ultra-550b-a55b

nemotron-3-ultra-550b-a55b
1M contestoRagionamentoStrumentiCacheStrutturato
Rilasciato Jun 4, 2026Aggiornato Jun 4, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Tokenizer Othernvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16
UNOROUTER

Piattaforma API AI unificata che fornisce accesso a centinaia di modelli da più provider tramite un singolo endpoint intelligente.

Prodotto

  • Modelli
  • Prezzi
  • Documentazione
  • Blog
  • Stato

Legale

  • Termini e condizioni
  • Informativa sulla privacy
  • Politica di utilizzo accettabile
  • Politica di rimborso

Contatto

Domande o preoccupazioni?

[email protected]
In evidenza su Startup FameVerificato su DANG!In evidenza su Twelve ToolsIn evidenza su FazierIn evidenza su Product HuntIn evidenza su TheSaaSDirIn evidenza su Turbo0In evidenza su CodeTrendyIn evidenza su SitePatentIn evidenza su MediaProNetIn evidenza su LaunchBoosts

© 2026 UnoRouter. Tutti i diritti riservati.

Prezzi

Prezzo di input
$0.90/ 1 M token
Prezzo di output
$5.40/ 1 M token
Endpoint compatibili openaiProvider NVIDIA

Disponibilità

Performance

Caricamento dati di performance...

Utilizzo e classifica

Caricamento utilizzo...

Parametri supportati

Tutti i provider = supportato da ogni upstream che serve questo modello. Alcuni provider = dipende dall'upstream che gestisce la richiesta. Predefinito = il valore inviato quando non lo imposti.

ParametroProviderPredefinito
frequency_penaltyTutti i providerNon inviato per impostazione predefinita
include_reasoningTutti i provider-
logit_biasAlcuni provider-
max_tokensTutti i provider-
min_pAlcuni provider-
presence_penaltyTutti i providerNon inviato per impostazione predefinita
reasoningTutti i provider-
reasoning_effortTutti i provider-
repetition_penaltyAlcuni providerNon inviato per impostazione predefinita
response_formatAlcuni provider-
seedAlcuni provider-
stopTutti i provider-
structured_outputsAlcuni provider-
temperatureTutti i provider1
tool_choiceAlcuni provider-
toolsAlcuni provider-
top_kTutti i providerNon inviato per impostazione predefinita
top_pTutti i provider0.95

Domande frequenti

Modelli simili

N
llama-3.1-nemotron-nano-8b-v1:free
NVIDIA
N
llama-3.1-nemotron-nano-vl-8b-v1:free
NVIDIA
N
llama-3.3-nemotron-super-49b-v1:free
NVIDIA
A
aion-1.0-mini:free
Aion Labs
S
allam-2-7b:free
SDAIA
S
bielik-11b-v3.0-instruct:free
SpeakLeash
Accedi