UNOROUTER
UNOROUTER
ModèlesClassementsTarifsChat
  • Inspecteur
  • Docs
Se connecter
ModèlesNVIDIAnemotron-3-ultra-550b-a55b
N

NVIDIA: nemotron-3-ultra-550b-a55b

nemotron-3-ultra-550b-a55b
1M contexteRaisonnementOutilsCacheStructuré
Publié Jun 4, 2026Mis à jour Jun 4, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Tokenizer Othernvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16
UNOROUTER

Plateforme d'API IA unifiée donnant accès à des centaines de modèles de plusieurs fournisseurs via un unique point d'accès intelligent.

Produit

  • Modèles
  • Tarifs
  • Documentation
  • Blog
  • Statut

Mentions légales

  • Conditions générales
  • Politique de confidentialité
  • Politique d'utilisation acceptable
  • Politique de remboursement

Contact

Des questions ou des préoccupations ?

[email protected]
En vedette sur Startup FameVerifie sur DANG!En vedette sur Twelve ToolsEn vedette sur FazierEn vedette sur Product HuntEn vedette sur TheSaaSDirEn vedette sur Turbo0En vedette sur CodeTrendyEn vedette sur SitePatentEn vedette sur MediaProNetEn vedette sur LaunchBoosts

© 2026 UnoRouter. Tous droits réservés.

Tarification

Prix en entrée
$0.90/ 1 M jetons
Prix en sortie
$5.40/ 1 M jetons
Points d'accès compatibles openaiÉditeur NVIDIA

Disponibilité

Performance

Chargement des performances...

Utilisation et classement

Chargement de l'utilisation...

Paramètres supportés

Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.

ParamètreFournisseursPar défaut
frequency_penaltyTous les fournisseursNon envoyé par défaut
include_reasoningTous les fournisseurs-
logit_biasCertains fournisseurs-
max_tokensTous les fournisseurs-
min_pCertains fournisseurs-
presence_penaltyTous les fournisseursNon envoyé par défaut
reasoningTous les fournisseurs-
reasoning_effortTous les fournisseurs-
repetition_penaltyCertains fournisseursNon envoyé par défaut
response_formatCertains fournisseurs-
seedCertains fournisseurs-
stopTous les fournisseurs-
structured_outputsCertains fournisseurs-
temperatureTous les fournisseurs1
tool_choiceCertains fournisseurs-
toolsCertains fournisseurs-
top_kTous les fournisseursNon envoyé par défaut
top_pTous les fournisseurs0.95

Questions fréquentes

Modèles similaires

N
llama-3.1-nemotron-nano-8b-v1:free
NVIDIA
N
llama-3.1-nemotron-nano-vl-8b-v1:free
NVIDIA
N
llama-3.3-nemotron-super-49b-v1:free
NVIDIA
A
aion-1.0-mini:free
Aion Labs
S
allam-2-7b:free
SDAIA
S
bielik-11b-v3.0-instruct:free
SpeakLeash
Se connecter