NVIDIA: nemotron-3-ultra-550b-a55b:free
NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.
Tarification
Disponibilité
Performance
Utilisation et classement
Paramètres supportés
Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.
| Paramètre | Fournisseurs | Par défaut |
|---|---|---|
| frequency_penalty | Tous les fournisseurs | Non envoyé par défaut |
| include_reasoning | Tous les fournisseurs | - |
| logit_bias | Tous les fournisseurs | - |
| max_tokens | Tous les fournisseurs | - |
| min_p | Tous les fournisseurs | - |
| presence_penalty | Tous les fournisseurs | Non envoyé par défaut |
| reasoning | Tous les fournisseurs | - |
| reasoning_effort | Tous les fournisseurs | - |
| repetition_penalty | Tous les fournisseurs | Non envoyé par défaut |
| response_format | Tous les fournisseurs | - |
| seed | Certains fournisseurs | - |
| stop | Tous les fournisseurs | - |
| structured_outputs | Tous les fournisseurs | - |
| temperature | Tous les fournisseurs | 1 |
| tool_choice | Tous les fournisseurs | - |
| tools | Tous les fournisseurs | - |
| top_k | Tous les fournisseurs | Non envoyé par défaut |
| top_p | Tous les fournisseurs | 0.95 |