UNOROUTER
UNOROUTER
ModelleRanglistePreiseChat
  • Inspektor
  • Docs
Anmelden
ModelleNVIDIAnemotron-3-ultra-550b-a55b
N

NVIDIA: nemotron-3-ultra-550b-a55b

nemotron-3-ultra-550b-a55b
1M KontextReasoningToolsCacheStrukturiert
Veröffentlicht Jun 4, 2026Aktualisiert Jun 4, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Tokenizer Othernvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16
UNOROUTER

Einheitliche KI-API-Plattform mit Zugang zu hunderten Modellen von zahlreichen Anbietern über einen einzigen, intelligenten Endpunkt.

Produkt

  • Modelle
  • Preise
  • Dokumentation
  • Blog
  • Status

Rechtliches

  • Nutzungsbedingungen
  • Datenschutz
  • Nutzungsrichtlinie
  • Rückerstattungsrichtlinie

Kontakt

Fragen oder Anliegen?

[email protected]
Vorgestellt auf Startup FameVerifiziert auf DANG!Vorgestellt auf Twelve ToolsVorgestellt auf FazierVorgestellt auf Product HuntVorgestellt auf TheSaaSDirVorgestellt auf Turbo0Vorgestellt auf CodeTrendyVorgestellt auf SitePatentVorgestellt auf MediaProNetVorgestellt auf LaunchBoosts

© 2026 UnoRouter. Alle Rechte vorbehalten.

Preise

Input-Preis
$0.90/ 1 Mio. Tokens
Output-Preis
$5.40/ 1 Mio. Tokens
Kompatible Endpunkte openaiAnbieter NVIDIA

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle AnbieterStandardmäßig nicht gesendet
include_reasoningAlle Anbieter-
logit_biasEinige Anbieter-
max_tokensAlle Anbieter-
min_pEinige Anbieter-
presence_penaltyAlle AnbieterStandardmäßig nicht gesendet
reasoningAlle Anbieter-
reasoning_effortAlle Anbieter-
repetition_penaltyEinige AnbieterStandardmäßig nicht gesendet
response_formatEinige Anbieter-
seedEinige Anbieter-
stopAlle Anbieter-
structured_outputsEinige Anbieter-
temperatureAlle Anbieter1
tool_choiceEinige Anbieter-
toolsEinige Anbieter-
top_kAlle AnbieterStandardmäßig nicht gesendet
top_pAlle Anbieter0.95

Häufige Fragen

Ähnliche Modelle

N
llama-3.1-nemotron-nano-8b-v1:free
NVIDIA
N
llama-3.1-nemotron-nano-vl-8b-v1:free
NVIDIA
N
llama-3.3-nemotron-super-49b-v1:free
NVIDIA
A
aion-1.0-mini:free
Aion Labs
S
allam-2-7b:free
SDAIA
S
bielik-11b-v3.0-instruct:free
SpeakLeash
Anmelden