N

NVIDIA: nemotron-3-ultra-550b-a55b

nemotron-3-ultra-550b-a55b
1.0M Kontext32.8K AusgabeReasoningToolsCacheStrukturiert
Veröffentlicht Jun 4, 2026Aktualisiert Jul 22, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Modus chatTokenizer OtherQuantisierung fp4nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16

Preise

Input-Preis
$0.90/ 1 Mio. Tokens
Output-Preis
$5.40/ 1 Mio. Tokens
Kompatible Endpunkte openaiAnbieter NVIDIA

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle AnbieterStandardmäßig nicht gesendet
include_reasoningAlle Anbieter-
logit_biasEinige Anbieter-
max_tokensAlle Anbieter-
min_pEinige Anbieter-
presence_penaltyAlle AnbieterStandardmäßig nicht gesendet
reasoningAlle Anbieter-
reasoning_effortAlle Anbieter-
repetition_penaltyEinige AnbieterStandardmäßig nicht gesendet
response_formatAlle Anbieter-
seedEinige Anbieter-
stopAlle Anbieter-
structured_outputsEinige Anbieter-
temperatureAlle Anbieter1
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_kAlle AnbieterStandardmäßig nicht gesendet
top_pAlle Anbieter0.95

Häufige Fragen

Ähnliche Modelle