N

NVIDIA: nemotron-3-ultra-550b-a55b-free:free

nemotron-3-ultra-550b-a55b-free:free
1.0M Kontext32.8K AusgabeReasoningToolsCacheStrukturiert
Veröffentlicht Jun 4, 2026Aktualisiert Sep 4, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Modus chatTokenizer OtherQuantisierung fp4nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16

Alle Anbieter für dieses Modell sind gerade ausgelastet

Jeder Upstream-Anbieter hat sein Ratenlimit erreicht. Das Modell kommt automatisch zurück, sobald die Limits fallen, meist innerhalb von Stunden. Versuche es später erneut oder wechsle zu einem anderen Modell.

Dieses Modell auf Discord anfragen

Preise

Input-Preis
$0.00/ 1 Mio. Tokens
Output-Preis
$0.00/ 1 Mio. Tokens
Kompatible Endpunkte openaiAnbieter NVIDIA

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle AnbieterStandardmäßig nicht gesendet
include_reasoningAlle Anbieter-
logit_biasEinige Anbieter-
max_tokensAlle Anbieter-
min_pEinige Anbieter-
presence_penaltyAlle AnbieterStandardmäßig nicht gesendet
reasoningAlle Anbieter-
reasoning_effortAlle Anbieter-
repetition_penaltyEinige AnbieterStandardmäßig nicht gesendet
response_formatAlle Anbieter-
seedEinige Anbieter-
stopAlle Anbieter-
structured_outputsEinige Anbieter-
temperatureAlle Anbieter1
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_kAlle AnbieterStandardmäßig nicht gesendet
top_pAlle Anbieter0.95

Häufige Fragen

Ähnliche Modelle