UNOROUTER
UNOROUTER
ModeleRankingiCennikChat
  • Inspektor
  • Dokumentacja
Zaloguj się
ModeleNVIDIAnemotron-3-ultra-550b-a55b
N

NVIDIA: nemotron-3-ultra-550b-a55b

nemotron-3-ultra-550b-a55b
1M kontekstRozumowanieNarzędziaCacheStrukturalne
Wydano Jun 4, 2026Zaktualizowano Jun 4, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Tokenizer Othernvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16
UNOROUTER

Ujednolicona platforma API AI dająca dostęp do setek modeli od wielu dostawców przez jeden, inteligentny endpoint.

Produkt

  • Modele
  • Cennik
  • Dokumentacja
  • Blog
  • Status

Prawne

  • Warunki i postanowienia
  • Polityka prywatności
  • Zasady dopuszczalnego użytkowania
  • Polityka zwrotów

Kontakt

Pytania lub wątpliwości?

[email protected]
Wyróżniony w Startup FameZweryfikowany w DANG!Wyróżniony w Twelve ToolsWyróżniony w FazierWyróżniony w Product HuntWyróżniony w TheSaaSDirWyróżniony w Turbo0Wyróżniony w CodeTrendyWyróżniony w SitePatentWyróżniony w MediaProNetWyróżniony w LaunchBoosts

© 2026 UnoRouter. Wszelkie prawa zastrzeżone.

Cennik

Cena wejścia
$0.90/ 1 mln tokenów
Cena wyjścia
$5.40/ 1 mln tokenów
Kompatybilne endpointy openaiDostawca NVIDIA

Czas dostępności

Wydajność

Ładowanie danych wydajności...

Użycie i ranking

Ładowanie użycia...

Obsługiwane parametry

Wszyscy dostawcy = obsługiwany przez każdy upstream serwujący ten model. Niektórzy dostawcy = zależy od upstreamu obsługującego żądanie. Domyślnie = wartość wysyłana, gdy nic nie ustawisz.

ParametrDostawcyDomyślne
frequency_penaltyWszyscy dostawcyDomyślnie niewysyłany
include_reasoningWszyscy dostawcy-
logit_biasNiektórzy dostawcy-
max_tokensWszyscy dostawcy-
min_pNiektórzy dostawcy-
presence_penaltyWszyscy dostawcyDomyślnie niewysyłany
reasoningWszyscy dostawcy-
reasoning_effortWszyscy dostawcy-
repetition_penaltyNiektórzy dostawcyDomyślnie niewysyłany
response_formatNiektórzy dostawcy-
seedNiektórzy dostawcy-
stopWszyscy dostawcy-
structured_outputsNiektórzy dostawcy-
temperatureWszyscy dostawcy1
tool_choiceNiektórzy dostawcy-
toolsNiektórzy dostawcy-
top_kWszyscy dostawcyDomyślnie niewysyłany
top_pWszyscy dostawcy0.95

Często zadawane pytania

Podobne modele

N
llama-3.1-nemotron-nano-8b-v1:free
NVIDIA
N
llama-3.1-nemotron-nano-vl-8b-v1:free
NVIDIA
N
llama-3.3-nemotron-super-49b-v1:free
NVIDIA
A
aion-1.0-mini:free
Aion Labs
S
allam-2-7b:free
SDAIA
S
bielik-11b-v3.0-instruct:free
SpeakLeash
Zaloguj się