N

NVIDIA: nemotron-3-ultra-550b-a55b:free

nemotron-3-ultra-550b-a55b:free
262.1K kontekst32.8K wyjścieRozumowanieNarzędziaCacheStrukturalne
Wydano Jun 4, 2026Zaktualizowano Jun 18, 2026

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it supports text input and output with a context window of up to 1M tokens. It is suited for long-running agentic workflows, including agent orchestration, coding agents, deep research, and complex enterprise tasks. It is particularly strong at multi-step reasoning and planning, with high-throughput inference designed for high-volume agent pipelines. It is part of the NVIDIA Nemotron family of open models for agentic AI.

Cennik

Cena wejścia
$0.00/ 1 mln tokenów
Cena wyjścia
$0.00/ 1 mln tokenów
Okno kontekstu 512.3K tokenówKompatybilne endpointy openaiDostawca NVIDIA

Czas dostępności

Wydajność

Ładowanie danych wydajności...

Użycie i ranking

Ładowanie użycia...

Obsługiwane parametry

Wszyscy dostawcy = obsługiwany przez każdy upstream serwujący ten model. Niektórzy dostawcy = zależy od upstreamu obsługującego żądanie. Domyślnie = wartość wysyłana, gdy nic nie ustawisz.

ParametrDostawcyDomyślne
frequency_penaltyWszyscy dostawcyDomyślnie niewysyłany
include_reasoningWszyscy dostawcy-
logit_biasWszyscy dostawcy-
max_tokensWszyscy dostawcy-
min_pWszyscy dostawcy-
presence_penaltyWszyscy dostawcyDomyślnie niewysyłany
reasoningWszyscy dostawcy-
reasoning_effortWszyscy dostawcy-
repetition_penaltyWszyscy dostawcyDomyślnie niewysyłany
response_formatWszyscy dostawcy-
seedNiektórzy dostawcy-
stopWszyscy dostawcy-
structured_outputsWszyscy dostawcy-
temperatureWszyscy dostawcy1
tool_choiceWszyscy dostawcy-
toolsWszyscy dostawcy-
top_kWszyscy dostawcyDomyślnie niewysyłany
top_pWszyscy dostawcy0.95

Często zadawane pytania

Podobne modele