• UnoRouterUNOROUTER
Dokumentacja
  • Przewodnik po platformie
Podręcznik użytkownika
  • Szybki start
  • Modele i ceny
  • Powiadomienia
  • Przypinanie grup
FAQ
  • Błędy i limity szybkości
  • Konto i rozliczenia
  • Nagrody Discord
Nawiguj
  • Modele
  • Rankingi
  • Inspektor
  • Cennik
  • Chat
  • Status

Szukaj w dokumentacji...

Zacznij wpisywać, aby przeszukać dokumentację

PlatformaIntegracjeCzat
Przewodnik po platformie

Modele i ceny

Co oznacza przyrostek :free, jak wyceniane jest użycie i dlaczego model czasami znika.

Strona Modele wymienia każdy model z oknem kontekstu, cenami za token, obsługiwanymi punktami końcowymi i filtrami możliwości, takimi jak wywoływanie narzędzi i wejście obrazu. Każdy model ma własną stronę z gotowymi do skopiowania przykładami kodu. Nie każdy darmowy model obsługuje wywoływanie narzędzi lub wizję, więc sprawdź odznaki możliwości, zanim podłączysz jeden do agenta programistycznego.

Katalog modeli z cenami i znaczkami rabatów

Rankings pokazuje na podstawie testów społeczności, które darmowe modele naprawdę działają, a Status śledzi na żywo zdrowie dostawców.

Nowy tutaj? Zdobycie klucza i wysłanie pierwszego zapytania zajmuje minutę w Szybki start

Darmowe modele mają przyrostek :free, na przykład gpt-oss-120b:free

Model :free jest kierowany wyłącznie do darmowych dostawców upstream i nigdy nie narusza twojego salda. Ta sama nazwa bazowa bez przyrostka to wersja płatna: stabilna, bez limitu i rozliczana za token. Obie mogą istnieć obok siebie, więc przejście z darmowego na płatny to zmiana jednego ciągu znaków.

Darmowe modele mają dwie warstwy limitów. Dostawcy upstream ograniczają swoje darmowe pule, a my dodatkowo nakładamy własny limit na użytkownika i model, aby jeden intensywny użytkownik nie wyczerpał wspólnej puli. Spodziewaj się odpowiedzi 429 w godzinach szczytu i używaj modelu płatnego, gdy potrzebujesz niezawodności.

Dokładne limity, nagłówki i wskazówki dotyczące ponowień dokumentuje Błędy i limity szybkości

Każdy model przechodzi przez jedną lub więcej grup dostawców, każda z własną ceną; tabela Group Pricing na stronie modelu wymienia je wszystkie. Wysoka dostępność daje automatyczne rabaty, a przełączenie na inną grupę może przesunąć efektywną cenę.

Tabela cen grup na stronie szczegółów modelu

Jak zablokować model na konkretnych grupach i ich stawkach, zobacz Przypinanie grup

Większość modeli rozlicza się za token, z osobnymi cenami wejścia i wyjścia. Kilka modeli (głównie obraz i wideo) rozlicza zamiast tego stałą cenę za wywołanie. To, co widzisz na stronie modelu, to to, co płacisz: bez subskrypcji, bez ukrytych opłat, twoje saldo po prostu maleje z każdym żądaniem.

Strona Cennik zawiera aktualne opcje doładowania; każda strona modelu pokazuje ceny za token na żywo.

W przypadku modeli obsługujących buforowanie promptów (Claude i inne) powtarzające się prefiksy promptów są rozliczane po obniżonej stawce za wejście z cache, podczas gdy zapis nowego wpisu do cache kosztuje nieco więcej niż zwykły token wejściowy (około 1,25x).

Buforowanie jest automatyczne. Najwięcej zyskują obciążenia z długimi, stabilnymi promptami systemowymi (agenci, presety RP), bez potrzeby konfiguracji.

Żądania automatycznie przechodzą do następnej grupy dostawców, gdy jedna osiągnie limit lub padnie. Model znika z katalogu dopiero wtedy, gdy wszystkie jego kanały są wyłączone.

Znikanie modelu pod obciążeniem jest oczekiwane i nie jest awarią: wraca sam, gdy tylko kanał się odbuduje, zwykle w kilka minut.

Klucze z przypiętymi grupami dostawców przełączają się tylko w obrębie przypiętych grup, zobacz Przypinanie grup

Aby dostać powiadomienie w chwili powrotu, obserwuj go w Powiadomienia

Szybki startPowiadomienia

Na tej stronie

Katalog
Modele darmowe kontra płatne
Zniżki
Jak działa wycena
Buforowanie promptów
Dostępność i przełączanie awaryjne