Szukaj w dokumentacji...

Zacznij wpisywać, aby przeszukać dokumentację

Przewodnik po platformie

Limity szybkości i błędy

Limity i znaczenie każdego kodu statusu.

429 może pochodzić z kilku warstw:

  • Nasz limit darmowych modeli: 1 żądanie na minutę, na darmowy model, na użytkownika.
  • Limity po stronie dostawcy: dostawca stojący za darmowym modelem osiągnął własny limit.
  • Dzienne budżety tokenów w części darmowych pul, resetowane o północy UTC.
  • Limity tokenów na minutę, wyzwalane przez bardzo duże prompty.
  • Limit równoległych żądań przypadający na użytkownika.

Modele płatne nie mają limitów szybkości narzuconych przez UnoRouter.

Gdy zadziała limit 1 na minutę, dostajesz standardowe nagłówki limitu żądań:

text
HTTP/1.1 429 Too Many Requests
Retry-After: 38
X-RateLimit-Limit: 1
X-RateLimit-Remaining: 0
X-RateLimit-Reset: 1783198478

Retry-After to liczba sekund pozostałych w twoim oknie, nie sztywne 60. Komunikat wskazuje model płatny, który nie ma limitu.

Część modeli płatnych jest udostępniana za darmo z limitem rozmiaru żądania. Zbyt duże prompty zwracają 413: Request body too large for gpt-4.1 model. Max size: 8000 tokens.

Limit dotyczy wyłącznie trasy darmowej. Model płatny przyjmuje prompty pełnej długości.

Błędy wracają jako JSON w formacie błędów OpenAI. code to stały identyfikator. Do każdego komunikatu dopisywany jest identyfikator żądania:

json
{
  "error": {
    "message": "Model \"gpt-5.5-typo\" is not offered here. Check the model name for typos, or switch to a model from our supported list. (request id: 20260705...)",
    "type": "new_api_error",
    "code": "model_not_found"
  }
}

Dołącz identyfikator żądania do zgłoszenia do wsparcia. Pozwala on odnaleźć twoje żądanie w logach.

Jeśli dopiero konfigurujesz klucz lub bazowy adres URL, zacznij od Szybki start

Kody statusu, które faktycznie napotkasz:

KodZnaczenieCo zrobić
400Nieprawidłowe żądanie: zły parametr albo prompt zablokowany przez moderację.Popraw żądanie. Ponowienie bez zmian zawiedzie tak samo.
401Brak klucza albo klucz nieprawidłowy, wygasły lub wyłączony.Sprawdź nagłówek Authorization i Tokens page.
402Własny limit wydatków tego klucza został wyczerpany.Podnieś limit klucza lub utwórz nowy klucz.
403Puste saldo, model niedozwolony dla tego klucza albo IP spoza listy dozwolonych.Doładuj lub sprawdź ograniczenia modelu i IP klucza.
413Żądanie przekracza limit rozmiaru darmowego okresu próbnego tego modelu.Skróć prompt lub przełącz się na model płatny.
429Zadziałał limit szybkości (patrz rodzaje poniżej).Odczekaj liczbę sekund z Retry-After, a następnie ponów lub zmień model.
500Coś zawiodło po naszej stronie lub u dostawcy upstream.Spróbuj ponownie po krótkiej chwili. Zgłaszaj uporczywe błędy 500.
503Wszyscy dostawcy zajęci albo nazwa modelu nie istnieje.Przeczytaj komunikat: zajętość mija w kilka minut, literówka nie.

Dwie bardzo różne sytuacje dzielą status 503. Pierwsza to tymczasowe przeciążenie:

text
HTTP/1.1 503 Service Unavailable

{
  "error": {
    "message": "All providers for model \"kimi-k2.6:free\" are busy right now (they hit their rate limit). This is not a spelling error. Please try again in a little while, or switch to another model. (request id: 20260705...)",
    "type": "new_api_error",
    "code": "get_channel_failed"
  }
}

get_channel_failed oznacza, że wszyscy darmowi dostawcy tego modelu mają limit. Mija w kilka minut: ponów albo zmień model. model_not_found oznacza, że nazwa się nie rozwiązuje; ponawianie nigdy nie pomoże. Sprawdź literówki albo katalog.

Traktuj get_channel_failed jako błąd do ponowienia, a model_not_found jako błąd twardy.

Strona statusu pokazująca modele sprawne i z degradacją

Model, który zniknął pod obciążeniem, wraca sam; by dostać powiadomienie w chwili powrotu, obserwuj go w Powiadomienia

Jeśli twój klucz przypina grupy dostawców, istnieje trzeci wariant 503, gdy padły tylko twoje przypięte grupy, zobacz Przypinanie grup

Przy 429 respektuj Retry-After. Błąd 503 get_channel_failed ponów po krótkiej chwili albo zmień model. Błędów klasy 400 nie ponawiaj.

Nieudane i odrzucone żądania nigdy nie są rozliczane; działanie blokady wstępnej i zwrotu opisuje Konto i rozliczenia