Modele i ceny
Co oznacza przyrostek :free, jak wyceniane jest użycie i dlaczego model czasami znika.
Strona Modele wymienia każdy model z oknem kontekstu, cenami za token, obsługiwanymi punktami końcowymi i filtrami możliwości, takimi jak wywoływanie narzędzi i wejście obrazu. Każdy model ma własną stronę z gotowymi do skopiowania przykładami kodu. Nie każdy darmowy model obsługuje wywoływanie narzędzi lub wizję, więc sprawdź odznaki możliwości, zanim podłączysz jeden do agenta programistycznego.

Rankings pokazuje na podstawie testów społeczności, które darmowe modele naprawdę działają, a Status śledzi na żywo zdrowie dostawców.
Nowy tutaj? Zdobycie klucza i wysłanie pierwszego zapytania zajmuje minutę w Szybki start
Darmowe modele mają przyrostek :free, na przykład gpt-oss-120b:free
Model :free jest kierowany wyłącznie do darmowych dostawców upstream i nigdy nie narusza twojego salda. Ta sama nazwa bazowa bez przyrostka to wersja płatna: stabilna, bez limitu i rozliczana za token. Obie mogą istnieć obok siebie, więc przejście z darmowego na płatny to zmiana jednego ciągu znaków.
Darmowe modele mają dwie warstwy limitów. Dostawcy upstream ograniczają swoje darmowe pule, a my dodatkowo nakładamy własny limit na użytkownika i model, aby jeden intensywny użytkownik nie wyczerpał wspólnej puli. Spodziewaj się odpowiedzi 429 w godzinach szczytu i używaj modelu płatnego, gdy potrzebujesz niezawodności.
Dokładne limity, nagłówki i wskazówki dotyczące ponowień dokumentuje Błędy i limity szybkości
Każdy model przechodzi przez jedną lub więcej grup dostawców, każda z własną ceną; tabela Group Pricing na stronie modelu wymienia je wszystkie. Wysoka dostępność daje automatyczne rabaty, a przełączenie na inną grupę może przesunąć efektywną cenę.

Jak zablokować model na konkretnych grupach i ich stawkach, zobacz Przypinanie grup
Większość modeli rozlicza się za token, z osobnymi cenami wejścia i wyjścia. Kilka modeli (głównie obraz i wideo) rozlicza zamiast tego stałą cenę za wywołanie. To, co widzisz na stronie modelu, to to, co płacisz: bez subskrypcji, bez ukrytych opłat, twoje saldo po prostu maleje z każdym żądaniem.
Strona Cennik zawiera aktualne opcje doładowania; każda strona modelu pokazuje ceny za token na żywo.
W przypadku modeli obsługujących buforowanie promptów (Claude i inne) powtarzające się prefiksy promptów są rozliczane po obniżonej stawce za wejście z cache, podczas gdy zapis nowego wpisu do cache kosztuje nieco więcej niż zwykły token wejściowy (około 1,25x).
Buforowanie jest automatyczne. Najwięcej zyskują obciążenia z długimi, stabilnymi promptami systemowymi (agenci, presety RP), bez potrzeby konfiguracji.
Żądania automatycznie przechodzą do następnej grupy dostawców, gdy jedna osiągnie limit lub padnie. Model znika z katalogu dopiero wtedy, gdy wszystkie jego kanały są wyłączone.
Znikanie modelu pod obciążeniem jest oczekiwane i nie jest awarią: wraca sam, gdy tylko kanał się odbuduje, zwykle w kilka minut.
Klucze z przypiętymi grupami dostawców przełączają się tylko w obrębie przypiętych grup, zobacz Przypinanie grup
Aby dostać powiadomienie w chwili powrotu, obserwuj go w Powiadomienia