• UnoRouterUNOROUTER
Dokumentation
  • Plattform-Leitfaden
Benutzerhandbuch
  • Schnellstart
  • Modelle & Preise
  • Benachrichtigungen
  • Gruppen-Pinning
FAQ
  • Fehler & Ratenlimits
  • Konto & Abrechnung
  • Discord-Belohnungen
Navigation
  • Modelle
  • Rangliste
  • Inspektor
  • Preise
  • Chat
  • Status

Docs durchsuchen...

Tippen Sie, um die Dokumentation zu durchsuchen

PlattformIntegrationenChat
Plattform-Leitfaden

Modelle & Preise

Was das Suffix :free bedeutet, wie die Nutzung abgerechnet wird und warum ein Modell manchmal verschwindet.

Die Modelle-Seite listet jedes Modell mit Kontextfenster, Preisen pro Token, unterstützten Endpunkten und Fähigkeitsfiltern wie Tool-Aufrufen und Bildeingabe auf. Jedes Modell hat seine eigene Seite mit Copy-and-paste-Codebeispielen. Nicht jedes kostenlose Modell unterstützt Tool-Aufrufe oder Vision, prüfe also die Fähigkeits-Badges, bevor du eines in einen Coding-Agenten einbindest.

Modellkatalog mit Preisen und Rabatt-Badges

Rankings zeigt anhand von Community-Testergebnissen, welche kostenlosen Modelle wirklich liefern, und Status verfolgt die Live-Gesundheit der Anbieter.

Neu hier? Key holen und erste Anfrage senden dauert eine Minute im Schnellstart

Kostenlose Modelle tragen ein Suffix :free, zum Beispiel gpt-oss-120b:free

Ein :free-Modell wird nur an kostenlose Upstream-Anbieter geleitet und berührt niemals dein Guthaben. Derselbe Basisname ohne Suffix ist die kostenpflichtige Version: stabil, ohne Obergrenze und pro Token abgerechnet. Beide können nebeneinander existieren, sodass der Wechsel von kostenlos zu kostenpflichtig eine Änderung an einer einzigen Zeichenkette ist.

Kostenlose Modelle haben zwei Ebenen von Limits. Die Upstream-Anbieter begrenzen ihre kostenlosen Pools, und darüber hinaus setzen wir ein eigenes Limit pro Nutzer und Modell, damit ein einzelner Vielnutzer einen gemeinsamen Pool nicht leeren kann. Erwarte 429-Antworten zu Stoßzeiten und nutze ein kostenpflichtiges Modell, wenn du Zuverlässigkeit brauchst.

Die genauen Limits, Header und Retry-Hinweise dokumentiert Fehler & Ratenlimits

Jedes Modell läuft über eine oder mehrere Anbietergruppen mit jeweils eigenem Preis; die Group-Pricing-Tabelle auf der Modellseite listet sie alle. Hohe Verfügbarkeit bringt automatische Rabatte, und ein Failover in eine andere Gruppe kann den effektiven Preis verschieben.

Gruppenpreis-Tabelle auf einer Modell-Detailseite

Wie du ein Modell auf bestimmte Gruppen und deren Tarife festlegst, zeigt Gruppen-Pinning

Die meisten Modelle rechnen pro Token ab, mit getrennten Preisen für Eingabe und Ausgabe. Einige wenige Modelle (meist Bild und Video) rechnen stattdessen einen Pauschalpreis pro Aufruf ab. Was du auf der Modellseite siehst, ist das, was du bezahlst: keine Abonnements, keine versteckten Gebühren, dein Guthaben verringert sich einfach pro Anfrage.

Die Preise-Seite enthält die aktuellen Aufladeoptionen; jede Modellseite zeigt Live-Preise pro Token.

Bei Modellen, die Prompt-Caching unterstützen (Claude und andere), werden wiederholte Prompt-Präfixe zu einem reduzierten Tarif für zwischengespeicherte Eingaben abgerechnet, während das Schreiben eines neuen Cache-Eintrags etwas mehr als ein normales Eingabe-Token kostet (etwa 1,25x).

Das Caching erfolgt automatisch. Arbeitslasten mit langen, stabilen System-Prompts (Agenten, RP-Presets) profitieren am meisten, ganz ohne Konfiguration.

Anfragen weichen automatisch auf die nächste Anbietergruppe aus, wenn eine ihr Limit erreicht oder ausfällt. Erst wenn jeder Kanal eines Modells weg ist, verschwindet das Modell aus dem Katalog.

Dass ein Modell unter Last verschwindet, ist normal und kein Ausfall: Es taucht von selbst wieder auf, sobald ein Kanal sich erholt, meist binnen Minuten.

Schlüssel mit gepinnten Anbietergruppen weichen nur innerhalb ihrer gepinnten Gruppen aus, siehe Gruppen-Pinning

Um sofort benachrichtigt zu werden, wenn es zurück ist, beobachte es unter Benachrichtigungen

SchnellstartBenachrichtigungen

Auf dieser Seite

Der Katalog
Kostenlose vs. kostenpflichtige Modelle
Rabatte
So funktioniert die Preisgestaltung
Prompt-Caching
Verfügbarkeit & Failover