Wir hatten genug von falschem Claude. Also haben wir UnoRouter gebaut.
Ausfälle im Wochentakt. Premium-Modelle heimlich gegen billige Klone getauscht. Irgendwann war Schluss, also haben wir unseren eigenen Router gebaut und ihn paranoid gemacht. Das ist die Launch-Story.
Der Markt für günstige KI-APIs hat zwei Probleme. Anbieter fallen oft aus, und manche leiten deine Anfrage still und heimlich an ein schwächeres Modell weiter, während sie dir trotzdem das Flaggschiff in Rechnung stellen. UnoRouter ist gebaut, um beides zu lösen.
Online bleiben, wenn Anbieter es nicht tun
Günstige Upstreams sind aus einem Grund günstig. Sie drosseln, limitieren und brechen Verbindungen unter Last ab. Wenn einer schwächelt, leitet UnoRouter dieselbe Anfrage automatisch an einen anderen gesunden Anbieter weiter, der dasselbe Modell bereitstellt. Deine Anwendung merkt nichts vom Ausfall. Du schreibst deinen Code nicht um. Du lieferst einfach weiter.
Jedes Modell ist das echte Modell
Nicht jedes Gateway liefert, was es verspricht. Manche leiten Premium-Modellnamen auf günstigere Ersatzmodelle um und hoffen, dass du es nicht merkst. UnoRouter prüft die Authentizität jedes gelisteten Modells: Wir testen Identität und Verhalten durchgängig, und wenn ein Anbieter lügt, fliegt er raus. Wenn du Claude aufrufst, bekommst du Claude. Wenn du GPT aufrufst, bekommst du GPT.
Läuft in den Terminals, die du wirklich benutzt
Ein Modell ist nur nützlich, wenn es in deinen Tools funktioniert. Wir testen jedes Modell durchgängig auf HTTP-Completion, Streaming und Tool-Calling. Genau diese drei Fähigkeiten sind es, auf die KI-Terminal-Harnesses angewiesen sind. Wenn ein Modell in unserem Katalog steht, läuft es in Claude Code, Codex CLI, Gemini CLI und jedem OpenAI-kompatiblen Client. Keine bösen Überraschungen mitten in der Session, weil plötzlich 'Streaming nicht unterstützt' kommt.
Was kommt als Nächstes
Wir liefern wöchentlich. Erwarte mehr Modelle, präzisere Health-Signale für noch intelligentere Fallbacks, reichhaltigere Dashboards für Kosten und Latenz und tiefere Integrationen mit den Terminals und IDEs, in denen du ohnehin schon arbeitest.
Bereit zum Ausprobieren? Hol dir einen API-Schlüssel oder durchsuche den Modellkatalog.
ai-model-verifier ist der Motor hinter unserem Modell-Tester, veröffentlicht auf npm unter AGPL-3.0. Gib ihm eine Basis-URL, einen Schlüssel und ein Modell, und er sagt dir, ob der Endpunkt liefert, was er verkauft, jetzt mit Prüfung der Thinking-Signatur und der Token-Abrechnung.
Wenn du das UnoRouter-Discord-Tag trägst, verkürzt sich dein Ratenlimit-Fenster für Gratis-Modelle um 25 Prozent: Ein Modell, das du einmal pro Minute aufrufen konntest, kannst du nun alle 45 Sekunden aufrufen.
Nevika akzeptiert jeden OpenAI-kompatiblen Endpunkt als Custom Proxy. Hier ist die Einrichtung in einer Minute, welches Modell sich eignet und die zwei Fehler, die auftreten.