On en avait marre des faux Claude. Alors on a construit UnoRouter.
Des pannes une semaine sur deux. Des modèles premium silencieusement remplacés par des copiés bon marché. On a craqué, on a sorti notre propre routeur, paranoïaque sur les deux fronts. Voici l'histoire.
Le marché des API IA bon marché a deux problèmes. Les fournisseurs tombent souvent en panne, et certains transmettent discrètement votre requête à un modèle plus faible tout en vous facturant le modèle phare. UnoRouter est conçu pour résoudre les deux.
Rester en ligne quand les fournisseurs ne le sont pas
Les upstreams bon marché le sont pour une raison. Ils limitent le débit, restreignent les accès et coupent les connexions sous charge. Quand l'un se dégrade, UnoRouter route automatiquement la même requête vers un autre fournisseur sain servant le même modèle. Votre application ne voit pas la panne. Vous ne réécrivez pas votre code. Vous continuez simplement à livrer.
Chaque modèle est le vrai modèle
Toutes les passerelles ne servent pas ce qu'elles annoncent. Certaines redirigent les noms de modèles premium vers des substituts moins chers en espérant que vous ne le remarquiez pas. UnoRouter valide l'authenticité de chaque modèle que nous listons : nous sondons l'identité et le comportement de bout en bout, et si un fournisseur ment, nous le coupons. Quand vous appelez Claude, vous obtenez Claude. Quand vous appelez GPT, vous obtenez GPT.
Fonctionne dans les terminaux que vous utilisez vraiment
Un modèle n'est utile que s'il fonctionne dans vos outils. Nous testons chaque modèle de bout en bout pour la complétion HTTP, le streaming et l'appel d'outils. Ces trois capacités sont celles dont dépendent les harnais de terminaux IA. Si un modèle figure dans notre catalogue, il fonctionne dans Claude Code, Codex CLI, Gemini CLI et tout client compatible OpenAI. Pas de surprise avec des échecs de type 'streaming non pris en charge' en pleine session.
Et ensuite
Nous livrons chaque semaine. Attendez-vous à plus de modèles, des signaux de santé plus précis pour des basculements plus intelligents, des tableaux de bord de coût et de latence plus riches et des intégrations plus profondes avec les terminaux et IDE que vous utilisez déjà.
Prêt à essayer ? Obtenez une clé API ou parcourez le catalogue de modèles.
ai-model-verifier est le moteur de notre testeur de modèles, publié sur npm sous licence AGPL-3.0. Donnez-lui une URL de base, une clé et un modèle, et il vous dit si le point de terminaison sert ce qu'il vend, désormais avec vérification de la signature de réflexion et de la facturation des tokens.
Porter le tag Discord UnoRouter réduit de 25 pour cent votre fenêtre de limitation sur les modèles gratuits : un modèle appelable une fois par minute devient appelable toutes les 45 secondes.
Nevika accepte n'importe quel endpoint compatible OpenAI comme proxy personnalisé. Voici la configuration en une minute, quel modèle choisir et les deux erreurs que l'on rencontre.