हम नकली Claude से थक गए। तो हमने UnoRouter बनाया।
हर दूसरे हफ्ते आउटेज। प्रीमियम मॉडल चुपचाप सस्ते क्लोन से बदले जा रहे थे। हम झल्ला गए, अपना खुद का राउटर बनाया, और दोनों के बारे में पागल हो गए। यहां है लॉन्च की कहानी।
सस्ते AI API बाज़ार में दो समस्याएं हैं। प्रदाता बहुत डाउन हो जाते हैं, और उनमें से कुछ चुपचाप आपके अनुरोध को कमज़ोर मॉडल को आगे बढ़ाते हैं जबकि फ्लैगशिप के लिए आपसे शुल्क लेते हैं। UnoRouter दोनों को ठीक करने के लिए बनाया गया है।
जब प्रदाता नहीं करते तब ऑनलाइन रहें
सस्ते अपस्ट्रीम सस्ते कारण से होते हैं। वे रेट-लिमिट करते हैं, थ्रॉटल करते हैं, और लोड के तहत कनेक्शन छोड़ देते हैं। जब एक डिग्रेड होता है, UnoRouter उसी अनुरोध को उसी मॉडल को सर्व करने वाले दूसरे स्वस्थ प्रदाता को स्वचालित रूप से रूट करता है। आपके एप्लिकेशन को आउटेज नहीं दिखता। आप अपना कोड नहीं लिखते। आप बस शिप करते रहते हैं।
हर मॉडल वास्तविक मॉडल है
हर गेटवे वह नहीं सर्व करता जो वह विज्ञापित करता है। कुछ प्रीमियम मॉडल नामों को सस्ते विकल्पों को अग्रेषित करते हैं और आशा करते हैं कि आप नोटिस नहीं करेंगे। UnoRouter हमारे द्वारा सूचीबद्ध हर मॉडल पर प्रामाणिकता को सत्यापित करता है: हम पहचान और व्यवहार को end to end जांचते हैं, और यदि कोई प्रदाता झूठ बोलता है, तो हम उन्हें काट देते हैं। जब आप Claude कॉल करते हैं, आपको Claude मिलता है। जब आप GPT कॉल करते हैं, आपको GPT मिलता है।
उन टर्मिनलों में काम करता है जिनका आप वास्तव में उपयोग करते हैं
एक मॉडल केवल तभी उपयोगी है जब वह आपके टूल्स में काम करता है। हम HTTP completion, streaming, और tool calling के लिए हर मॉडल को end to end टेस्ट करते हैं। वे तीन क्षमताएं हैं जिन पर AI टर्मिनल हार्नेस निर्भर करते हैं। यदि कोई मॉडल हमारे कैटलॉग में है, तो यह Claude Code, Codex CLI, Gemini CLI, और किसी भी OpenAI-संगत क्लाइंट में काम करता है। सेशन के बीच में कोई आश्चर्यजनक 'streaming not supported' विफलता नहीं।
आगे क्या है
हम साप्ताहिक शिप करते हैं। अधिक मॉडल, स्मार्ट fallback चलाने वाले कड़े स्वास्थ्य सिग्नल, समृद्ध लागत और लेटेंसी डैशबोर्ड, और उन टर्मिनलों और IDEs के साथ गहरे एकीकरण की अपेक्षा करें जिनमें आप पहले से रहते हैं।
कोशिश करने के लिए तैयार हैं? एक API key प्राप्त करें या मॉडल कैटलॉग ब्राउज़ करें।
ai-model-verifier हमारे मॉडल टेस्टर के पीछे का इंजन है, जो AGPL-3.0 लाइसेंस के तहत npm पर प्रकाशित है। इसे एक बेस URL, एक कुंजी और एक मॉडल दें, और यह बताता है कि एंडपॉइंट वही दे रहा है या नहीं जो वह बेचता है, अब थिंकिंग सिग्नेचर और टोकन बिलिंग की जाँच के साथ।
UnoRouter का Discord टैग पहनने से मुफ़्त मॉडलों की दर-सीमा विंडो 25 प्रतिशत घट जाती है: जो मॉडल आप मिनट में एक बार बुला पाते थे, अब हर 45 सेकंड में बुला सकते हैं।
Nevika किसी भी OpenAI-संगत एंडपॉइंट को कस्टम प्रॉक्सी के रूप में स्वीकार करता है। यहाँ एक मिनट का सेटअप है, कौन सा मॉडल चुनें, और वे दो त्रुटियाँ जो सबको मिलती हैं।