हमने 190+ मुफ़्त AI मॉडल को एक ही एंडपॉइंट में समेट दिया
हमने UnoRouter में 18 मुफ़्त प्रदाता जोड़े हैं: 190+ मुफ़्त मॉडल पंक्तियाँ, एक OpenAI-compatible एंडपॉइंट, $0 per token. इनमें अपस्ट्रीम सीमाएँ होती हैं जिन्हें हम बढ़ा नहीं सकते, और साझा पूल को निष्पक्ष रखने के लिए हमारी ओर से जोड़ी गई प्रति मिनट 1 की एक हल्की सीमा भी। यह रही ईमानदार बात।
UnoRouter कई अपस्ट्रीम प्रोवाइडरों के मुफ्त कोटा को मिलाकर एक कुंजी के पीछे असली फ्री टियर वाले 190 से अधिक मॉडल देता है। हर मुफ्त मॉडल प्रति उपयोगकर्ता लगभग 1 अनुरोध प्रति मिनट की अनुमति देता है; सीमा छूने पर Retry-After हेडर के साथ HTTP 429 मिलता है, और खाली हुए पूल स्पष्ट त्रुटि देते हैं कि सभी प्रोवाइडर व्यस्त हैं और अपने आप ठीक हो जाते हैं। सशुल्क मॉडल $1 से पे-एज़-यू-गो बिल होते हैं।
मुफ़्त LLM का परिदृश्य असली है पर बिखरा हुआ है: Groq, Gemini, Cloudflare, NVIDIA, SiliconFlow और एक दर्जन अन्य, हर एक असली क्षमता मुफ़्त देते हैं, पर एक दर्जन साइन-अप पेजों, एक दर्जन कुंजी प्रारूपों और एक दर्जन असंगत API के पीछे। हमने हर वैध, स्थायी रूप से मुफ़्त प्रदाता को खोजा, परखा और UnoRouter में मिला दिया जो हमें मिल सका। नतीजा: 18 प्रदाताओं से 190+ मुफ़्त मॉडल पंक्तियाँ, एक ही OpenAI-compatible एंडपॉइंट और एक ही कुंजी के पीछे।
हमने क्या जोड़ा
अठारह मुफ़्त प्रदाता, एक-एक करके: Groq, Gemini, Cerebras, SambaNova, Mistral, Cloudflare Workers AI (दो खाते), GitHub Models, Z.ai, OVHcloud, AI Horde, Pollinations, Cohere, Jina, NVIDIA NIM (पूरा खुला कैटलॉग: Nemotron, Llama, Qwen, gpt-oss, DeepSeek और भी), SiliconFlow (DeepSeek-V4, GLM-5.1, Qwen3.5/3.6, Kimi-K2.6, MiniMax-M3), HuggingFace राउटर और LLM7. यह हुई 190+ मुफ़्त मॉडल पंक्तियाँ: Llama, gpt-oss, Qwen, Mistral, GLM, Nemotron, DeepSeek और भी, साथ ही मुफ़्त embedding, इमेज और ऑडियो मॉडल। हर एक को लाइव होने से पहले HTTP, स्ट्रीमिंग और टूल कॉल के लिए आद्योपांत जाँचा जाता है, वही प्रामाणिकता और हार्नेस जाँचें जो हम भुगतान वाले मॉडल पर चलाते हैं।
मुफ्त होने की एक वजह है
ये मॉडल सचमुच मुफ़्त हैं, और ठीक इसीलिए इनकी सीमाएँ हैं। हर अपस्ट्रीम अपनी सीमाएँ लागू करता है: प्रति मिनट अनुरोध, दैनिक टोकन कोटा, Cloudflare न्यूरॉन बजट, स्वयंसेवी कतार में प्राथमिकता। सीमा पर पहुँचते ही वह प्रदाता रीसेट होने तक 429 लौटाता है। जो मुफ़्त कुंजी आज सुबह काम कर रही थी, वह दोपहर तक चुक सकती है। मुफ़्त स्तर सर्वोत्तम-प्रयास थ्रूपुट है, कोई गारंटी नहीं। यदि आपके वर्कलोड को पूर्वानुमेय लेटेंसी और कोई अप्रत्याशित 429 नहीं चाहिए, तो भुगतान वाला मॉडल इस्तेमाल करें।
हमारी अपनी दर सीमा, और वह क्यों है
अपस्ट्रीम सीमाओं के ऊपर हम अपनी एक छोटी सीमा जोड़ते हैं: प्रति उपयोगकर्ता, प्रति मुफ़्त मॉडल, प्रति मिनट एक अनुरोध। यह जानबूझकर है। एक अकेला मुफ़्त मॉडल अक्सर एक ही साझा अपस्ट्रीम पूल होता है, जिसमें शायद सबके मिलाकर रोज़ाना दस लाख टोकन होते हैं, इसलिए बिना सीमा के मुट्ठीभर भारी उपयोगकर्ता उसे मिनटों में सोख लेते और बाकी सबको कुछ न मिलता। प्रति मॉडल प्रति मिनट एक अनुरोध पूल को जीवित रखता है और पूरे समुदाय में फैला देता है, और आप एक ही मॉडल पर हथौड़ा चलाने के बजाय ट्रैफ़िक को कई मुफ़्त मॉडलों में बाँट सकते हैं। जब आप हमारी सीमा पर पहुँचते हैं, तो आपको एक HTTP 429 मिलता है, साथ में एक Retry-After हेडर जो ठीक-ठीक बताता है कि कितनी देर रुकना है। यह अपस्ट्रीम 429 से और नीचे दिए 503 से अलग है। यदि आपको किसी विशेष मॉडल पर अधिक थ्रूपुट चाहिए, तो उसका भुगतान वाला स्तर इस्तेमाल करें, जहाँ यह सीमा लागू नहीं होती।
इन्हें एक जगह जोड़ने की वजह ही क्या है
क्योंकि विकल्प है अठारह अकाउंट। हर प्रोवाइडर का अपना साइनअप, अपना की-फॉर्मेट, अपना बेस URL और अपनी ही झंझटें हैं: Z.ai Zhipu V4 पाथ बोलता है, Cloudflare अकाउंट आईडी को URL में रखता है, AI Horde एक एनोनिमस की चाहता है, GitHub मॉडल को टोकन स्कोप के पीछे रखता है। हमने यह सब अपने ऊपर ले लिया ताकि आप इन्हें वैसे ही कॉल करें जैसे बाकी सब कुछ कॉल करते हैं: एक OpenAI-compatible एंडपॉइंट, एक की, एक मॉडल नाम। ईमानदार नियम जिस पर हम खुद को रखते हैं: हर प्रोवाइडर पर एक असली अकाउंट, सीमाएँ स्वीकार, न कुछ फार्म किया, न कुछ पूल किया। हम मुफ्त टियर को एक उपहार के रूप में पेश करते हैं, किसी और के कोटे की पुनर्बिक्री के रूप में नहीं।
हम सीमाओं को कैसे नरम करते हैं
इनमें से कई मॉडल एक से अधिक मुफ़्त प्रदाता द्वारा परोसे जाते हैं। अकेला Llama 3.3 70B इनमें से सात पर चलता है। जब कई प्रदाता एक ही मॉडल देते हैं, तो हम उन्हें एक प्रकाशित नाम में समेट देते हैं और अपने आप फ़ेलओवर करते हैं: यदि कोई अपस्ट्रीम 429 लौटाता है या चुप हो जाता है, तो उस मॉडल को परोसने वाला अगला स्वस्थ प्रदाता अनुरोध सँभाल लेता है। यही एकमात्र लीवर है जिस पर सचमुच हमारा नियंत्रण है। यदि किसी क्षण किसी मॉडल के सभी प्रदाता दर-सीमित हों, तो अनुरोध एक HTTP 503 लौटाता है, जिसमें एक स्पष्ट "सभी प्रदाता व्यस्त हैं" संदेश होता है (न कोई 404, न "मॉडल नहीं मिला"), और हमारा हेल्थ क्रॉन मिनटों के भीतर चैनल को दोबारा जाँचकर फिर से चालू कर देता है। इसलिए एक बहु-स्रोत मुफ़्त मॉडल अपने किसी भी प्रदाता के चुक जाने के बहुत बाद तक जवाब देता रहता है। एकल-स्रोत मुफ़्त मॉडल के पास कोई विकल्प नहीं होता, इसलिए उनका इकलौता अपस्ट्रीम खत्म होते ही वे ठप हो जाते हैं।
हमने क्या नहीं किया
हमने ऐसे रिवर्स प्रॉक्सी नहीं जोड़े जो बिना अनुमति OpenAI या Claude के फ्लैगशिप मॉडल दोबारा सर्व करते हैं। हमने ऐसे पर्सनल-की एग्रीगेटर नहीं लिए जिनके टोकन ट्रांसफर नहीं किए जा सकते, और न ही पूल-ऑफ-पूल सेवाएँ जो दूसरों की की फार्म और रोटेट करती हैं। ये मौजूद हैं, लुभावनी हैं, और ठीक यही वह ग्रे-मार्केट गड़बड़ है जिसे यह गेटवे बदलने के लिए बना है। सूची का हर प्रोवाइडर अपना मुफ्त टियर जानबूझकर, अपनी शर्तों के तहत देता है। अगर कोई स्रोत उस मानक पर खरा नहीं उतरा, तो वह यहाँ नहीं है।
इसे आज़माएँ
सभी 190+ मुफ़्त मॉडल एक ही OpenAI-compatible एंडपॉइंट के पीछे लाइव हैं। एक API कुंजी लें या मॉडल कैटलॉग देखें और मुफ़्त के लिए फ़िल्टर करें। बस याद रखें कि जब 429 या 503 आए तो आप किस स्तर पर हैं।
अक्सर पूछे जाने वाले सवाल
UnoRouter के पास कितने मुफ्त मॉडल हैं?
200+ मॉडलों के कैटलॉग में से किसी भी समय 190 से अधिक। सटीक सूची अपस्ट्रीम मुफ्त पूलों के खाली होने और उबरने के साथ बदलती रहती है, और लाइव सूची unorouter.com/models पर है।
फ्री टियर की रेट लिमिट क्या है?
लगभग 1 अनुरोध प्रति मिनट प्रति मॉडल प्रति उपयोगकर्ता। सीमा पर Retry-After हेडर के साथ HTTP 429 मिलता है। 190+ मुफ्त मॉडलों के साथ व्यावहारिक तरीका है इंतजार करने की बजाय मॉडल बदलते रहना।
क्या मुफ्त मॉडलों के लिए क्रेडिट कार्ड चाहिए?
नहीं। Discord या GitHub से साइन अप करें, एक कुंजी बनाएँ, और :free प्रत्यय वाला कोई भी मॉडल इस्तेमाल करें। एक बार मिलने वाला $1 का Discord सत्यापन बोनस सशुल्क मॉडलों पर खर्च किया जा सकता है।
SpicyChat एक ज़ीरो-सेटअप RP साइट है जिसकी मेमोरी और कॉन्टेक्स्ट पेड टियर के पीछे बंद हैं। UnoRouter आसान शुरुआत बनाए रखता है पर आपके चुने 200+ मॉडल, गहरे lorebooks, और एक ऐसी key जोड़ता है जो coding agents भी चलाती है।
Agnai एक ओपन-सोर्स RP फ्रंट-एंड है जिसकी ख़ासियत असली मल्टीप्लेयर है: एक ही चैट में कई इंसान और कई बॉट। UnoRouter में सिंगल-यूज़र RP गहराई होस्टेड है, जहाँ key ही अकाउंट है और coding agents भी चलाती है।
Open WebUI एक सेल्फ-होस्टेड, Ollama-first चैट UI है जिसे आप चलाते हैं और keys देते हैं। UnoRouter एक ही key पर 200+ होस्टेड मॉडल है, कोई इंफ्रा नहीं, साथ में एक असली कैरेक्टर क्लाइंट, और key कोड भी करती है।