190+ ücretsiz yapay zeka modelini tek bir uç noktada topladık
UnoRouter içine 18 ücretsiz sağlayıcı bağladık: 190+ ücretsiz model satırı, tek bir OpenAI-compatible uç nokta, $0 per token. Yükseltemediğimiz üst kaynak sınırlarını taşırlar, ayrıca paylaşılan havuzları adil tutmak için eklediğimiz hafif bir dakikada 1 üst sınır vardır. İşte dürüst sürümü.
UnoRouter, birçok üst kaynak sağlayıcının ücretsiz kotalarını tek anahtarın arkasında gerçek ücretsiz katmanlı 190'dan fazla modelde toplar. Her ücretsiz model, kullanıcı başına dakikada yaklaşık 1 isteğe izin verir; sınıra ulaşınca Retry-After başlığıyla HTTP 429 döner, tükenen havuzlar tüm sağlayıcıların meşgul olduğuna dair açık bir hata döndürür ve otomatik olarak toparlanır. Ücretli modeller $1 başlangıçla kullandıkça öde faturalandırılır.
Ücretsiz LLM ortamı gerçek ama dağınık: Groq, Gemini, Cloudflare, NVIDIA, SiliconFlow ve bir düzine diğeri, her biri bir düzine kayıt sayfası, bir düzine anahtar biçimi ve bir düzine uyumsuz API'nin ardında gerçek kapasite dağıtıyor. Bulabildiğimiz her meşru ve kalıcı olarak ücretsiz sağlayıcıyı keşfedip test ederek UnoRouter içinde birleştirdik. Sonuç: tek bir OpenAI-compatible uç nokta ve tek bir anahtarın ardında 18 sağlayıcıdan 190+ ücretsiz model satırı.
Neler ekledik
On sekiz ücretsiz sağlayıcı, tek tek: Groq, Gemini, Cerebras, SambaNova, Mistral, Cloudflare Workers AI (iki hesap), GitHub Models, Z.ai, OVHcloud, AI Horde, Pollinations, Cohere, Jina, NVIDIA NIM (tam açık katalog: Nemotron, Llama, Qwen, gpt-oss, DeepSeek ve daha fazlası), SiliconFlow (DeepSeek-V4, GLM-5.1, Qwen3.5/3.6, Kimi-K2.6, MiniMax-M3), HuggingFace yönlendiricisi ve LLM7. Bu 190+ ücretsiz model satırı demek: Llama, gpt-oss, Qwen, Mistral, GLM, Nemotron, DeepSeek ve daha fazlası, ayrıca ücretsiz embedding, görüntü ve ses modelleri. Her biri yayına girmeden önce HTTP, akış ve araç çağrıları için baştan sona sınanır; ücretli modellerde uyguladığımız aynı özgünlük ve test tezgahı kontrolleridir.
Bir nedenle ücretsiz
Bu modeller gerçekten ücretsiz ve tam da bu yüzden sınırları var. Her üst kaynak kendi sınırlarını uygular: dakikada istek, günlük token kotaları, Cloudflare neuron bütçeleri, gönüllü kuyruğunda öncelik. Bir üst sınıra ulaşınca o sağlayıcı sıfırlanana dek 429 döndürür. Bu sabah çalışan ücretsiz bir anahtar öğleden sonraya kadar tükenmiş olabilir. Ücretsiz katman, garanti değil, elden gelen en iyi verim sunar. İş yükünüz öngörülebilir gecikme ve sürpriz 429 istemiyorsa ücretli bir model kullanın.
Kendi hız sınırımız ve neden orada olduğu
Üst kaynak sınırlarının üstüne kendimize ait küçük bir sınır ekliyoruz: kullanıcı başına, ücretsiz model başına dakikada bir istek. Bu kasıtlı. Tek bir ücretsiz model çoğu zaman herkesin ortaklaşa paylaştığı, günde belki bir milyon tokenlık tek bir üst kaynak havuzudur; bu yüzden sınır olmadan bir avuç ağır kullanıcı onu dakikalar içinde tüketir ve geri kalan herkes hiçbir şey göremezdi. Model başına dakikada bir istek, havuzu hayatta tutar ve tüm topluluğa yayar; ayrıca trafiğinizi tek bir modeli hırpalamak yerine pek çok ücretsiz modele dağıtabilirsiniz. Sınırımıza ulaştığınızda, tam olarak ne kadar bekleyeceğinizi söyleyen bir Retry-After başlığıyla birlikte bir HTTP 429 alırsınız. Bu, üst kaynak 429 ve aşağıdaki 503 ile ayrıdır. Belirli bir modelde daha yüksek verim istiyorsanız, sınırın geçerli olmadığı ücretli katmanını kullanın.
Neden hepsini bir araya getirelim ki
Çünkü alternatifi on sekiz ayrı hesap. Her sağlayıcının kendi kaydı, kendi anahtar formatı, kendi temel URL'si ve kendi tuhaflıkları var: Z.ai Zhipu V4 yolundan konuşuyor, Cloudflare hesap kimliğini URL içinde taşıyor, AI Horde anonim bir anahtar istiyor, GitHub modelleri bir token kapsamı ardında kilitliyor. Bunların hepsini biz üstlendik, böylece onları diğer her şeyi çağırdığınız gibi çağırıyorsunuz: tek bir OpenAI-compatible uç nokta, tek bir anahtar, bir model adı. Kendimize koyduğumuz dürüst kural: sağlayıcı başına tek bir gerçek hesap, kabul edilen limitler, hiçbir şey çiftliklenmez, hiçbir şey havuzlanmaz. Ücretsiz katmanı bir hediye olarak sunuyoruz, başkasının kotasının yeniden satışı olarak değil.
Limitleri nasıl yumuşatıyoruz
Bu modellerin birçoğu birden fazla ücretsiz sağlayıcı tarafından sunulur. Tek başına Llama 3.3 70B, bunların yedisinde çalışır. Aynı modeli birden çok sağlayıcı sunduğunda, onları tek bir yayımlanmış ad altında birleştirir ve otomatik olarak devrederiz: bir üst kaynak 429 döndürür ya da susarsa, o modeli sunan bir sonraki sağlıklı sağlayıcı isteği devralır. Gerçekten kontrol ettiğimiz tek kol budur. Bir anda bir modelin tüm sağlayıcıları hız sınırındaysa, istek açık bir "tüm sağlayıcılar meşgul" mesajıyla bir HTTP 503 döndürür (404 değil, "model bulunamadı" da değil) ve kanal, sağlık cron'umuz tarafından dakikalar içinde yeniden test edilip yeniden etkinleştirilir. Böylece çok kaynaklı bir ücretsiz model, sağlayıcılarından herhangi biri tükendikten çok sonra bile yanıt vermeyi sürdürür. Tek kaynaklı ücretsiz modellerin yedeği yoktur, bu yüzden tek üst kaynakları tükendiğinde takılıp kalırlar.
Neleri yapmadik
OpenAI ya da Claude amiral gemisi modellerini izinsiz yeniden sunan ters proxy'ler eklemedik. Token'lari devredilemez kişisel-anahtar toplayıcılarını ya da başkalarının anahtarlarını çiftleyip döndüren havuz-içinde-havuz hizmetlerini de dahil etmedik. Bunlar mevcut, cazip ve tam olarak bu geçidin yerine geçmek için tasarlandığı gri-piyasa karmaşası. Listedeki her sağlayıcı, kendi şartları altında, ücretsiz katmanını bilerek sunuyor. Bir kaynak bu çizgiyi geçemediyse, burada yok.
Deneyin
190'ın üzerindeki tüm ücretsiz model, tek bir OpenAI-compatible uç noktanın ardında yayında. Bir API anahtarı edinin ya da model kataloğuna göz atın ve ücretsizlere göre filtreleyin. Bir 429 ya da 503 belirdiğinde yalnızca hangi katmanda olduğunuzu unutmayın.
Sıkça sorulan sorular
UnoRouter'in kaç ücretsiz modeli var?
200+ modellik katalogdan her an 190'dan fazlası. Kesin küme, üst kaynak ücretsiz havuzlar tükenip toparlandıkça değişir ve canlı liste unorouter.com/models adresindedir.
Ücretsiz katmanın hız sınırları nedir?
Kullanıcı başına model başına dakikada yaklaşık 1 istek. Sınır, Retry-After başlığıyla HTTP 429 döndürür. 190+ ücretsiz modelle pratik çözüm, beklemek yerine modeller arasında geçiş yapmaktır.
Ücretsiz modeller için kredi kartı gerekiyor mu?
Hayır. Discord veya GitHub ile kaydolun, bir anahtar oluşturun ve :free son ekine sahip herhangi bir modeli kullanın. Tek seferlik $1 Discord doğrulama bonusu ücretli modellerde harcanabilir.
SpicyChat, belleği ve bağlamı ücretli katmanların ardına kapatılmış, kurulumsuz bir RP sitesidir. UnoRouter kolay başlangıcı korur ama seçtiğiniz 200'den fazla model, derin lorebook'lar ve kodlama ajanları da süren bir anahtar ekler.
Agnai, öne çıkan yanı gerçek çok oyunculu olan açık kaynak bir RP önyüzüdür: tek sohbette birkaç insan ve birkaç bot. UnoRouter ise tek kullanıcılı RP derinliğini barındırılmış olarak sunar; anahtar hesabın kendisidir ve kodlama ajanlarını da sürer.
Open WebUI; kendiniz çalıştırıp anahtarladığınız, Ollama öncelikli, kendiniz barındırılan bir sohbet arayüzüdür. UnoRouter tek anahtarla 200+ barındırılmış modeldir, altyapı yok, üstüne gerçek bir karakter istemcisi ve anahtar kod da yazar.