Kami menggabungkan 190+ model AI gratis ke dalam satu endpoint
Kami menyambungkan 18 penyedia gratis ke UnoRouter: 190+ baris model gratis, satu endpoint OpenAI-compatible, $0 per token. Semuanya membawa batas dari hulu yang tidak bisa kami naikkan, ditambah batas ringan 1 per menit yang kami tambahkan sendiri agar kumpulan bersama tetap adil. Inilah versi jujurnya.
UnoRouter menggabungkan jatah gratis dari banyak provider upstream menjadi lebih dari 190 model dengan tier gratis sungguhan di balik satu kunci. Setiap model gratis mengizinkan sekitar 1 permintaan per menit per pengguna; menyentuh batas mengembalikan HTTP 429 dengan header Retry-After, dan pool yang habis mengembalikan error eksplisit bahwa semua provider sibuk lalu pulih otomatis. Model berbayar ditagih sesuai pemakaian mulai dari $1.
Lanskap LLM gratis itu nyata tetapi tersebar: Groq, Gemini, Cloudflare, NVIDIA, SiliconFlow, dan selusin lainnya masing-masing membagikan kapasitas sungguhan, di balik selusin halaman pendaftaran, selusin format kunci, dan selusin API yang tidak kompatibel. Kami menemukan, menguji, dan menyatukan ke dalam UnoRouter setiap penyedia sah yang gratis secara permanen yang bisa kami temukan. Hasilnya: 190+ baris model gratis dari 18 penyedia di balik satu endpoint OpenAI-compatible dan satu kunci.
Apa yang kami tambahkan
Delapan belas penyedia gratis, satu per satu: Groq, Gemini, Cerebras, SambaNova, Mistral, Cloudflare Workers AI (dua akun), GitHub Models, Z.ai, OVHcloud, AI Horde, Pollinations, Cohere, Jina, NVIDIA NIM (katalog terbuka lengkap: Nemotron, Llama, Qwen, gpt-oss, DeepSeek, dan lainnya), SiliconFlow (DeepSeek-V4, GLM-5.1, Qwen3.5/3.6, Kimi-K2.6, MiniMax-M3), router HuggingFace, dan LLM7. Itu 190+ baris model gratis: Llama, gpt-oss, Qwen, Mistral, GLM, Nemotron, DeepSeek, dan lainnya, ditambah model embedding, gambar, dan audio gratis. Setiap model diuji menyeluruh untuk HTTP, streaming, dan pemanggilan alat sebelum ditayangkan, pemeriksaan keaslian dan uji rig yang sama seperti yang kami jalankan pada model berbayar.
Gratis ada alasannya
Model-model ini benar-benar gratis, dan justru karena itulah mereka memiliki batas. Setiap hulu menerapkan batasnya sendiri: permintaan per menit, kuota token harian, anggaran neuron Cloudflare, prioritas antrean relawan. Begitu mencapai batas, penyedia itu mengembalikan 429 sampai batasnya disetel ulang. Kunci gratis yang tadi pagi bekerja bisa habis pada sore harinya. Tingkat gratis adalah throughput sebisa mungkin, bukan jaminan. Jika beban kerja Anda butuh latensi yang bisa diprediksi dan tanpa 429 yang mengejutkan, gunakan model berbayar.
Batas laju milik kami sendiri, dan mengapa ia ada
Di atas batas dari hulu, kami menambahkan batas kecil milik kami sendiri: satu permintaan per menit per model gratis, per pengguna. Ini disengaja. Satu model gratis sering kali merupakan satu kumpulan hulu bersama yang mungkin berisi sejuta token per hari untuk semua orang digabung, sehingga tanpa batas, segelintir pengguna berat akan menguras habis dalam hitungan menit dan yang lain tidak kebagian apa-apa. Satu per menit per model menjaga kumpulan itu tetap hidup dan tersebar ke seluruh komunitas, dan Anda bisa menyebarkan lalu lintas ke banyak model gratis alih-alih menggempur satu model. Saat Anda mencapai batas kami, Anda mendapat HTTP 429 dengan header Retry-After yang memberi tahu persis berapa lama harus menunggu. Ini terpisah dari 429 dari hulu dan dari 503 di bawah. Jika Anda ingin throughput lebih tinggi pada model tertentu, gunakan tingkat berbayarnya, tempat batas ini tidak berlaku.
Kenapa repot-repot menggabungkannya
Karena pilihan satunya adalah delapan belas akun. Setiap penyedia punya pendaftarannya sendiri, format key-nya sendiri, base URL-nya sendiri, dan keanehannya sendiri: Z.ai bicara lewat jalur Zhipu V4, Cloudflare menyimpan account id di dalam URL, AI Horde meminta key anonim, GitHub mengunci model di balik token scope. Kami menyerap semua itu agar Anda bisa memanggilnya sama seperti memanggil yang lain: satu endpoint OpenAI-compatible, satu key, satu nama model. Aturan jujur yang kami pegang untuk diri sendiri: satu akun asli per penyedia, batasan kami terima, tidak ada yang difarming, tidak ada yang dikumpulkan beramai-ramai. Kami menyajikan tier gratis sebagai pemberian, bukan menjual kembali kuota milik orang lain.
Bagaimana kami meringankan batasannya
Banyak dari model ini dilayani oleh lebih dari satu penyedia gratis. Llama 3.3 70B saja berjalan di tujuh di antaranya. Ketika beberapa penyedia menawarkan model yang sama, kami menggabungkannya di bawah satu nama yang dipublikasikan dan melakukan failover otomatis: jika satu hulu mengembalikan 429 atau terdiam, penyedia sehat berikutnya yang melayani model itu mengambil alih permintaan. Itulah satu-satunya tuas yang benar-benar kami kendalikan. Jika untuk sesaat setiap penyedia sebuah model sedang dibatasi laju, permintaan mengembalikan HTTP 503 dengan pesan eksplisit "semua penyedia sibuk" (bukan 404, dan bukan "model tidak ditemukan"), lalu kanal diuji ulang dan diaktifkan kembali dalam hitungan menit oleh cron kesehatan kami. Jadi, model gratis multi-sumber terus menjawab lama setelah salah satu penyedianya habis. Model gratis sumber tunggal tidak punya cadangan, sehingga macet ketika satu-satunya hulunya terkuras.
Apa yang tidak kami lakukan
Kami tidak menambahkan reverse proxy yang menyajikan ulang model unggulan OpenAI atau Claude tanpa izin. Kami tidak menarik agregator key pribadi yang token-nya tidak dapat dipindahtangankan, atau layanan pool-of-pools yang memfarming dan merotasi key milik orang lain. Hal-hal seperti itu ada, menggoda, dan justru kekacauan pasar gelap yang dimaksudkan untuk digantikan oleh gateway ini. Setiap penyedia dalam daftar memberikan tier gratisnya dengan sengaja, sesuai ketentuannya sendiri. Jika sebuah sumber tidak lolos standar itu, ia tidak ada di sini.
Coba sendiri
Semua 190+ model gratis tayang di balik satu endpoint OpenAI-compatible. Ambil kunci API atau jelajahi katalog model dan saring untuk yang gratis. Cukup ingat Anda berada di tingkat mana saat 429 atau 503 muncul.
Pertanyaan yang sering diajukan
Berapa banyak model gratis yang dimiliki UnoRouter?
Lebih dari 190 pada setiap saat, dari katalog 200+ model. Susunan pastinya bergeser seiring pool gratis upstream terkuras dan pulih, dan daftar langsungnya ada di unorouter.com/models.
Berapa batas laju tier gratis?
Sekitar 1 permintaan per menit per model per pengguna. Saat kena batas, dikembalikan HTTP 429 dengan header Retry-After. Dengan 190+ model gratis, jawaban praktisnya adalah berganti-ganti model alih-alih menunggu.
Apakah aku perlu kartu kredit untuk model gratis?
Tidak. Daftar dengan Discord atau GitHub, buat kunci, dan pakai model mana pun dengan sufiks :free. Bonus verifikasi Discord satu kali sebesar $1 bisa dipakai untuk model berbayar.
SpicyChat adalah situs RP tanpa setup yang memori dan konteksnya dikunci di balik tier berbayar. UnoRouter mempertahankan awalan yang mudah tapi menambahkan 200+ model yang Anda pilih, lorebook yang mendalam, dan key yang juga menjalankan coding agent Anda.
Agnai adalah frontend RP open-source yang unggulannya adalah multiplayer sejati: beberapa manusia dan beberapa bot dalam satu chat. UnoRouter punya kedalaman RP satu-pengguna secara ter-hosting, di mana key-nya sekaligus akunnya dan juga menjalankan coding agent Anda.
Open WebUI adalah UI chat self-host yang mengutamakan Ollama, yang Anda jalankan dan Anda beri key. UnoRouter adalah 200+ model ter-hosting dengan satu key, tanpa infra, plus character client sungguhan, dan key-nya juga bisa coding.