Мы объединили более 190 бесплатных ИИ-моделей в одну точку доступа
Мы подключили к UnoRouter 18 бесплатных провайдеров: 190+ строк бесплатных моделей, одна точка доступа OpenAI-compatible, $0 per token. Они несут вышестоящие лимиты, которые мы не можем поднять, плюс небольшой предел в 1 запрос в минуту, который мы добавляем сами, чтобы общие пулы оставались справедливыми. Вот честная версия.
UnoRouter собирает бесплатные квоты множества провайдеров в более чем 190 моделей с настоящим бесплатным тарифом за одним ключом. Каждая бесплатная модель допускает примерно 1 запрос в минуту на пользователя; при достижении лимита возвращается HTTP 429 с заголовком Retry-After, а исчерпанные пулы возвращают явную ошибку о занятости всех провайдеров и восстанавливаются автоматически. Платные модели оплачиваются по факту от $1.
Ландшафт бесплатных LLM реален, но разрознен: Groq, Gemini, Cloudflare, NVIDIA, SiliconFlow и десяток других отдают настоящие мощности, каждый за десятком страниц регистрации, десятком форматов ключей и десятком несовместимых API. Мы нашли, протестировали и свели в UnoRouter каждого легитимного и постоянно бесплатного провайдера, какого только смогли отыскать. Результат: 190+ строк бесплатных моделей от 18 провайдеров за единой точкой доступа OpenAI-compatible и одним ключом.
Что мы добавили
Восемнадцать бесплатных провайдеров, по очереди: Groq, Gemini, Cerebras, SambaNova, Mistral, Cloudflare Workers AI (два аккаунта), GitHub Models, Z.ai, OVHcloud, AI Horde, Pollinations, Cohere, Jina, NVIDIA NIM (полный открытый каталог: Nemotron, Llama, Qwen, gpt-oss, DeepSeek и другие), SiliconFlow (DeepSeek-V4, GLM-5.1, Qwen3.5/3.6, Kimi-K2.6, MiniMax-M3), маршрутизатор HuggingFace и LLM7. Получается 190+ строк бесплатных моделей: Llama, gpt-oss, Qwen, Mistral, GLM, Nemotron, DeepSeek и другие, плюс бесплатные модели эмбеддингов, изображений и аудио. Каждая проходит сквозную проверку HTTP, потоковой передачи и вызова инструментов, прежде чем выйти в продакшн, те же проверки подлинности и стендовые тесты, которые мы выполняем для платных моделей.
Бесплатны не просто так
Эти модели действительно бесплатны, и именно поэтому у них есть лимиты. Каждый вышестоящий провайдер устанавливает свои: запросы в минуту, суточные квоты токенов, бюджеты нейронов Cloudflare, приоритет в волонтёрской очереди. Достигнув предела, провайдер возвращает 429, пока лимит не сбросится. Бесплатный ключ, работавший утром, к обеду может быть исчерпан. Бесплатный уровень даёт пропускную способность по мере возможности, а не гарантию. Если вашей нагрузке нужны предсказуемая задержка и никаких неожиданных 429, используйте платную модель.
Наш собственный лимит запросов и зачем он нужен
Поверх вышестоящих пределов мы добавляем небольшой собственный лимит: один запрос в минуту на каждую бесплатную модель для каждого пользователя. Это сделано намеренно. Отдельная бесплатная модель зачастую представляет собой единый общий вышестоящий пул примерно в миллион токенов в день на всех вместе, так что без лимита горстка активных пользователей осушила бы его за считанные минуты, и остальным не досталось бы ничего. Один запрос в минуту на модель сохраняет пул живым и распределяет его по всему сообществу, а вы можете разнести трафик по множеству бесплатных моделей вместо того, чтобы долбить одну. Достигнув нашего предела, вы получаете HTTP 429 с заголовком Retry-After, который точно сообщает, сколько ждать. Это отдельно от вышестоящего 429 и от 503 ниже. Если вам нужна большая пропускная способность для конкретной модели, используйте её платный уровень, где лимит не действует.
Зачем вообще их объединять
Потому что альтернатива это восемнадцать аккаунтов. У каждого провайдера своя регистрация, свой формат ключа, свой базовый URL и свои причуды: Z.ai говорит на пути Zhipu V4, Cloudflare несет id аккаунта в URL, AI Horde хочет анонимный ключ, GitHub прячет модели за областью видимости токена. Мы взяли все это на себя, чтобы вы обращались к ним так же, как ко всему остальному: один OpenAI-compatible эндпоинт, один ключ, имя модели. Честное правило, которому мы себя держим: один реальный аккаунт на провайдера, лимиты приняты, ничего не нафармлено, ничего не объединено в пул. Мы отдаем бесплатный тариф как подарок, а не как перепродажу чужой квоты.
Как мы смягчаем лимиты
Многие из этих моделей обслуживаются более чем одним бесплатным провайдером. Один только Llama 3.3 70B работает у семи из них. Когда одну и ту же модель предлагают несколько провайдеров, мы объединяем их под единым публикуемым именем и автоматически переключаемся: если вышестоящий провайдер возвращает 429 или замолкает, запрос принимает следующий исправный провайдер, обслуживающий эту модель. Это единственный рычаг, которым мы действительно управляем. Если в какой-то момент у всех провайдеров модели превышен лимит, запрос возвращает HTTP 503 с явным сообщением "все провайдеры заняты" (не 404 и не "модель не найдена"), а канал повторно проверяется и снова включается за считанные минуты нашим cron проверки работоспособности. Так бесплатная модель с несколькими источниками продолжает отвечать ещё долго после того, как исчерпан любой из её провайдеров. У бесплатных моделей с единственным источником резерва нет, поэтому они останавливаются, когда их единственный вышестоящий провайдер исчерпан.
Чего мы не делали
Мы не добавляли реверс-прокси, которые без разрешения перепродают флагманы OpenAI или Claude. Мы не подтягивали агрегаторы личных ключей, чьи токены непередаваемы, и сервисы пулов из пулов, которые фармят и ротируют чужие ключи. Они существуют, они соблазнительны, и это ровно та серая каша, которую этот шлюз и призван заменить. Каждый провайдер в списке раздает свой бесплатный тариф намеренно, на своих условиях. Если источник не смог пройти эту планку, его здесь нет.
Попробуйте
Все более чем 190 бесплатных моделей доступны за единой точкой доступа OpenAI-compatible. Получите ключ API или просмотрите каталог моделей и отфильтруйте по бесплатным. Просто помните, на каком уровне вы находитесь, когда появляется 429 или 503.
Часто задаваемые вопросы
Сколько бесплатных моделей у UnoRouter?
Более 190 в любой момент, из каталога в 200+ моделей. Точный набор меняется по мере того, как бесплатные пулы провайдеров исчерпываются и восстанавливаются, а живой список находится на unorouter.com/models.
Какие лимиты у бесплатного тарифа?
Примерно 1 запрос в минуту на модель на пользователя. При лимите возвращается HTTP 429 с заголовком Retry-After. При 190+ бесплатных моделях практичный ответ - менять модели, а не ждать.
Нужна ли банковская карта для бесплатных моделей?
Нет. Зарегистрируйтесь через Discord или GitHub, создайте ключ и используйте любую модель с суффиксом :free. Разовый бонус $1 за верификацию в Discord можно потратить на платные модели.
SpicyChat — это сайт для ролевых игр без настройки с фиксированными моделями. UnoRouter сохраняет лёгкость, но добавляет глубину lorebook-ов, 200+ моделей на ваш выбор и ключ, который ещё и запускает кодинг-агентов.
Agnai — это open-source мультидвижковый фронтенд для ролевых игр с книгами памяти и сценариями, BYOK. У UnoRouter та же глубина в облаке, где ключ и есть аккаунт, и он ещё запускает кодинг-агентов.
Open WebUI — это самостоятельно хостимый чат-интерфейс, ориентированный на Ollama, который вы запускаете и снабжаете ключами. UnoRouter — это 200+ облачных моделей на одном ключе, без инфраструктуры, плюс настоящий клиент для персонажей, и ключ ещё и кодит.