UNOROUTER
UNOROUTER
模型排行榜价格对话
  • 检测器
  • 文档
登录
返回全部文章
已发布
产品

我们把 190+ 个免费 AI 模型汇聚到了一个端点

我们已将 18 家免费提供方接入 UnoRouter:190+ 条免费模型、一个 OpenAI-compatible 端点、$0 per token。它们自带我们无法提高的上游限额,我们还额外加了一道轻量的每分钟 1 次上限,以保持共享池的公平。这是诚实的说法。

2026年6月15日·阅读时间 3 分钟·作者:UnoRouter 团队
公告产品

UnoRouter 把众多上游供应商的免费额度汇聚成 190 多个带真正免费额度的模型,全部在一把密钥之后。每个免费模型允许每位用户每分钟约 1 次请求;达到上限会返回带 Retry-After 头的 HTTP 429,额度耗尽的池会返回明确的所有供应商繁忙错误,并自动恢复。付费模型按量计费,$1 起。

免费 LLM 的版图是真实存在的,却又零散:Groq、Gemini、Cloudflare、NVIDIA、SiliconFlow 以及另外十几家,各自都在免费送出真实算力,只是藏在十几个注册页面、十几种密钥格式和十几套互不兼容的 API 背后。我们把能找到的每一家合法且永久免费的提供方都发现、测试并合并进了 UnoRouter。结果就是:来自 18 家提供方的 190+ 条免费模型,全都收在一个 OpenAI-compatible 端点和一把密钥之后。

我们加了什么

十八家免费提供方,逐一列出:Groq、Gemini、Cerebras、SambaNova、Mistral、Cloudflare Workers AI(两个账户)、GitHub Models、Z.ai、OVHcloud、AI Horde、Pollinations、Cohere、Jina、NVIDIA NIM(完整开放目录:Nemotron、Llama、Qwen、gpt-oss、DeepSeek 等)、SiliconFlow(DeepSeek-V4、GLM-5.1、Qwen3.5/3.6、Kimi-K2.6、MiniMax-M3)、HuggingFace 路由器,以及 LLM7。这样就有了 190+ 条免费模型:Llama、gpt-oss、Qwen、Mistral、GLM、Nemotron、DeepSeek 等,外加免费的嵌入、图像和音频模型。每一个在上线前都会针对 HTTP、流式传输和工具调用做端到端探测,这与我们在付费模型上执行的真实性检查和测试框架检查完全相同。

免费是有原因的

这些模型是真正免费的,也正因如此它们才有限制。每个上游都各自设限:每分钟请求数、每日 token 配额、Cloudflare 的神经元预算、志愿者队列的优先级。一旦触及上限,该提供方就会返回 429,直到限额重置。今早还能用的免费密钥,到下午就可能已经耗尽。免费层是尽力而为的吞吐量,而非保证。如果你的工作负载需要可预测的延迟、不希望冒出意外的 429,请使用付费模型。

我们自己的速率限制,以及它为何存在

在上游限额之上,我们再加了一道自己的小限制:每位用户、每个免费模型每分钟一次请求。这是刻意为之。单个免费模型往往就是一个共享的上游池,全体用户合计每天也许只有一百万 token,所以若没有上限,少数重度用户几分钟内就会把它抽干,其他人则什么都拿不到。每模型每分钟一次,让这个池得以存续并分摊到整个社区,你也可以把流量分散到众多免费模型上,而不是死磕某一个。当你触及我们的上限时,你会收到一个 HTTP 429,并附带一个 Retry-After 头,准确告诉你需要等待多久。这与上游的 429 以及下文的 503 是两码事。如果你想在某个特定模型上获得更高吞吐量,请使用它的付费层,那里不适用此限制。

为什么要把它们聚合起来

因为不聚合的代价就是 18 个账户。每家服务商都有自己的注册流程、自己的密钥格式、自己的 base URL 和自己的怪癖:Z.ai 走 Zhipu V4 的路径,Cloudflare 把账户 id 放在 URL 里,AI Horde 要的是匿名密钥,GitHub 把模型锁在某个 token scope 之后。我们把这一切都消化掉,让你像调用其他一切那样调用它们:一个 OpenAI-compatible 端点、一把密钥、一个模型名。我们对自己定下的诚实准则是:每家服务商只用一个真实账户,接受配额上限,不刷量、不拼池。我们把免费层当作一份礼物呈现,而不是转售别人配额的生意。

我们如何缓和这些限制

这些模型中有许多是由不止一家免费提供方供给的。单是 Llama 3.3 70B 就跑在其中七家上。当多家提供方提供同一个模型时,我们会把它们合并到一个对外发布的名称下,并自动进行故障转移:如果某个上游返回 429 或陷入沉默,供给该模型的下一家健康提供方就会接手这次请求。这是我们确实能掌控的唯一杠杆。如果某个模型的所有提供方一时间都被限速,请求会返回一个 HTTP 503,附带明确的"所有提供方繁忙"消息(既不是 404,也不是"未找到模型"),随后我们的健康检查 cron 会在几分钟内重新测试并重新启用该通道。这样一来,多源免费模型在其任一提供方枯竭之后,仍能长时间继续应答。单源免费模型没有退路,因此一旦其唯一的上游用尽,就会停摆。

我们没有做什么

我们没有加那种未经许可、转手重新提供 OpenAI 或 Claude 旗舰模型的反向代理。我们没有引入那些 token 不可转移的个人密钥聚合器,也没有引入刷量并轮换他人密钥的"池中池"服务。这些东西确实存在,确实诱人,而它们恰恰是这个网关想要取代的灰色市场乱象。名单上的每一家服务商,都是按自己的条款、有意把免费层拿出来共享的。如果某个来源过不了这道门槛,它就不会出现在这里。

来试试

全部 190+ 个免费模型都在一个 OpenAI-compatible 端点之后运行。获取一把 API 密钥,或浏览模型目录并按免费筛选。只要在出现 429 或 503 时记住自己身处哪一层就好。

常见问题

UnoRouter 有多少个免费模型?

在 200+ 个模型的目录中,任意时刻都有 190 多个免费。具体名单会随上游免费额度池的耗尽与恢复而变化,实时列表见 unorouter.com/models。

免费额度的速率限制是多少?

每位用户每个模型每分钟约 1 次请求。达到上限会返回带 Retry-After 头的 HTTP 429。既然有 190+ 个免费模型,实际做法是轮换模型而不是干等。

使用免费模型需要信用卡吗?

不需要。用 Discord 或 GitHub 注册,创建密钥,就能使用任何带 :free 后缀的模型。一次性的 $1 Discord 验证奖励可以用在付费模型上。

上一篇
在哪里找到UnoRouter:我们的目录收录
下一篇
UnoRouter 对比 LiteLLM:托管网关还是自托管代理
相关文章
产品·2026年7月28日·阅读时间 1 分钟
UnoRouter 对比 SpicyChat:轻松那条路,外加深度、模型和代码

SpicyChat 是一个零配置的 RP 网站,它的记忆和上下文被拦在付费档后面。UnoRouter 保留那份轻松的开局,还加上 200+ 个由你挑的模型、深度 lorebooks,以及一把还能运行编程智能体的密钥。

产品·2026年7月25日·阅读时间 1 分钟
UnoRouter 对比 Agnai:一样的 RP 深度,托管好,一把密钥

Agnai 是一个开源 RP 前端,它的亮点是真正的多人:一个聊天里有多个真人和多个机器人。UnoRouter 把有深度的单用户 RP 做成托管,密钥就是账号,还能运行编程智能体。

产品·2026年7月23日·阅读时间 1 分钟
UnoRouter 对比 Open WebUI:200 多个托管模型,不用 Ollama,外加角色聊天

Open WebUI 是一个自托管、以 Ollama 为先的聊天界面,你自己运行、自己配密钥。UnoRouter 是 200 多个托管模型,一把密钥,无需基础设施,外加一个真正的角色客户端,密钥还能写代码。

本页目录

我们加了什么
免费是有原因的
我们自己的速率限制,以及它为何存在
为什么要把它们聚合起来
我们如何缓和这些限制
我们没有做什么
来试试
UNOROUTER

统一的 AI API 平台,通过单一智能端点接入多家提供方的数百个模型。

产品

  • 模型
  • 价格
  • 文档
  • 博客
  • 状态

法律

  • 条款与条件
  • 隐私政策
  • 使用政策
  • 退款政策

联系我们

有疑问或建议?

[email protected]
已在 Startup Fame 推荐已在 DANG! 验证已在 Twelve Tools 推荐已在 Fazier 推荐已在 Product Hunt 推荐已在 TheSaaSDir 推荐已在 Turbo0 推荐已在 CodeTrendy 推荐已在 SitePatent 推荐已在 MediaProNet 推荐已在 LaunchBoosts 推荐

© 2026 UnoRouter。保留所有权利。

登录