UNOROUTER
UNOROUTER
Mô hìnhXếp hạngBảng giáTrò chuyện
  • Trình kiểm tra
  • Tài liệu
Đăng nhập
Quay lại mọi bài viết
Đã đăng
Sản phẩm

Chúng tôi đã gộp hơn 190 mô hình AI miễn phí vào một endpoint duy nhất

Chúng tôi đã kết nối 18 nhà cung cấp miễn phí vào UnoRouter: 190+ dòng mô hình miễn phí, một endpoint OpenAI-compatible, $0 per token. Chúng mang theo giới hạn từ nguồn thượng nguồn mà chúng tôi không thể nâng, cộng thêm một mức trần nhẹ 1 lần mỗi phút do chúng tôi thêm vào để giữ cho các nhóm dùng chung được công bằng. Đây là phiên bản trung thực.

15 tháng 6, 2026·3 phút đọc·Bởi Đội ngũ UnoRouter
thông báosản phẩm

UnoRouter gom các suất miễn phí từ nhiều nhà cung cấp thượng nguồn thành hơn 190 mô hình có bậc miễn phí thực sự sau một khóa duy nhất. Mỗi mô hình miễn phí cho phép khoảng 1 yêu cầu mỗi phút cho mỗi người dùng; chạm giới hạn sẽ trả về HTTP 429 kèm header Retry-After, còn các pool cạn sẽ trả về lỗi rõ ràng rằng tất cả nhà cung cấp đang bận và tự phục hồi. Mô hình trả phí tính theo mức dùng từ $1.

Bối cảnh LLM miễn phí là có thật nhưng phân tán: Groq, Gemini, Cloudflare, NVIDIA, SiliconFlow và cả chục nhà cung cấp khác, mỗi bên đều cho đi năng lực thực sự, ẩn sau cả chục trang đăng ký, cả chục định dạng khóa và cả chục API không tương thích. Chúng tôi đã tìm ra, kiểm thử và hợp nhất vào UnoRouter mọi nhà cung cấp hợp pháp, miễn phí vĩnh viễn mà chúng tôi tìm được. Kết quả: 190+ dòng mô hình miễn phí từ 18 nhà cung cấp, sau một endpoint OpenAI-compatible duy nhất và một khóa duy nhất.

Những gì chúng tôi đã thêm

Mười tám nhà cung cấp miễn phí, lần lượt từng bên: Groq, Gemini, Cerebras, SambaNova, Mistral, Cloudflare Workers AI (hai tài khoản), GitHub Models, Z.ai, OVHcloud, AI Horde, Pollinations, Cohere, Jina, NVIDIA NIM (toàn bộ danh mục mở: Nemotron, Llama, Qwen, gpt-oss, DeepSeek và nhiều hơn nữa), SiliconFlow (DeepSeek-V4, GLM-5.1, Qwen3.5/3.6, Kimi-K2.6, MiniMax-M3), bộ định tuyến HuggingFace và LLM7. Tổng cộng là 190+ dòng mô hình miễn phí: Llama, gpt-oss, Qwen, Mistral, GLM, Nemotron, DeepSeek và nhiều hơn nữa, cùng các mô hình embedding, hình ảnh và âm thanh miễn phí. Mỗi mô hình đều được kiểm tra đầu cuối về HTTP, streaming và gọi công cụ trước khi đưa vào hoạt động, cùng những kiểm tra tính xác thực và kiểm tra khung thử nghiệm mà chúng tôi áp dụng cho các mô hình trả phí.

Miễn phí là có lý do

Những mô hình này thực sự miễn phí, và chính vì thế chúng có giới hạn. Mỗi nguồn thượng nguồn tự áp đặt giới hạn riêng: số yêu cầu mỗi phút, hạn mức token hằng ngày, ngân sách neuron của Cloudflare, mức ưu tiên trong hàng đợi tình nguyện. Chạm trần thì nhà cung cấp đó trả về 429 cho tới khi được đặt lại. Một khóa miễn phí còn hoạt động sáng nay có thể đã cạn kiệt vào buổi chiều. Bậc miễn phí là thông lượng ở mức nỗ lực tối đa, không phải một bảo đảm. Nếu tải công việc của bạn cần độ trễ có thể dự đoán và không có 429 bất ngờ, hãy dùng một mô hình trả phí.

Giới hạn tốc độ của riêng chúng tôi, và vì sao nó tồn tại

Bên trên các mức trần thượng nguồn, chúng tôi thêm một giới hạn nhỏ của riêng mình: một yêu cầu mỗi phút cho mỗi mô hình miễn phí, cho mỗi người dùng. Đây là có chủ đích. Một mô hình miễn phí đơn lẻ thường là một nhóm thượng nguồn dùng chung duy nhất, có lẽ khoảng một triệu token mỗi ngày cho tất cả mọi người cộng lại, nên nếu không có mức trần thì một nhúm người dùng nặng sẽ vét cạn nó trong vài phút và những người còn lại chẳng thấy gì. Một yêu cầu mỗi phút cho mỗi mô hình giữ cho nhóm sống và trải đều khắp cộng đồng, và bạn có thể dàn lưu lượng ra nhiều mô hình miễn phí thay vì dồn dập vào một mô hình. Khi bạn chạm trần của chúng tôi, bạn nhận được một HTTP 429 kèm header Retry-After cho biết chính xác cần chờ bao lâu. Điều này tách biệt với 429 thượng nguồn và với 503 bên dưới. Nếu bạn muốn thông lượng cao hơn trên một mô hình cụ thể, hãy dùng bậc trả phí của nó, nơi giới hạn này không áp dụng.

Tại sao phải gom chúng lại làm gì

Vì lựa chọn còn lại là mười tám tài khoản. Mỗi nhà cung cấp có trang đăng ký riêng, định dạng key riêng, base URL riêng và những điểm oái oăm riêng: Z.ai nói theo đường dẫn Zhipu V4, Cloudflare mang account id trong URL, AI Horde muốn một key ẩn danh, GitHub khóa các mô hình sau phạm vi của token. Chúng tôi gánh hết tất cả những thứ đó để bạn gọi chúng theo đúng cách bạn gọi mọi thứ khác: một endpoint OpenAI-compatible, một key, một tên mô hình. Nguyên tắc thành thật mà chúng tôi tự ràng buộc: một tài khoản thật cho mỗi nhà cung cấp, chấp nhận giới hạn, không gom gặt, không gộp chung. Chúng tôi mở ra gói miễn phí như một món quà, không phải bán lại hạn ngạch của người khác.

Cách chúng tôi làm dịu các giới hạn

Nhiều mô hình trong số này được phục vụ bởi hơn một nhà cung cấp miễn phí. Riêng Llama 3.3 70B chạy trên bảy nhà cung cấp. Khi nhiều nhà cung cấp cùng cung cấp một mô hình, chúng tôi gộp chúng dưới một tên công bố duy nhất và tự động chuyển đổi dự phòng: nếu một nguồn thượng nguồn trả về 429 hoặc im lặng, nhà cung cấp khỏe mạnh kế tiếp phục vụ mô hình đó sẽ nhận yêu cầu. Đó là đòn bẩy duy nhất mà chúng tôi thực sự kiểm soát. Nếu tại một thời điểm mọi nhà cung cấp của một mô hình đều đang bị giới hạn tốc độ, yêu cầu sẽ trả về một HTTP 503 với thông báo rõ ràng "tất cả nhà cung cấp đều bận" (không phải 404, cũng không phải "không tìm thấy mô hình"), và kênh được kiểm tra lại và bật lại trong vài phút bởi cron kiểm tra sức khỏe của chúng tôi. Nhờ vậy, một mô hình miễn phí đa nguồn vẫn tiếp tục trả lời rất lâu sau khi bất kỳ nhà cung cấp nào của nó cạn kiệt. Mô hình miễn phí một nguồn không có phương án dự phòng, nên chúng đình trệ khi nguồn thượng nguồn duy nhất của chúng đã cạn.

Những gì chúng tôi đã không làm

Chúng tôi không thêm reverse proxy phục vụ lại các mô hình hàng đầu của OpenAI hay Claude mà không có phép. Chúng tôi không kéo vào các dịch vụ gom key cá nhân với token không thể chuyển nhượng, hay những dịch vụ pool-of-pools chuyên gom gặt và xoay vòng key của người khác. Chúng tồn tại, chúng đầy cám dỗ, và chúng chính là mớ chợ đen lộn xộn mà gateway này sinh ra để thay thế. Mỗi nhà cung cấp trong danh sách đều cho đi gói miễn phí của mình một cách có chủ đích, theo điều khoản riêng của họ. Nếu một nguồn không vượt qua được ngưỡng đó, nó không có mặt ở đây.

Dùng thử

Toàn bộ hơn 190 mô hình miễn phí đang hoạt động sau một endpoint OpenAI-compatible duy nhất. Lấy một khóa API hoặc duyệt danh mục mô hình và lọc theo miễn phí. Chỉ cần nhớ bạn đang ở bậc nào khi một 429 hoặc 503 xuất hiện.

Câu hỏi thường gặp

UnoRouter có bao nhiêu mô hình miễn phí?

Hơn 190 tại bất kỳ thời điểm nào, trong danh mục 200+ mô hình. Tập chính xác thay đổi khi các pool miễn phí thượng nguồn cạn rồi phục hồi, và danh sách trực tiếp có tại unorouter.com/models.

Giới hạn tốc độ của bậc miễn phí là gì?

Khoảng 1 yêu cầu mỗi phút cho mỗi mô hình với mỗi người dùng. Chạm giới hạn sẽ trả về HTTP 429 kèm header Retry-After. Với 190+ mô hình miễn phí, cách thực tế là xoay vòng mô hình thay vì chờ.

Tôi có cần thẻ tín dụng cho các mô hình miễn phí không?

Không. Đăng ký bằng Discord hoặc GitHub, tạo một khóa và dùng bất kỳ mô hình nào có hậu tố :free. Khoản thưởng xác minh Discord một lần trị giá $1 có thể dùng cho các mô hình trả phí.

Bài trước
Tìm UnoRouter ở đâu: các mục liệt kê trong thư mục
Bài tiếp theo
UnoRouter so với LiteLLM: cổng được lưu trữ hay proxy tự lưu trữ
Bài viết liên quan
Sản phẩm·28 thg 7, 2026·1 phút đọc
UnoRouter so với SpicyChat: con đường dễ dàng, kèm độ sâu, model, và code

SpicyChat là một trang nhập vai không cần thiết lập với model cố định. UnoRouter giữ sự dễ dàng nhưng thêm độ sâu lorebook, hơn 200 model bạn tự chọn, và một key cũng chạy các coding agent.

Sản phẩm·25 thg 7, 2026·1 phút đọc
UnoRouter so với Agnai: cùng độ sâu nhập vai, được host sẵn, trên một key

Agnai là một giao diện nhập vai mã nguồn mở, đa engine, với memory book và kịch bản, theo kiểu BYOK. UnoRouter có cùng độ sâu đó nhưng được host sẵn, nơi key chính là tài khoản và cũng chạy các coding agent.

Sản phẩm·23 thg 7, 2026·1 phút đọc
UnoRouter so với Open WebUI: hơn 200 model host sẵn, không Ollama, kèm chat nhân vật

Open WebUI là một giao diện chat ưu tiên Ollama, tự host, bạn tự vận hành và tự nạp key. UnoRouter là hơn 200 model host sẵn trên một key, không hạ tầng, kèm một chat nhân vật thực thụ, và key cũng code được.

Trên trang này

Những gì chúng tôi đã thêm
Miễn phí là có lý do
Giới hạn tốc độ của riêng chúng tôi, và vì sao nó tồn tại
Tại sao phải gom chúng lại làm gì
Cách chúng tôi làm dịu các giới hạn
Những gì chúng tôi đã không làm
Dùng thử
UNOROUTER

Nền tảng API AI hợp nhất cung cấp quyền truy cập hàng trăm mô hình từ nhiều nhà cung cấp qua một endpoint thông minh duy nhất.

Sản phẩm

  • Mô hình
  • Bảng giá
  • Tài liệu
  • Blog
  • Trạng thái

Pháp lý

  • Điều khoản và điều kiện
  • Chính sách bảo mật
  • Chính sách sử dụng được chấp nhận
  • Chính sách hoàn tiền

Liên hệ

Có câu hỏi hay thắc mắc?

[email protected]
Được giới thiệu trên Startup FameĐã xác minh trên DANG!Được giới thiệu trên Twelve ToolsĐược giới thiệu trên FazierĐược giới thiệu trên Product HuntĐược giới thiệu trên TheSaaSDirĐược giới thiệu trên AI Toolz DirĐược giới thiệu trên Turbo0Được giới thiệu trên CodeTrendyĐược giới thiệu trên SitePatentĐược giới thiệu trên MediaProNetĐược giới thiệu trên LaunchBoosts

© 2026 UnoRouter. Giữ toàn quyền.

Đăng nhập