190以上の無料AIモデルを1つのエンドポイントに集約しました
18の無料プロバイダーをUnoRouterに接続しました。190以上の無料モデル行、1つのOpenAI-compatibleエンドポイント、$0 per token。これらには当社が引き上げられない上流の制限があり、さらに共有プールを公平に保つために当社が加える1分あたり1回という軽い上限もあります。ここに正直な説明を記します。
UnoRouterは多数の上流プロバイダーの無料枠を集約し、キー1つの背後に本物の無料枠を持つ190超のモデルとして提供します。無料モデルはそれぞれユーザーごとに毎分約1リクエストまで使え、上限に達すると Retry-After ヘッダー付きの HTTP 429 が返り、枯渇したプールは全プロバイダーがビジーである旨の明示的なエラーを返して自動的に回復します。有料モデルは $1 からの従量課金です。
無料LLMの世界は実在しますが、散在しています。Groq、Gemini、Cloudflare、NVIDIA、SiliconFlowをはじめ十数社が、それぞれ本物の処理能力を無料で提供していますが、十数通りの登録ページ、十数通りのキー形式、十数通りの互換性のないAPIの向こう側にあります。当社は見つけられる限りの正規かつ恒久無料のプロバイダーをすべて発見し、テストし、UnoRouterに統合しました。その結果、18プロバイダーからの190以上の無料モデル行が、1つのOpenAI-compatibleエンドポイントと1つのキーの背後にまとまりました。
追加したもの
18の無料プロバイダーを1つずつ挙げると、Groq、Gemini、Cerebras、SambaNova、Mistral、Cloudflare Workers AI(2アカウント)、GitHub Models、Z.ai、OVHcloud、AI Horde、Pollinations、Cohere、Jina、NVIDIA NIM(完全なオープンカタログ:Nemotron、Llama、Qwen、gpt-oss、DeepSeekほか)、SiliconFlow(DeepSeek-V4、GLM-5.1、Qwen3.5/3.6、Kimi-K2.6、MiniMax-M3)、HuggingFaceルーター、そしてLLM7です。これで190以上の無料モデル行になります。Llama、gpt-oss、Qwen、Mistral、GLM、Nemotron、DeepSeekほかに加え、無料の埋め込み・画像・音声モデルも含みます。いずれも公開前にHTTP、ストリーミング、ツール呼び出しをエンドツーエンドで検証しており、有料モデルに対して実施するのと同じ真正性チェックとハーネスチェックを行います。
無料には理由がある
これらのモデルは本当に無料であり、まさにそれゆえに制限があります。各上流はそれぞれ独自の制限を課します。1分あたりのリクエスト数、1日のトークン割り当て、Cloudflareのニューロン予算、ボランティアキューでの優先度などです。上限に達すると、そのプロバイダーはリセットされるまで429を返します。今朝は使えた無料キーが、午後には枯渇していることもあります。無料枠はベストエフォートのスループットであり、保証ではありません。ワークロードに予測可能なレイテンシと不意の429がないことが必要なら、有料モデルを使ってください。
当社独自のレート制限と、それがある理由
上流の上限に加えて、当社は独自の小さな制限を設けています。ユーザーごと、無料モデルごとに1分あたり1リクエストです。これは意図的なものです。1つの無料モデルは多くの場合、全員合わせて1日およそ100万トークンという単一の共有上流プールであり、上限がなければ一握りのヘビーユーザーが数分でそれを使い果たし、他の全員には何も残りません。モデルごとに1分1回という制限は、プールを生かし続けてコミュニティ全体に行き渡らせます。また1つのモデルを叩き続けるのではなく、多数の無料モデルにトラフィックを分散できます。当社の上限に達すると、あとどれだけ待てばよいかを正確に示すRetry-Afterヘッダー付きのHTTP 429が返されます。これは上流の429や下記の503とは別物です。特定のモデルでより高いスループットが必要なら、この制限が適用されないその有料枠を使ってください。
そもそもなぜ集約するのか
そうしなければ18個のアカウントが必要になるからです。各プロバイダーには独自の登録手順、独自のキー形式、独自のベースURL、そして独自のクセがあります。Z.aiはZhipu V4のパスを話し、CloudflareはアカウントIDをURLに載せ、AI Hordeは匿名キーを求め、GitHubはトークンのスコープでモデルをゲートします。私たちはそのすべてを吸収し、あなたが他のすべてを呼び出すのと同じやり方で呼び出せるようにしました。1つのOpenAI-compatibleエンドポイント、1つのキー、そしてモデル名です。私たちが自らに課している正直なルールは、プロバイダーごとに本物のアカウントを1つだけ、上限はそのまま受け入れ、何も水増しせず、何もプールしないことです。私たちは無料枠を贈り物として提供しているのであって、誰か他人の割り当ての転売ではありません。
どうやって制限を和らげるか
これらのモデルの多くは、複数の無料プロバイダーによって提供されています。Llama 3.3 70Bだけでも7社で動いています。複数のプロバイダーが同じモデルを提供する場合、当社はそれらを1つの公開名にまとめ、自動的にフェイルオーバーします。ある上流が429を返すか無反応になると、そのモデルを提供する次の正常なプロバイダーがリクエストを引き継ぎます。これは当社が実際に制御できる唯一のレバーです。あるモデルのすべてのプロバイダーが一時的にレート制限を受けている場合、リクエストは明示的な「all providers busy(全プロバイダーが混雑中)」というメッセージ付きのHTTP 503を返し(404でも「model not found(モデルが見つかりません)」でもありません)、チャネルは当社のヘルスcronによって数分以内に再テストされ再有効化されます。こうして、複数ソースの無料モデルは、そのいずれかのプロバイダーが枯渇した後もずっと応答し続けます。単一ソースの無料モデルにはフォールバックがないため、唯一の上流が尽きると停止します。
私たちがやらなかったこと
私たちは、OpenAIやClaudeのフラッグシップを許可なく再提供するリバースプロキシは追加しませんでした。トークンが譲渡不可な個人キーのアグリゲーターや、他人のキーを水増しして使い回すプール・オブ・プールのサービスも取り込みませんでした。そうしたものは存在し、魅力的にも映りますが、まさにこのゲートウェイが置き換えようとしているグレーマーケットの混乱そのものです。リストにあるすべてのプロバイダーは、自らの規約のもとで意図的に無料枠を提供しています。その基準を通過できなかったソースは、ここにはありません。
試してみる
190以上のすべての無料モデルが、1つのOpenAI-compatibleエンドポイントの背後で稼働しています。APIキーを取得するか、モデルカタログを閲覧して無料で絞り込んでください。429や503が出たときに、自分がどの枠にいるかだけは忘れないでください。
よくある質問
UnoRouterには無料モデルがいくつありますか?
200+のモデルカタログのうち、常時190を超えるモデルが無料です。上流の無料プールの枯渇と回復に応じて正確な構成は変わり、最新のリストは unorouter.com/models にあります。
無料枠のレート制限はどうなっていますか?
ユーザーごと、モデルごとに毎分約1リクエストです。上限では Retry-After ヘッダー付きの HTTP 429 が返ります。190+の無料モデルがあるので、実際には待つよりモデルを切り替えるのが得策です。
無料モデルにクレジットカードは必要ですか?
いいえ。DiscordかGitHubでサインアップし、キーを作成して、:free サフィックスの付いたモデルを使うだけです。1回限りの $1 のDiscord認証ボーナスは有料モデルに使えます。
SpicyChatは設定ゼロのRPサイトで、そのメモリとコンテキストは有料ティアの裏に閉じ込められています。UnoRouterは手軽な入り口を保ちつつ、あなたが選ぶ200+のモデル、奥深いロアブック、そしてコーディングエージェントも動かすキーを加えます。
AgnaiはオープンソースのRPフロントエンドで、その際立った特長は本物のマルチプレイヤーです。複数の人間と複数のボットが1つのチャットに。UnoRouterはシングルユーザーのRPの深さをホスト型で持ち、キーがアカウントとなり、コーディングエージェントも動かします。
Open WebUI は自分で動かしてキーを設定する、自己ホスト型で Ollama を軸にしたチャット UI です。UnoRouter は 1 つのキーで 200 以上のホスト型モデルを、インフラなしで提供し、本物のキャラクタークライアントも備え、キーはコードも書けます。