搜索文档...

开始输入以搜索文档

平台指南

模型与定价

:free 后缀、价格,以及模型为何会消失。

模型页面列出了上下文窗口、按 token 计的价格、端点和能力。每个模型页面都有代码示例。并非所有免费模型都支持工具调用或视觉输入,请查看能力标识。

带价格和折扣徽章的模型目录

排行榜根据社区实测展示哪些免费模型表现更好。状态页跟踪提供商的可用情况。

初次使用?获取密钥并发送第一个请求只需一分钟,请看 快速入门

免费模型带有 :free 后缀,例如 gpt-oss-120b:free

:free 模型只会路由到免费提供商,绝不消耗你的余额。去掉后缀的同名模型是付费版:不设上限,按 token 计费。切换只需改一个字符串。

免费模型有两重限制:提供商自身的上限,以及我们按用户按模型的上限。高峰期出现 429 是正常的。需要稳定时请使用付费模型。

确切的上限、响应头和重试指引记录在: 速率限制与错误

模型会在多个提供商分组之间路由,每个分组单独定价并列在 Group Pricing 中。可用性高会自动获得折扣。发生故障切换时,实际价格可能变化。

模型详情页上的分组价格表

要将模型锁定到特定分组及其费率,请参阅: 分组固定

多数模型按 token 计费,输入和输出分别定价。图像和视频通常按次收取固定费用。模型页面上的价格就是你实际支付的价格。

价格页面列出了充值选项。模型页面显示实时的按 token 价格。

在支持的模型上,重复的提示词前缀会按更低的缓存价计费。写入一次缓存的成本约为普通输入 token 的 1.25 倍。

缓存是自动的。又长又稳定的系统提示词收益最大。

当某个提供商分组被限流或宕机时,请求会切换到下一个分组。只有所有渠道都不可用时,模型才会从目录中消失。

高负载时模型暂时消失属于正常现象。只要有渠道恢复,它几分钟内就会回来。

固定了提供方分组的密钥只在其固定分组内切换,见: 分组固定

想在它回归的那一刻收到提醒,请在这里关注它: 通知