平台指南
模型与定价
:free 后缀的含义、用量如何计价,以及模型为何有时会消失。
免费模型带有 :free 后缀,例如 gpt-oss-120b:free
:free 模型只路由到免费的上游提供商,绝不触及你的余额。不带后缀的同一基础名称是付费版本:稳定、无上限、按令牌计费。两者可以并存,因此从免费切换到付费只是改一个字符串。
免费模型有两层限制。上游提供商会限制自己的免费资源池,在此之上我们还会按用户、按模型施加自己的上限,避免个别重度用户耗尽共享资源池。高峰时段请预期会收到 429 响应,需要可靠性时请使用付费模型。
确切的上限、响应头和重试指引记录在: 错误与速率限制
每个模型经由一个或多个提供方分组路由,各有各的价格;模型页的 Group Pricing 表格列出全部分组。高可用性会带来自动折扣,切换到另一分组也可能改变实际价格。

要将模型锁定到特定分组及其费率,请参阅: 分组固定
大多数模型按令牌计费,输入和输出价格分开。少数模型(大多为图像和视频)改为按次收取固定费用。你在模型页面看到的就是你要支付的:没有订阅,没有隐藏费用,你的余额只是随每次请求而减少。
定价页面提供当前的充值选项;每个模型页面都会显示实时的按令牌价格。
对于支持提示词缓存的模型(Claude 等),重复的提示词前缀按较低的缓存输入费率计费,而写入一条新的缓存条目则比普通输入令牌略贵(约 1.25 倍)。
缓存是自动的。具有长而稳定的系统提示词的工作负载(代理、RP 预设)获益最多,无需任何配置。
