模型价格
模型价格和计费单位。
图片生成
Images Generations 按实际成功返回的图片数量计费。n 表示本次最多尝试生成的图片数量,当前支持 1-4;如果请求 n=4 但最终只返回 1 张图片,只按 1 张图片计费。
n 非法时请求会直接失败,不调用上游、不写 usage log、不扣费。
文本模型
按 token 计费的模型商品最多使用四类价格分项,实际适用项由当前调用入口对应的模型商品决定:
- 普通输入:未计入缓存读取或缓存创建的输入 token。
- 缓存命中/读取输入:从已有缓存读取的输入 token。
- 缓存创建/写入输入:协议返回缓存创建用量时计价;当前仅适用于 Anthropic Messages。
- 输出:模型生成的输出 token。
控制台展示的模型价格是当前账号实际调用时的权威口径;不同调用入口下的同名 public model id 也可能对应不同商品配置。
真实 usage 优先。按 token 计费的合法 JSON 对象,或已经交付至少一个上游/model chunk 的 stream,在 usage 缺失或无效时,服务端可能使用带标记的保守下界估算。详见 Usage 与计费。
调用前可用余额必须大于 0
账户余额扣除在途请求预留金额后的可用余额必须大于 0。一次调用结算后账户余额允许变成负数,但可用余额为 0 或负数时不能发起下一次模型调用。
最后更新于