计费、用量与限流

文档状态未标注功能状态未标注

页面类型:开始使用 | 读者:想知道一次调用大概花多少钱、怎么查余额和限流额度的开发者 | 预计 3 分钟 本页只讲怎么查,⛔ 讲某个具体模型的计费档位——那些在模型说明页;限流的完整规则见文末链接的对外契约文档。

计费:可能产生费用

调用模型接口可能产生生成费用:请求成功完成后按平台计费规则扣费。查询、下载等只读操作不会重新创建任务,不会因为你多查了几次而多算钱。

停止本地等待(比如客户端超时放弃轮询)不会取消远端已创建的任务,是否扣费按任务最终结果处理。

查余额和用量

这几个查询接口用你登录工作台后的身份鉴权(pk- + 登录态),⛔ 是调模型用的 sk- Key:

GET /api/v1/balance                余额(amount/frozen_amount/currency)
GET /api/v1/balance/transactions   余额流水(充值/扣费/退款等明细,分页)
GET /api/v1/usage/records          调用明细(按调用记录 token 数与花费,可按模型/日期筛选)

usage/records 里每条记录都有 status 字段,三个取值:

取值含义计费影响
confirmed已确认,可对账正常扣费,计入 total_cost
pending异步计费还没落定(视频等异步任务常见,稍后再查会变成 confirmed)暂不计入 total_cost,等落定
served_unbilled已服务 · 未计费——调用真的执行了(token 消耗是真实的),但平台没收到这笔钱不计入 total_cost 汇总,但 token 消耗量仍计入用量统计

⚠ 看到某条记录暂时没扣钱,不代表它一定是"还没确认、等等就好"——served_unbilled 是一个独立的第三态,⛔ 是 pending 的另一种说法,两者的下一步处理不一样,遇到时留意区分。

查限流额度

GET /api/v1/rate-limits/me

返回你此刻实际生效的 rpm(每分钟请求数上限)与 tpm(每分钟 token 消耗上限)——这是动态值,不是写死的常量,不要拿文档里的数字硬编码限速逻辑。超限时收到 429 并带 Retry-After,按它退避重试是安全的,不会因此被限制。

完整规则(含你自己能不能调低/调高额度、多协议共享同一限流桶等细节)见 API参考-调用频率限制。


「开始使用」到这里结束。接下来去「快速开始」挑一条你要做的事(对话 / 图片生成 / 视频生成),实际跑一次调用。

<!-- doc_status: 已发布 feature_status: 已上线 updated: 2026-09-19 -->
计费、用量与限流 · TokenPortal