AnyToken 文档
模型广场 控制台 ↗
13B / TOKEN BILLING

大模型 API Token 计费说明

大模型调用通常分别统计输入、输出和缓存 Token。最终扣费还会受到模型单价、分组倍率和具体计费单位影响,不能只用总 Token 数推算。

通用计算口径
基础费用 = 输入 Token × 输入单价
         + 输出 Token × 输出单价
         + 缓存写入 Token × 缓存写入单价
         + 缓存读取 Token × 缓存读取单价

最终费用 = 基础费用 × 当前分组倍率
输入 Token

系统提示、对话历史、用户输入和工具定义等发送给模型的内容。

输出 Token

模型实际生成的文本、推理或工具调用内容,单价可能与输入不同。

缓存 Token

只有模型和渠道支持缓存时才会出现;写入与命中读取可能使用不同单价。

分组倍率

由当前 API Key 所属分组和页面实时规则决定,变化后只影响对应结算周期或请求。

不要写死价格模型价格和可用分组可能调整。本文只解释计算方法;调用前查看模型广场,调用后以使用记录中的 Token 和实际费用核对。
已复制