13B / TOKEN BILLING
大模型 API Token 计费说明
大模型调用通常分别统计输入、输出和缓存 Token。最终扣费还会受到模型单价、分组倍率和具体计费单位影响,不能只用总 Token 数推算。
通用计算口径
基础费用 = 输入 Token × 输入单价
+ 输出 Token × 输出单价
+ 缓存写入 Token × 缓存写入单价
+ 缓存读取 Token × 缓存读取单价
最终费用 = 基础费用 × 当前分组倍率
输入 Token
系统提示、对话历史、用户输入和工具定义等发送给模型的内容。
输出 Token
模型实际生成的文本、推理或工具调用内容,单价可能与输入不同。
缓存 Token
只有模型和渠道支持缓存时才会出现;写入与命中读取可能使用不同单价。
分组倍率
由当前 API Key 所属分组和页面实时规则决定,变化后只影响对应结算周期或请求。
不要写死价格模型价格和可用分组可能调整。本文只解释计算方法;调用前查看模型广场,调用后以使用记录中的 Token 和实际费用核对。