用 Token 成本工具核一次真实请求,再谈省钱
先拿一条真实 usage(或一次保守估计)丢进成本工具。没有这一次,谈倍率、谈换模型都是空的。

为什么要「核一次」
评论区和群里的「这个模型便宜」通常没有 usage。你自己的请求形状(历史有多长、要不要工具、输出要不要推理)才决定账单。
最小实验
- 用官方或已探测可打的 id,跑你真正在做的那类任务一次。
- 从响应或控制台抄
prompt_tokens/completion_tokens(名称以厂商为准)。 - 填进成本工具,单价用 /official-api 对应行,不要用记忆中的旧价。
- 同一任务改短历史再跑一次,看输入列掉多少。
- 若走中转,再用公示倍率估有效单价,见 /guides/effective-price-without-inventing。
没有 usage 时,用「输入字符/4、输出按你能接受的上限」做保守估计,并在笔记里标明是估计。
示意(Astra 官方三列,不是你的账单):输入 4,000 + 输出 800 token,按 $10 / $50 每百万,约 (4000/10^6×10 + 800/10^6×50 = 0.04+0.04=0.08) 美元一次。Agent 若同样大小跑 20 步且输入叠加,数量级立刻不是「聊一句」。超 272K 输入还要按官方加价,别用短对话的单价外推长仓库。
Agent 任务
按步数估,不要按「一条回复」。/guides/agent-loops-multiply-tokens
和换算器
只在对方文档写明 NewAPI 公式时,才用 /tools/ratio-convert。公式对不上就回到对方账单,不要硬转。
风险与边界
工具输出是估算。折扣、赠金、失败重试、缓存命中都会变。本站不连接你的账号拉账单。
下一步
适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。