編程进阶约 8 分钟
Agent 一跑,Token 为什么比聊天贵
工具调用会把结果再喂回上下文。一次「帮我改仓库」往往是十几轮输入叠加,不是一条回复的价钱。
正文為 SEO 深度以中文為主;上方要點已本地化。可用語言切換與深鏈進行全球導航。

聊天账单和 Agent 账单不是一种形状
聊天:用户一句 + 模型一句。输入大致稳定,输出看回复长短。
Agent:读文件、跑命令、看报错、再读、再改。每一轮都会把上一轮工具结果塞进下一轮输入。输入随步数近似线性涨,有时比输出更贵。
所以「这个模型输出 $50/M,我一天聊不了几个字」没有意义。要问:一天多少步、每步带多少上下文。
把一次任务拆成可估的量
以「修一个类型错误」为例(示意,不是报价):
| 步 | 典型动作 | 主要吃哪一列 |
|---|---|---|
| 1 | 读报错、打开文件 | 输入(仓库片段) |
| 2 | 再读相关文件 | 输入叠加 |
| 3 | 打补丁 | 输出(diff) |
| 4 | 跑测试、读失败日志 | 输入(日志往往很长) |
| 5 | 再补丁 | 输出 |
五步之后,输入可能已经是第一步的数倍。长仓库 + 不开缓存,账单会很难看。
能做的控制(不涉及破解)
- 限制每步读入的文件长度,先 grep 再打开。
- 能缓存的前缀就缓存;对照官方缓存列,见 /guides/read-official-api-columns。
- 旗舰只放在「决策步」,检索和格式化用小模型。本站不替你点名必须用哪一只——看 /official-api 和 /ladder。
- 用 /tools/token-cost 把「估计步数 × 每步输入/输出」算成一次任务,而不是算一条消息。
中转场景多一条
中转按官方价 × 综合倍率。Agent 步数放大的是有效单价,不是只放大官方输出列。先探测再谈倍率:/guides/probe-before-topup。
风险与边界
本页不教绕过配额、不教改客户端、不保管 Key。估算不是账单。对账看上游 usage。
下一步
适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。