Agent 的成本单位,正在从 Token 变成一次完成的任务
此前我们在《Agent 开始进入团队账本》中记录过:当 Agent 进入团队级使用,成本、质量、效率和收益也需要被算清楚。本周出现了一个更具体的问题:这本账应该按什么单位来记?JetBrains 的内部评测发现,Fable 5 虽然每 Token 更贵,但在部分复杂任务中通过率更高、执行步骤约少 22%,最终的单任务成本反而更低。
Agent 执行的已经不是一次模型调用,而是一段包含上下文读取、工具调用、代码修改、测试和失败恢复的过程。模型、Thinking Effort、上下文长度、缓存、工具输出和重试次数,都会改变最终成本。价格较低的模型如果需要更多步骤和人工介入,完成任务未必更便宜。
因此,企业对 Agent 的评估口径会逐渐从 Token 和 Credit,走向完成一个经过验证的任务需要多少成本。模型单价仍然重要,但更有意义的指标将是任务成功率、执行步骤、总耗时、验证结果和人工介入次数。只有把消耗和最终交付关联起来,才能判断哪一种 Agent 工作流真正划算。