20131 20131
EN

你的 agent 不知道自己在花多少钱。谁在看着?

2026-10-08 — 在一个失败测试上反复打转的 coding agent,感受不到账单。它会重试、拉起一个子助手、再重试。每一步在局部都合理,总和不合理。钱在别处:在你供应商的计费面上,而 agent 的进程只看得到发出去请求。

为什么支出上限对 agent 是难题

今天能诚实度量什么

上限要能熬过它自己的断供

每个控制都依赖某个会失效的东西。如果你的支出上限需要去问一个远程端点,而这次调用超时了、被限流了、或返回了垃圾,就有两种偷懒的答案:全部放行,或全部拦死。两个都错。我们对着设计的合同是:外部情报失效时,运行时回退到确定性的本地策略,按动作的可逆性与影响面分级处理——绝不二值化。一个会随自己的网络调用一起消失的支出上限,不是上限,是一条带延迟的建议。

还不存在的那部分

观察告诉你发生了什么。一个同时跑好几个 agent 的团队,要的是一个能把下一个动作扣住、等人点头再放行,并且在所有人机器上保持一个视图的上限。我们正在决定要不要把它做成 Team plan。它今天不存在,没有定价,这篇博客里没有任何话跑到代码前面。

如果你在跑 coding agent,并且「账单失控」是你宁愿提前拦住、而不是事后重建的那类事故——加入<a href="/zh-cn/early-access/">抢先体验等候名单</a>,或写信到 <a href="mailto:[email protected]">[email protected]</a>,描述你真会用的上限形状。每封邮件都有真人读。如果没有人提这个需求,它就保持不建——这就是这一页背后的诚实实验。