看到 Anthropic 那条公告,我第一反应不是「要贵了」,是去翻自己那条每天自动跑的日报流水线。里面到处是重试。刚才,重试变贵了。
AI 的成本从来不是单价决定的,是「什么算一次计费」决定的。
9 月 24 日起,Claude 在给出回复之前就被安全分类器拦下的请求恢复计费,范围只有三类:生物学、蒸馏攻击、前沿大模型开发(一手来源:Anthropic 官方账号 @claudedevs;官方称分类器误报率低于 0.1%、99.7% 的账号没触发过,未独立复现)。
我做过二十年架构,算成本一直用一个笨公式:单价 × 输出量 × 重试次数。这个公式我讲了不止一次,因为它能挡住大多数自欺欺人——只看单价一定算错。
但今天这个公式里有一项的价格变了。以前「被拒」在我的模型里是零成本的:请求没走完,不产生输出,自然不产生费用。很多团队的预算护栏、红队探测、评测跑批,都悄悄建立在这条假设上——反正被拦下来不花钱,多试几次没关系。
现在它有了价格。
官方给出的两个数字容易被混着读:99.7% 的账号没碰上,和分类器误报率低于 0.1%。前者说的是面,后者说的是率,谁都不能保证某一次具体拦截是对的。而公告里没写误拦了怎么退钱。
一个计费规则改了却不给冲正路径,这不是定价问题,是争议处理机制的缺位。
供应商改的不是价格,是分母。而分母是在你没有改一行代码的情况下变的。
同一周里还有两件事,方向完全相反。
阿里在云栖把「精度每降一档,一度电换来的 Token 基本翻倍」当成芯片卖点(真武 V900,原生 FP8/FP4,厂商自报未独立复现);微软给 Copilot 企业用户做了成本可视化,让员工直接看到自己花掉多少(路透社 9 月 25 日)。
一个把成本口径往硬件里沉,一个把成本口径摊给用户看,Anthropic 则把分母往外扩。三件事不是巧合。
Anthropic 那边给的理由也实在:最近几周有人协同着试它的护栏,而试探本身一直是免费的。
护栏如果可以无限次免费试探,那它就不是护栏,是说明书。
我那条日报流水线也一样。它每天会因为各种策略拒掉一批内容,我从来没把这些算进成本,因为它们没产出东西。往后得算了。
当所有人都开始讲「每任务成本」,争的就不再是单价,而是「什么算一次计费」的定义权。
这件事我在虚拟电厂的项目里见过一模一样的版本。多方协同的系统里,真正难谈的从来不是电价,是结算口径:调峰响应算不算、响应时间从哪一秒起算、指令下发了但没执行算不算。口径改一次,所有人的账本重写一遍。AI 正在走到同一个位置上。
所以我的建议很具体:今年成本看板上唯一必须新增的一列,是「被拒绝的调用数」。 它要和成功调用分开统计,要有独立的告警阈值。理由不是它会很贵,而是它涨的时候你目前看不到。
顺手提醒一件小事:Codex 本周的版本里静默删掉了 gpt-5.6-sol 的 ultrafast 档位,没有公告。
你依赖的东西消失的时候,你不一定会收到任何通知。