一个请求被安全系统拦下,Claude根本没开口回答,账单却照样生成。Anthropic宣布,从今天起恢复对这类被拦截请求的计费。 适用范围被压得很窄: 生物学、蒸馏攻击、前沿大模型开发 这三类。官方给出的理由是这些类别的误报率足够低,换句话说,被拦下来的大概率不是误伤。 这条规则真正指向的不是普通用户,而是那些反复试探边界的人。 拦截不等于免费 过去,请求在Claude回应之前就被安全机制挡下,这部分调用不计费。对正常用户来说这是善意,对另一类使用者来说,这是一条零成本通道。 你可以不断发送请求,观察哪些被拦、哪些被放行,用返回结果反推模型的判断边界。每一次试探都不花钱,试探的次数就可以无限叠加。 Anthropic在说明中提到,最近几周观察到了一些针对其系统的 协同攻击 。恢复计费,等于把这条通道的成本重新抬起来。 计费本身不阻止攻击,但它让攻击变得可计量。请求量、账号、时间分布,这些数据在免费时是噪音,在收费后是线索。 为什么是这三个类别 三类场景被单独拎出来,逻辑并不相同。 生物学 :涉及高风险知识的边界,误报率低意味着拦截判断相对可靠。 蒸馏攻击 :试图通过大量请求提取模型能力,本身就是一种系统性行为。 前沿大模型开发 :竞争对手或研究方借调用获取训练信号,同样带有明确目的性。 共同点是:这些请求的发起者通常不是来聊天的。他们有成规模的调用需求,也有持续试探的动机。对这类流量收费,误伤正常用户的空间很小。 Anthropic强调只在这三类低误报率场景下恢复计费,其余被拦截的请求如何处理,官方没有展开。 正方:这是必要的成本门槛 支持这一做法的观点很直接。安全机制本身要消耗算力,拦截判断需要跑分类器、做推理,这些都不是免费的。当拦截量被恶意流量推高,成本由平台单方面承担,等于变相补贴攻击者。 恢复计费后,攻击者每试探一次都要付出代价,规模化试探的性价比下降。同时,平台获得了区分正常误伤和恶意试探的数据维度——一个账号被拦几百次还继续发,和偶尔撞上一次,行为模式完全不同。 反方:误伤用户要为拦截买单 反对的声音同样成立。安全系统再准也有误判,低误报率不等于零误报。一个做生物学研究的正常用户,可能因为提问方式触发了拦截,结果既没拿到回答,还被扣了钱。 更麻烦的是申诉成本。用户很难判断自己为什么被拦,也很难证明这次拦截是误伤。计费一旦发生,举证责任就落到了用户这边。 还有一种担忧:把计费和拦截绑定,会不会让平台在边界判断上更倾向于"先拦了再说"?毕竟拦下来也有收入。 我的判断 这件事的关键不在收费本身,而在 低误报率 这个前提能不能守住。Anthropic把范围限定在三个类别,说明它清楚误伤风险,也清楚一旦误伤面扩大,这套机制会迅速变成用户信任问题。 从防御角度看,让攻击有成本是合理动作。协同攻击的特征就是高频、批量、低成本,抬高单次成本能直接压缩攻击规模。但计费只能提高门槛,不能替代识别——真正拦住攻击的仍然是安全系统本身,收费只是让攻击者不再免费试错。 对普通开发者来说,这条规则的实际影响接近于零。除非你的调用集中在生物学、蒸馏或前沿模型开发这几个方向,否则大概率不会碰到。真正需要留意的是那些做模型评测、能力对比的团队,他们的调用模式可能天然接近被拦截的特征。 Anthropic没有说明这三类之外的拦截请求是否也会恢复计费,也没有给出误伤申诉的具体路径。这两点,决定了这套机制最终是防御工具,还是又一个让用户困惑的收费项。 特别