研究员|卢杨 北京时间9月2日,Anthropic静悄悄上线了Claude Fable 5.1和Mythos 5.1。 毫无疑问,这又是一次世界级模型的亮相:8项公开基准测试全部第一,缓存读取价格从每百万token 1美元直降到0.25美元、降幅75%,典型工作负载总成本降低约25%、高度智能体化任务最高省45%:单看这些,这不过一次顶级模型的常规迭代:更强、更快、更便宜。AI圈每月都在发生这种事。 但我们要说的,藏在不起眼的角落里: 01 反蒸馏机制,正式落地 Anthropic给“思维链”上了把锁。 从今天起,新注册的API账号不能再在多轮对话里手动篡改Claude的上下文、同时保留它的推理过程。每个思维链区块都被打上了数字签名,对话前缀有任何改动:哪怕一句系统提示词、一个工具、一条历史消息,签名就失效。API要么报400错误,要么静默丢弃被篡改的区块。 巧合的是,一个月前,张一鸣在字节内部说了一句话:字节不做蒸馏,即使短期落后。当时争议很大。一个月后,Anthropic的反蒸馏落地了。 我们来说说蒸馏是什么。 2015年Hinton提出以来,蒸馏就是AI行业的常规操作:用一个强大的“教师模型”训练一个更小的“学生模型”,让学生花更少的钱获得接近老师的水平。美国公司互相用,行业常态,心照不宣。 但Anthropic这次高调地用技术手段把它堵上了。他们给出的理由是“因为蒸馏能力随后可以在没有充分保障的情况下释放。”此前Anthropic已多次公开指控外来公司进行“工业级蒸馏攻击”,这次上技术锁,也算是把之前的口水仗落到了实处。 反蒸馏最核心的就一条:思维链不能碰了。 思维链为什么关键?因为它是推理过程。最终输出是答案,思维链是解题步骤。蒸馏最有效的方式,就是拿这些“解题步骤”去训练小模型。 Anthropic给每个思维链区块都加了数字签名。对话前缀有任何改动,签名就失效。处理方式有两种:默认返回400错误拒绝请求;或者静默丢弃被篡改的区块,请求照常执行,丢弃部分不计费。 这是一把逐级收紧的锁。目前只针对8月31日后注册的新账户,但Anthropic已放话:未来所有新模型都会强制执行。 有些操作是安全的:在对话末尾追加新消息、移除开头的思维链区块、改max_tokens这类参数、服务端压缩上下文,这些不会触发校验。但文档里特别提醒:如果你维护的工具让用户用自己的API密钥调用,新注册用户会更早撞上校验,最好提前测试。 也就是说,如果用Claude Code或Claude.ai这些官方产品,什么都不用改。直接调API的话,官方建议把messages数组严格当“只追加”来用。 这把锁落下的时机,也印证了8月初张一鸣的判断。 02 成绩单:8项第一,断层式领先 聊完反蒸馏,再来看看Anthropic这次到底发布的产品性能如何。 在Anthropic公布的8项评测中 Fable 5.1依旧是碾压级的存在。Fable 5.1在Terminal-Bench-Science 0.1(智能体科研基准)上拿下52.6%。作为对比,上一代Fable 5只有24.7%,Claude Opus 5为29.0%,GPT-5.6 Sol只有22.4%:新模型是它们的两倍多。 在Terminal-Bench 4.0(智能体编程测试)上,Fable 5.1达到55.8%,Mythos 5.1更是飙到60.9%。上一代Fable 5仅为42.0%,GPT-5.6 Sol为37.3%。 CursorBench 3.2.0上,Fable 5.1以73.4%刷新内部纪录。AutomationBench(商业工作流)从上一代的17.1%跃升至31.4%,几乎翻倍。在OSWorld 2.0(计算机使用基准)上,Fable 5.1达到77.9%(宽松标准)和41.7%(严格标准)。GDPval-AA v2(知识工作基准)拿下1853分,同样领先Fable 5的1723分和Opus 5的1824分。Humanity's Last Exam(多学科推理)无工具模式下60.9%,启用工具后提升至65.0%。 还有一个容易被忽略的细节:把Fable 5.1的推理程度调到“低”或“中”,表现已经达到甚至超过老版Fable 5开到最高推理程度的效果。 价格方面,输入输出价格与Fable 5保持一致(输入10美元、输出50美元每百万token),但缓存读取从1美元降到0.25美元,降幅75%。为什么降这个?因为智能体任务里缓存读取占了成本大头。Anthropic算了一笔账:普通工作负载总成本降25%,重度Agent任务最多省45%。对于那些需要频繁读写上下文的复杂Agent应用,这意味着成本结构的大幅优化。 跑分之外,Anthropic还展示了三个让人无法忽视的充满“科研色彩”的实战案