天风修正此前判断:Fable5.1 大幅降价并叠加能力代差迁移,意味着 Opus 层的超额定价权侵蚀已不止于前沿层,Fable 层同样无法独善其身。缓存命中价从 1 美元降至 0.25 美元、长程任务成本逼近 Opus5、能力跃迁集中在 Terminal-Bench-Science 这类长程专业任务,“单纯更聪明"的提价模式正式受双向夹击。

更多缓存折扣:缓存命中价从 1 美元 → 0.25 美元,典型负载 -25%、重度 Agent -45%

缓存价砍至 0.025 倍:Fable5.1 降幅 75%,Sonnet5 同步放弃涨价

  • 核心变化:Fable5.1 缓存命中价格从 1 美元降至 0.25 美元,按基础输入价的 0.025 倍计。
  • 横向对比:其他 Claude 模型仍为 0.1 倍。
  • 整体趋势:此前 Anthropic 已取消 Sonnet5 原定于 9 月 1 日的涨价,前沿层降低缓存价格、中端层放弃涨价,方向一致。

负载成本:典型 -25%,重度 Agent 最高 -45%,特定任务可逼近 Opus5

  • 官方统计:典型负载成本下降约 25%。
  • 重度 Agent 负载:最高下降约 45%。
  • 天风计算:在极度重缓存或 token 效率显著提升的特定任务中,Fable5.1 单任务成本可以逼近甚至低于 Opus5。

修正此前判断:Top1 模型向上定价困难,Fable 层也难独善其身

  • 此前判断:Opus 层的超额定价权被侵蚀。
  • 修正后:Fable5.1 说明 Top1 模型继续向上定价依然困难,Fable 层也无法独善其身。

能力代差转向长程专业任务:Terminal-Bench-Science 24.7% → 52.6%

基准成绩:Terminal-Bench-Science 翻倍超 Opus5 与 GPT-5.6Sol

  • Fable5.1:24.7% → 52.6%。
  • 对照模型:显著超过 Opus5 的 29.0% 和 GPT-5.6Sol 的 22.4%。
  • 本次定位:基础能力涨幅有限,核心提升集中在 Agent 长程任务。

企业工作流能力:26.9% → 31.4%

  • 场景意义:在企业工作流中能力由 Opus5 的 26.9% 提升至 31.4%。

计算生物学长程任务:端到端编写 GPU Kernel,GPU 成本 -30-60%

  • 能力跃迁:Fable5.1 现在可以自己端到端编写 GPU Kernel 做推理加速。
  • 效果:提高特定场景下 GPU 算子的效率,将 GPU 成本降低 30-60%,并缓存中间结果等待复用。

开放企业使用 Fable:Enterprise Frontier Safeguards 破解数据留痕

政策松绑:企业 Fable 用量从 ~10% 开启向上迁移

  • 历史痛点:过去数据停留问题导致企业的 Fable 用量仅 ~10%。
  • 配套推出:Anthropic 同步推出 Enterprise Frontier Safeguards,在接近零数据留存的隐私条件下保留安全监测能力。
  • 预期效果:将推动 Opus 流量开始向上迁移。

早期客户实测:Cognition Devin / Every / Rogo 三家反馈

  • Cognition:宣布发布当天将部分 Devin 的 Opus5 流量迁往 Fable5.1。
  • Every:实测速度约为 Opus5 的两倍、token 使用量约一半。
  • Rogo:在金融任务上保持 Fable5 准确率的同时减少约 20% 的 token。

防蒸馏:提高 CoT 数据蒸馏难度,旧方法窗口关闭

  • 动作:Anthropic 提高 CoT 数据的蒸馏难度,关闭了典型旧方法的窗口。
  • 局限:这种禁止或许依旧很难避免蒸馏。

核心结论:单纯更聪明不再管用,长程任务价值打开

  • 定价逻辑:Top1 模型很难再只靠"更聪明"提价。只有持续保持 Top1、并能打开更高价值任务边界的模型,才能保留相对更好的商业模式。
  • 价值迁移:长程科学任务运行代表模型能够完成过去无法承接的专业任务。
  • 分层视角:同等智能的价格继续下降,智能上界打开的任务价值继续提高,模型层看单位任务成本,算力层看需求弹性。

(风险提示:所提观点仅做学习交流,所涉标的不作为推荐依据。)