天风修正此前判断:Fable5.1 大幅降价并叠加能力代差迁移,意味着 Opus 层的超额定价权侵蚀已不止于前沿层,Fable 层同样无法独善其身。缓存命中价从 1 美元降至 0.25 美元、长程任务成本逼近 Opus5、能力跃迁集中在 Terminal-Bench-Science 这类长程专业任务,“单纯更聪明"的提价模式正式受双向夹击。
更多缓存折扣:缓存命中价从 1 美元 → 0.25 美元,典型负载 -25%、重度 Agent -45%
缓存价砍至 0.025 倍:Fable5.1 降幅 75%,Sonnet5 同步放弃涨价
- 核心变化:Fable5.1 缓存命中价格从 1 美元降至 0.25 美元,按基础输入价的 0.025 倍计。
- 横向对比:其他 Claude 模型仍为 0.1 倍。
- 整体趋势:此前 Anthropic 已取消 Sonnet5 原定于 9 月 1 日的涨价,前沿层降低缓存价格、中端层放弃涨价,方向一致。
负载成本:典型 -25%,重度 Agent 最高 -45%,特定任务可逼近 Opus5
- 官方统计:典型负载成本下降约 25%。
- 重度 Agent 负载:最高下降约 45%。
- 天风计算:在极度重缓存或 token 效率显著提升的特定任务中,Fable5.1 单任务成本可以逼近甚至低于 Opus5。
修正此前判断:Top1 模型向上定价困难,Fable 层也难独善其身
- 此前判断:Opus 层的超额定价权被侵蚀。
- 修正后:Fable5.1 说明 Top1 模型继续向上定价依然困难,Fable 层也无法独善其身。
能力代差转向长程专业任务:Terminal-Bench-Science 24.7% → 52.6%
基准成绩:Terminal-Bench-Science 翻倍超 Opus5 与 GPT-5.6Sol
- Fable5.1:24.7% → 52.6%。
- 对照模型:显著超过 Opus5 的 29.0% 和 GPT-5.6Sol 的 22.4%。
- 本次定位:基础能力涨幅有限,核心提升集中在 Agent 长程任务。
企业工作流能力:26.9% → 31.4%
- 场景意义:在企业工作流中能力由 Opus5 的 26.9% 提升至 31.4%。
计算生物学长程任务:端到端编写 GPU Kernel,GPU 成本 -30-60%
- 能力跃迁:Fable5.1 现在可以自己端到端编写 GPU Kernel 做推理加速。
- 效果:提高特定场景下 GPU 算子的效率,将 GPU 成本降低 30-60%,并缓存中间结果等待复用。
开放企业使用 Fable:Enterprise Frontier Safeguards 破解数据留痕
政策松绑:企业 Fable 用量从 ~10% 开启向上迁移
- 历史痛点:过去数据停留问题导致企业的 Fable 用量仅 ~10%。
- 配套推出:Anthropic 同步推出 Enterprise Frontier Safeguards,在接近零数据留存的隐私条件下保留安全监测能力。
- 预期效果:将推动 Opus 流量开始向上迁移。
早期客户实测:Cognition Devin / Every / Rogo 三家反馈
- Cognition:宣布发布当天将部分 Devin 的 Opus5 流量迁往 Fable5.1。
- Every:实测速度约为 Opus5 的两倍、token 使用量约一半。
- Rogo:在金融任务上保持 Fable5 准确率的同时减少约 20% 的 token。
防蒸馏:提高 CoT 数据蒸馏难度,旧方法窗口关闭
- 动作:Anthropic 提高 CoT 数据的蒸馏难度,关闭了典型旧方法的窗口。
- 局限:这种禁止或许依旧很难避免蒸馏。
核心结论:单纯更聪明不再管用,长程任务价值打开
- 定价逻辑:Top1 模型很难再只靠"更聪明"提价。只有持续保持 Top1、并能打开更高价值任务边界的模型,才能保留相对更好的商业模式。
- 价值迁移:长程科学任务运行代表模型能够完成过去无法承接的专业任务。
- 分层视角:同等智能的价格继续下降,智能上界打开的任务价值继续提高,模型层看单位任务成本,算力层看需求弹性。
(风险提示:所提观点仅做学习交流,所涉标的不作为推荐依据。)