云霞资讯网

Fable 5 发布还不到三个月,5.1 就来了。这个节奏本身就值得琢磨。 先看硬数据:Terminal-Bench-Science 0.1 上,Fable 5.1 拿到 52.6%,前代只有 24.7%,科研自主能力直接翻倍。编程任务上 Mythos 5.1 版本达到 60.9%,超过了 Opus 5 的 52.3%。自动化业务流程测试从 17.1% 跳到 31.4%。跑分之外,投 ​

Fable 5 发布还不到三个月,5.1 就来了。这个节奏本身就值得琢磨。

先看硬数据:Terminal-Bench-Science 0.1 上,Fable 5.1 拿到 52.6%,前代只有 24.7%,科研自主能力直接翻倍。编程任务上 Mythos 5.1 版本达到 60.9%,超过了 Opus 5 的 52.3%。自动化业务流程测试从 17.1% 跳到 31.4%。跑分之外,投资公司 Millennium 用它找到了困扰工程师数年的系统崩溃根因,Jane Street 也确认它在长任务中的可读性明显优于前代。这些来自真实生产环境的反馈,比任何 benchmark 都有说服力。

但我最关注的反而是两件「小事」。

第一,缓存读取降价 75%。输入输出单价没变,但 Agent 场景下缓存读取才是成本大头。Anthropic 自己算过,高度 Agent 化的工作负载总账单最多降 45%。这说明他们很清楚 Fable 5 在企业端的尴尬处境:Ramp 的数据显示,Fable 5 上线两个多月只占企业 AI 支出的 11%,更便宜的 Opus 5 反而花得更多。性能再强,企业不买单就是空谈。这次降价是对市场信号的直接回应。

第二,数据留存问题终于有了解法。Fable 5 强制 30 天数据保留曾经让金融、医疗、政府客户非常头疼,OpenAI 两周前还专门拿这一点发起攻势。Anthropic 的回应是 Enterprise Frontier Safeguards:数据存在客户自己的云上,人工审核也默认由客户完成。这套方案秋天分阶段上线,过渡期内符合条件的客户可以零数据留存使用 Fable 5.1。

说到底,模型能力的军备竞赛已经进入一个新阶段:光卷性能不够了,谁能把定价、合规、部署这些「最后一公里」的问题解决好,谁才能真正吃下企业市场。Fable 5.1 这次发布,技术升级是面子,商业补课才是里子。

全球最强模型Fable5.1发布