简介
当地时间 9 月 1 日,Anthropic 正式发布 Claude Fable 5.1 与 Claude Mythos 5.1:两款模型共享同一基座,仅安全防护等级不同,Fable 5.1 面向所有用户开放,Mythos 5.1 仅向审核通过的机构提供。Anthropic 称其为"全球最先进的编程与知识工作模型"——在智能体科学基准 Terminal-Bench-Science 0.1 上,Fable 5.1 得分 52.6%,是前代 Fable 5(24.7%)的两倍多;缓存读取价格下调 75%,典型工作负载总成本降低约 25%。
同一模型,两套安全防护
与 6 月发布的 Fable 5 / Mythos 5 组合一样,Fable 5.1 与 Mythos 5.1 本质是同一个模型,区别在于护栏:Fable 5.1 在网络安全、生物与化学、模型蒸馏等高风险领域会被分类器拦截并回退,Mythos 5.1 移除了部分限制,因此仅对通过可信访问计划审核的机构开放。两款模型均支持 100 万 token 上下文与 128K 最大输出,自适应思考(adaptive thinking)默认开启。在算力军备竞赛的背景下,Anthropic 与 OpenAI 已吞下全球约 1/3 新增算力(相关分析),新模型的效率指标因此格外受关注。
基准表现:科学智能体翻倍,编程登顶
- 科学智能体:Terminal-Bench-Science 0.1 得分 52.6%,对比 Fable 5 的 24.7%、Opus 5 的 29.0%、GPT-5.6 Sol 的 22.4%;
- 编程:Terminal-Bench 4.0 得分 55.8%(Fable 5 为 42.0%),放宽护栏的 Mythos 5.1 达 60.9%;
- 知识工作:GDPval-AA v2 得分 1853,超过 Opus 5(1824)与 Fable 5(1723);
- 效率:内部金融基准上以少 20% 的 token 达到 Fable 5 同等准确率,幻灯片生成与复杂数据解释能力明显提升。开源模型靠自测两个月反超 Opus 4.8 的案例(详见此前报道)说明竞争已进入训练策略层面,头部模型的差距正在收窄。
价格与 API:缓存读取降 75%,三条破坏性变更
Fable 5.1 基础定价不变(输入每百万 token 10 美元、输出 50 美元),缓存读取价格从每百万 token 1 美元降至 0.25 美元(-75%)。官方测算:典型工作负载总成本比 Fable 5 低约 25%,高度智能体化负载最高可降 45%。API 同步带来 3 条破坏性变更,主要影响会编辑对话历史的智能体应用;数据保留默认 30 天,零保留需显式授权。
研究展示:蛋白质结合剂、金星高程图、GPU 内核
- 蛋白质设计:Mythos 5.1 在 12 个靶点上的结合剂命中率接近 50%(行业典型值 10-15%),3 个靶点上的结合亲和力比 Adaptyv Bio 竞赛最佳作品高 10 倍;
- 计算分析:Fable 5.1 基于 NASA 麦哲伦任务 30 年前的雷达图像训练神经网络,绘出覆盖金星 1/3 区域的高程图,分辨率从 10-20 公里细化到 2-3 公里,高程精度提升 25%;
- 计算生物:通过编写自定义 GPU 内核并缓存中间结果,将 7 个开源深度学习模型提速最高 2.5 倍,预计 GPU 成本降低 30-60%。与生成式基因组设计首次造出活噬菌体的 Evo(报道见这里)一样,这类展示指向同一个方向:模型正在从"生成文本"走向"直接做科研"。
常见问题
Fable 5.1 和 Mythos 5.1 有什么区别?两者是同一基座模型,仅安全防护不同。Fable 5.1 面向所有用户开放(API 模型 ID:claude-fable-5-1);Mythos 5.1 移除部分限制,仅向审核通过的机构提供。
Fable 5.1 涨价了吗?没有。输入 10 美元、输出 50 美元每百万 token 的基础定价不变;缓存读取降价 75% 至 0.25 美元,典型负载总成本反而降低约 25%。
在哪里可以使用?Fable 5.1 已通过 Claude API 及 Amazon Bedrock、Google Cloud、Microsoft Foundry 等渠道提供,Mythos 5.1 需联系厂商申请。