Claude Fable 5.1 – Anthropic推出的智能体编程与科研推理大语言模型

AI模型4天前更新 智小研
33 0

Claude Fable 5.1是一款由 Anthropic 于 2026 年 9 月推出的通用旗舰大语言模型,与同日发布的 Claude Mythos 5.1 基于同一底层模型,差异仅在安全防护等级:Fable 5.1 面向所有用户与企业普遍可用,覆盖智能体编程、长周期科研推理与知识工作,并同步下调缓存读取费用。

基础信息内容
开发团队Anthropic
发布时间2026 年 9 月 1 日
产品定位通用旗舰大语言模型(智能体编程与科研推理)
底层模型与 Claude Mythos 5.1 相同,仅安全防护等级不同
上线平台Claude API、AWS、Google Cloud、Microsoft Azure
API 模型名claude-fable-5-1(low 至 max 五档推理强度)
关键评测Terminal-Bench 4.0 55.8%、Terminal-Bench-Science 0.1 52.6%
定价输入 10 美元/百万 tokens、输出 50 美元/百万 tokens
Claude Fable 5.1 – Anthropic推出的智能体编程与科研推理大语言模型

Claude Fable 5.1 的核心能力

与上一代 Claude Fable 5 相比,Fable 5.1 的主线不是单纯堆能力,而是把”能力”与”可安全落地”同时推进:在同一底层模型上收紧误报、下调缓存成本,让长周期智能体任务跑得更久、更少被打断。

同基座双版本:能力相同,防护分级

Anthropic 官方明确,Claude Fable 5.1 与 Claude Mythos 5.1 是同一个模型,区别只在安全防护等级:Fable 5.1 启用生产级防护、面向所有人开放;Mythos 5.1 仅在网络安全与生命科学方向放宽。这意味着 Fable 5.1 不是”缩水版”,而是完整能力加更严格的默认约束。

基准表现:多项智能体任务大幅领先前代

  • Terminal-Bench-Science 0.1 取得 52.6%,高于 Fable 5 的 24.7% 与 Opus 5 的 29.0%,提升超过一倍
  • Terminal-Bench 4.0 取得 55.8%,高于 Fable 5 的 42.0% 与 Opus 5 的 52.3%
  • CursorBench 3.2.0 在 max effort 档下取得 73.4%,为同批模型最高
  • AutomationBench 从 Fable 5 的 17.1% 提升到 31.4%,业务工作流自动化能力接近翻倍

安全防护:把误报率压下来

防护误报的下降是另一条主线。官方数据显示,新的网络安全防护对良性内容的误报拦截减少 60%,Claude Code 用户平均每会话被干预次数比 Fable 5 的旧防护减少约 60%;生物学防护对良性请求的触发频率也比 Fable 5 发布时降低 85%。对长时间无人值守跑任务的团队,这种”少被打断”的改进体感往往更明显。

Claude Fable 5.1 与 GPT-5.6 Sol、GLM-5.3 对比

把 Claude Fable 5.1 与GPT-5.6 Sol、GLM-5.3 放在一起,可以更直观看到它在智能体编程与科研推理上的位置。以下数据来自 Anthropic 与 Z.ai(智谱)官方发布页,Fable 5.1 在启用生产级防护的条件下评估。

对比维度Claude Fable 5.1GPT-5.6 SolGLM-5.3
科学研究(Terminal-Bench-Science 0.1)52.6%22.4%未公布
Agent 编码(Terminal-Bench 4.0)55.8%37.3%41.82%
知识工作(GDPval-AA v2)185317111769
业务流程(AutomationBench)31.4%19.6%48.2%(v1.0.6)
计算机操作(OSWorld 2.0)77.9%(partial)无公开数据未公布
性价比缓存读取降 75%,典型负载省 25%无同等降价未公布

注:数据来自 Anthropic 2026 年 9 月 1 日官方发布页与 Z.ai(智谱)2026 年 8 月 14 日 GLM-5.3 发布页。GLM-5.3 部分维度未公布公开数据,AutomationBench 标注其版本(v1.0.6),与 Anthropic 所用版本不完全一致,不作直接横比。

从官方数据可以看出,Fable 5.1 的提升集中在长链条、多步骤任务:科研推理从 22.4% 跃升到 52.6%,AutomationBench 从 19.6% 提升到 31.4%;而 GLM-5.3 作为开源模型,在 Terminal-Bench 4.0 与 GDPval-AA v2 上已接近旗舰模型区间。以智能体流水线为主的使用者更值得关注 Fable 5.1 的防护下表现。

Claude Fable 5.1 的应用场景与适用人群

结合官方基准与落地案例,Claude Fable 5.1 更偏向需要连续执行、多步验证的知识与工程任务,与侧重单轮问答的模型定位不同。

  • 科研推理与文献工作:适合做实验设计、数据分析与假设验证的自动化辅助
  • 长周期智能体编程:支持连续数小时至数十小时无人值守运行,适合大型重构与批量代码治理
  • 业务流程自动化:适合把跨系统的多步骤办公流程交给智能体串联执行

适用人群:需要长周期智能体执行能力的工程团队、做计算与数据科学的研究人员、希望把跨系统办公流程自动化的企业部门,以及以 Claude API 或三大云为主干构建 AI 应用的开发者。

如何使用 Claude Fable 5.1

使用前的准备

  • 准备 Anthropic 控制台账号(入口与权限说明见 Claude Fable 5.1 官网)或三大云(AWS Bedrock、Google Cloud、Microsoft Foundry)的模型访问权限
  • 确认所用 SDK 已支持 claude-fable-5-1 模型名,并按复杂度预设 effort 档位

接入步骤

  1. 获取密钥:在 Anthropic 控制台或所用云平台创建 API key,确认已开通 Fable 5.1 的模型权限
  2. 切换模型名:把调用参数中的模型标识改为 claude-fable-5-1,其余请求结构与此前一致
  3. 设置推理档位:按复杂度选择 low 至 max 五档,日常任务用 medium,长周期任务建议 high 及以上
  4. 开启提示缓存:对长上下文与工具密集型负载开启缓存,以享受下调 75% 的缓存读取价格

完整基准表格、安全评估说明与最新定价请参考 Claude Fable 5.1 官网。

Claude Fable 5.1 的价格与开源情况

Claude Fable 5.1 为闭源商业模型,不开放模型权重,只能通过 API 或云平台调用。其定价为每百万 tokens 输入 10 美元、输出 50 美元,与前代 Fable 5 持平;真正的降幅来自缓存读取费用,本次下调 75% 至每百万 tokens 0.25 美元。

由于高度智能体化的任务中缓存读取往往占主要成本,这一调整带来的节省相当可观:官方测算典型负载成本较 Fable 5 下降约 25%,在上下文与工具密集的智能体负载上最高可省约 45%。负载越”重”,升级的性价比越明显。

Claude Fable 5.1 常见问题

Claude Fable 5.1 与 Claude Mythos 5.1 是什么关系?

两者是同一个底层模型,区别仅在安全防护等级:Fable 5.1 面向所有用户普遍可用,Mythos 5.1 仅在网络安全与生命科学方向放宽防护,且只通过可信访问计划向经审查的机构开放。

升级到 Claude Fable 5.1 的成本是升还是降?

输入与输出单价与 Fable 5 持平,为每百万 tokens 10 美元与 50 美元;缓存读取费用下调 75% 至 0.25 美元。官方测算典型负载成本下降约 25%,智能体负载最高可省约 45%。

Claude Fable 5.1 的上下文窗口有多大?

Anthropic 本次发布页未披露上下文窗口与最大输出 tokens 的具体数值,仅公开 low 至 max 五档推理强度与默认设置;如需精确参数,建议查阅官方 API 文档或 System Card。

Claude Fable 5.1 可以用来做渗透测试吗?

官方明确 Fable 5.1 可用于发现软件漏洞等防御性安全工作,但渗透测试、漏洞利用生成与二进制漏洞扫描等两用任务仍会被重定向到Claude Opus 5 等 Claude 模型,不能用于开发 exploits。

© 版权声明
AI工具站赚钱操作手册横幅,分享AI工具站SEO、GEO流量增长、CPS、CPA及数字产品变现经验

相关文章