Claude Mythos 5.1 – Anthropic推出的网络安全与生命科学特化大模型

AI模型4天前更新 智小研
29 0

Claude Mythos 5.1是一款由 Anthropic 于 2026 年 9 月推出的面向网络安全与生命科学的可信访问特化大模型,与 Claude Fable 5.1 基于同一底层模型,差异在安全防护等级:Mythos 5.1 在这两个方向上采用更宽松的防护,仅向通过审查的机构开放,用于防御性安全研究与专业科研活动。

基础信息内容
开发团队Anthropic
发布时间2026 年 9 月 1 日
产品定位网络安全与生命科学方向特化大模型
底层模型与 Claude Fable 5.1 相同,仅安全防护等级更宽松
访问方式CVP(网络验证计划)与 LSVP(生命科学验证计划)
开放范围目前仅面向部分美国组织,正与美国政府协调扩展
关键评测Terminal-Bench 4.0 60.9%,为 Anthropic 同批最高
代表成果蛋白质结合剂设计命中率接近 50%,为行业典型水平的三倍以上
Claude Mythos 5.1 – Anthropic推出的网络安全与生命科学特化大模型

Claude Mythos 5.1 的核心能力

与全面开放的 Claude Fable 5 系列不同,Mythos 5.1 的价值不在”谁都能用”,而在”特定的工作终于能做了”:网络安全与生命科学里被通用防护挡在门外的正当研究,正是它的服务对象。

同一底座,两个防护等级

Anthropic 在官方发布页明确,Claude Mythos 5.1 与 Fable 5.1 是同一个模型,区别只在 safeguards。Mythos 5.1 在网络安全与生命科学两个方向上采用更宽松的防护,其余所有防护保持不变;与之配套的是两道准入门槛——CVP 面向防御性网络安全工作,LSVP 面向生命科学专业人员。

网络安全:能力最强,风险仍受控

  • Terminal-Bench 4.0 取得 60.9%,高于同基座 Fable 5.1 的 55.8% 与前代 Fable 5 的 42.0%
  • 官方说明与 Fable 5.1 的分差主要来自早期网络安全防护的介入,预计会随防护改进缩小
  • 在关闭网络安全防护的测试中,展现出 Anthropic 已发布模型中最强的网络能力
  • 但在 Frontier Compliance Framework 中仍属较低风险层级,且未发现 critical-severity 越狱

生命科学:蛋白质设计与计算生物学成果

Mythos 5.1 的两组实验数据最能说明它的定位。其一是蛋白质设计:官方把设计结果送交外部机构做实验验证,在 EGFR、Nipah G、15-PGDH 三个靶点上,结合亲和力比 Adaptyv Bio 竞赛的最佳提交高 10 倍;12 个靶点的可结合命中率接近 50%,而蛋白质设计领域典型水平仅为 10% 至 15%。其二是计算生物学:Mythos 5.1 通过编写自定义 GPU 内核并缓存中间结果,在 NVIDIA H100 上把 7 个开源模型加速最高 2.5 倍且输出完全一致,GPU 成本下降 30% 至 60%。

在对齐层面,官方结论是 Mythos 5.1 在多数指标上比 Mythos 5 更对齐:更不容易访问测试环境外的资源、更不容易忽略显式约束,奖励 hacking 的成功率也更低;在外部提示注入基准上,官方称其为迄今最稳健的模型。此外,Anthropic 的 Claude Security 产品现由 Mythos 5.1 驱动。

Claude Mythos 5.1 与 OpenAI GPT-Rosalind 对比

Mythos 5.1 与 OpenAI GPT-Rosalind 都采用「受控 / 受信访问」路线,面向高敏感科研场景,但覆盖领域与能力侧重不同。以下对照基于双方官方发布信息。

对比维度Claude Mythos 5.1OpenAI GPT-Rosalind
所属公司AnthropicOpenAI
模型定位面向网络安全与生命科学的受控访问旗舰模型面向生命科学的受信访问模型
覆盖领域网络安全(CVP)+ 生命科学(LSVP)双轨专注生命科学(药物发现、基因组学、湿实验)
访问方式需通过 CVP / LSVP 政府级审核,目前以美国机构为主通过 trusted-access deployment 向符合条件的全球科研机构开放,需证明公共利益与安全治理
核心能力蛋白质设计、GPU 内核优化、防御性漏洞研究、长周期自主科研药物发现、NGS 分析、生物信息学工作流、Codex 插件执行可重复实验
插件 / 工具调用开源蛋白质设计 / 折叠工具,自主编写代码内置 Life Sciences Research 与 NGS Analysis 插件,支持序列 / 结构可视化查看器
安全策略与 Fable 5.1 同源,差异化安全围栏,反蒸馏机制企业级安全 + 受控访问,需具备治理和安全监督能力

注:以上对照基于 Anthropic 与 OpenAI 官方发布信息。GPT-Rosalind 为 OpenAI 面向生命科学的受信访问模型,具体能力以官方披露为准。

从对照可以看出,两款模型都把高敏感科研能力放在受控访问框架内,真正的差异在覆盖领域:Mythos 5.1 是网络安全与生命科学双轨,GPT-Rosalind 则聚焦生命科学内部的药物发现与组学分析。对需要跨安全与生物双场景的团队,Mythos 5.1 的覆盖面更宽。

Claude Mythos 5.1 的应用场景与适用人群

由于访问受限,Mythos 5.1 的场景边界非常清晰——它服务的不是通用生产力,而是被通用防护挡住、但本身正当的专业工作。

  • 防御性安全研究:在受审查的前提下做漏洞发现与补丁建议,Claude Security 即由该模型驱动
  • 蛋白质与药物设计:借助放宽的生物学防护做结合剂设计,官方实测命中率接近 50%
  • 计算生物学加速:编写自定义 GPU 内核优化开源生物学模型推理,最高加速 2.5 倍

适用人群:通过 CVP 审查的网络安全研究人员与防御性安全团队、经 LSVP 认证的生命科学专业人员与药物研发机构、需要压低生物学模型推理成本的计算生物学团队,以及采购 Claude Security 的企业安全部门。普通开发者不在其服务范围内。

如何使用 Claude Mythos 5.1

申请前的准备

  • 确认所在机构属于网络安全或生命科学领域,并能提供相应的专业资质证明
  • 明确用途属于防御性安全工作或专业研发活动,而非攻击性用途

申请与接入步骤

  1. 选择计划:防御性网络安全工作走 CVP,生命科学专业研发走 LSVP
  2. 提交申请:通过 Claude Mythos 5.1 官网 的官方申请入口提交机构资质与用途说明
  3. 等待审查:目前仅面向部分美国组织开放,Anthropic 正与美国政府协调扩展范围
  4. 接入使用:通过审查后按官方指引调用模型;企业用户也可直接使用 Claude Security 产品

CVP 与 LSVP 的申请入口、审查标准与最新开放范围请参考 Claude Mythos 5.1 官网。

Claude Mythos 5.1 的价格与开源情况

Claude Mythos 5.1 为闭源商业模型,不开放模型权重,也不采用公开定价——Anthropic 官方发布页未披露其 API 价格,仅说明通过可信访问计划提供。同基座的 Fable 5.1 定价为每百万 tokens 输入 10 美元、输出 50 美元,可作为成本量级的参考。

由于目前仅面向部分美国组织开放且需通过 CVP 或 LSVP 审查,实际获取门槛中的合规与审查成本,远高于调用本身的费用。

Claude Mythos 5.1 常见问题

Claude Mythos 5.1 与 Claude Fable 5.1 的能力有差别吗?

两者是同一个底层模型,能力相同,区别仅在安全防护等级与访问方式:Fable 5.1 全面开放,Mythos 5.1 在网络安全与生命科学方向放宽防护,仅向通过 CVP 或 LSVP 审查的机构开放。

为什么 Mythos 5.1 在 Terminal-Bench 4.0 上比 Fable 5.1 高?

官方解释是这一差距主要反映早期网络安全防护在部分任务上的介入,而非底层能力差异;随着本次防护改进,官方预计两者分差会大幅缩小。

Mythos 5.1 的蛋白质设计成果具体是什么水平?

官方送交外部机构实验验证的结果是:在 EGFR、Nipah G、15-PGDH 三个靶点上结合亲和力比竞赛最佳提交高 10 倍;12 个靶点的可结合命中率接近 50%,而蛋白质设计领域典型水平为 10% 至 15%。

个人开发者可以申请使用 Mythos 5.1 吗?

目前不能。它仅面向部分美国组织通过 CVP / LSVP 审查后开放,Anthropic 正与美国政府协调扩展至更广范围;个人开发者建议使用全面开放的 Fable 5.1。

© 版权声明
AI工具站赚钱操作手册横幅,分享AI工具站SEO、GEO流量增长、CPS、CPA及数字产品变现经验

相关文章