Anthropic 披露内部模型 2:整体能力略超 Claude Mythos 5

Anthropic 在其 2026 年 8 月风险报告中悄然披露了一个未发布的内部 AI 模型,名为 Model 2。该模型并非公开的 Claude 版本,Anthropic 也未宣布...

发布于 2026年8月19日generalGEO 评分: 0
Anthropic 披露内部模型 2:整体能力略超 Claude Mythos 5

Anthropic 披露内部模型 2:整体能力略强于 Claude Mythos 5

引言

Anthropic 在其 2026 年 8 月风险报告中悄然披露了一款名为 Model 2 的未发布内部 AI 模型。

该模型并非公开的 Claude 版本,Anthropic 也未将其作为产品发布。它出现在报告中,是因为该公司在评估先进 AI 风险时纳入了内部部署的前沿及接近前沿的系统。

根据 Anthropic 的说法,Model 2 整体能力略强于 Claude Mythos 5

提升是真实存在的,但该公司谨慎地没有将其描述为重大的代际跃升。

Anthropic 自己的总结指出,在与内部使用相关的许多任务上,Model 2 明显优于 Mythos 5,但仍远未达到该公司从 Claude Opus 4.6 升级到 Claude Mythos Preview 时所观察到的能力飞跃程度。

这使得 Model 2 从一个不同角度显得颇具意义。

与其说它标志着全新一代的来临,不如说它更像是 Anthropic 对前沿模型能力的持续精进。

报告还给出了一个具体数据点:在 Anthropic 的内部 CoBench 评估中,Model 2 得分 62.8%,领先于 Claude Mythos 5 的 50.3% 和 Claude Mythos Preview 的 54.8%

同一份报告还提到了另一个内部系统 Model 1,这引发了外界猜测:Anthropic 是否在开发一系列内部模型,之后再分配公开的 Claude 产品名称。

官方报告仅部分支持这种解读。

Anthropic 确认 Model 1 和 Model 2 是内部模型,但并未表示 Model 2 是 Model 1 的正式继任者,也未表示两者中的任何一个将成为未来的 Claude 版本。

Model 2 整体略强于 Claude Mythos 5

AIBase 报道的核心观点是准确的:Anthropic 表示 Model 2 整体强于 Claude Mythos 5。

该公司 8 月的风险报告将 Model 2 描述为:

  • 在某些领域能力优于 Mythos 5。
  • 在其他领域能力弱于 Mythos 5。
  • 整体能力略强。

Anthropic 还表示,其粗略的定性评估是,Model 2 在诸多与内部使用相关的任务上提供了明显的改进。

这一措辞很重要。

Model 2 不应被描述为在每个基准测试或每个与风险相关的领域都全面优于 Mythos 5。

报告本身显示,对比结果因任务而异。

例如,在某些化学和生物风险评估中,Anthropic 表示 Model 2 的有限结果与 Claude Mythos 5 相当或更弱。

在另一项隐蔽行为评估中,Model 2 略强于 Mythos 5,但仍明显弱于 Mythos Preview。

因此,最公允的总结是:

Model 2
= 整体能力略强
≠ 在每项评估中均更优

改进并非重大的代际跃升

原文强调,这一提升相对有限。

Anthropic 表示,与……相比,

一样的情况。

该公司特别将 Model 2 与此前的跃迁进行对比,即从 Claude Opus 4.6 升级到 Claude Mythos Preview

那一次升级代表了更大的能力提升。

Model 2 则不然。

Anthropic 表示,这个更新的内部模型在许多内部任务上都有明显改进,但并不是同等规模的颠覆性变化。

这一点也反映在另一个内部能力指标上。

Anthropic 维护着一个名为 AECI 的内部版 Epoch 能力指数,该指数综合了多项内部基准测试的表现。

根据有限的数据,Model 2 的得分大约是:

1.5 个 AECI 点

高于 Claude Mythos 5。

Anthropic 明确指出,该估算存在较大的误差范围。

它还表示,这一增幅小于从 Mythos Preview 到 Mythos 5 的改进幅度。

这支持了文章的主要定性:Model 2 看起来是前沿模型的渐进式改进,而非明显的新能力阶段。

CoBench 提供了最清晰的公开对比

报告中最具体的证据来自 CoBench

Anthropic 将 CoBench 描述为一种内部评估,旨在测试模型解决公司实际研发问题的能力,而非使用通用基准作为替代指标。

该评估将模型置于 Anthropic 基础设施历史中的某个时间点。

模型会收到一份资源快照,包括:

  • 代码。
  • 日志。
  • 内部文档。
  • 历史内部消息。

然后,它需要诊断 Anthropic 工程师此前解决过的技术问题的根本原因。

8 月报告中所描述的当前版本包含:

449 个问题

主要来源于 2026 年 2 月至 4 月间解决的问题。

这些问题来自 Anthropic 技术组织中涉及以下领域的部门:

  • 训练模型。
  • 运行模型基础设施。
  • 调试技术系统。
  • 研究工程。

这使得 CoBench 与 Anthropic 对 AI 自动化 AI 研发 的关注尤为相关。

Model 2 在 CoBench 上得分 62.8%

报告中展示的对比得分如下:

模型 CoBench 得分
Claude Sonnet 4.6 12.0%
Claude Opus 4.6 15.6%
Claude Opus 4.7 27.4%
Claude Mythos 5 50.3%
Claude Mythos Preview 54.8%
Model 2 62.8%

因此,Model 2 在图表所示的模型中处于领先地位。

它与 Mythos 5 相比的优势为:

62.8% - 50.3% = 12.5 个百分点

在这一特定的内部基准上,这是一个显著的差距。

但这仍远低于 Anthropic 认为足以完全替代其技术人员所需的分数。

Anthropic 估计完全替代研究人员需要大约 85% 的得分

Anthropic 表示,根据对任务和评分流程的人工审查,一个能够真正完全替代 Anthropic 研究科学家和工程师的系统,在 CoBench 上的得分至少应约为:

85%

Model 2 的 62.8% 因此仍有较大差距。

Anthropic 还提醒,该基准并不能完美衡量与人类的等效性。

该数据集是

刻意筛选了难题。

大多数任务之所以被选中,是因为 Mythos Preview 在三次尝试中至少失败了一次。

Anthropic 表示,如果没有这种筛选,数据集规模大约会翻倍。

还有其他限制:

  • 一些历史人类结论可能并不完善。
  • 一些答案可能具有歧义。
  • 自动评分可能出错。
  • 模型并不会获得真正 Anthropic 工程师可能拥有的所有权限或基础设施支持。

因此,CoBench 最好被视为一个有用的内部信号,而非衡量 AI 模型能否取代研究者的通用标准。

给 Mythos 5 更多 Token 并不能完全弥合差距

Anthropic 还测试了 CoBench 结果是否仅仅反映了推理预算不足。

该图表使用的 token 预算约为:

300,000 tokens

用于被评估的设置。

当 Anthropic 将 Mythos 5 的预算增加到:

900,000 tokens

其得分仅提升了约:

3 个百分点

这表明 Model 2 的优势至少有一部分无法仅通过给 Mythos 5 更多 token 来解释。

Anthropic 仍然认为更好的脚手架和评估框架可以改善结果,因此该基准并非纯粹衡量模型权重本身。

智能体架构很重要。

Model 2 已在 Anthropic 内部大量使用

Model 2 尚未发布,但它不仅仅是一个无人使用的实验室检查点。

Anthropic 表示,Model 2 和 Claude Mythos 5 是其内部能力最强且最常用的模型之一。

它们被大量用于:

  • 编程。
  • 数据生成。
  • 其他智能体工作流。
  • 研究。
  • 工程。

Anthropic 还表示,这两个模型都通过持久化智能体部署来使用,而不仅仅是交互式聊天会话。

这一点很重要,因为该公司的风险报告部分关注的是 AI 系统可能自动化 Anthropic 自身研发工作中越来越多的部分。

报告称,Claude 现在编写了绝大多数合并到 Anthropic 生产代码库中的代码。

然而,Anthropic 并未得出结论认为其模型目前能够完全取代其研究人员。

该公司认为 AI 正在实质性加速内部工作,但其 8 月份的评估仍低于负责任扩展政策中关于 AI 驱动研发大幅加速的阈值。

Model 2 尚未完成 Anthropic 完整的部署前评估套件

报告中还包含另一个重要注意事项。

Model 2 已经通过了 Anthropic 的内部部署审查流程,但尚未经过公司在外部部署前通常会运行的完整评估套件。

因此,Anthropic 表示,它对 Model 2 的理解置信度略低于对经过全面评估的发布模型的置信度。

这在解读基准比较时很重要。

单个 CoBench 结果可以表明 Model 2 在内部研发任务上表现强劲。

但它并不能建立完整的性能画像,涵盖:

  • 通用推理。
  • 编程。
  • 网络安全。
  • 生物学。
  • 安全性。
  • 对齐。
  • 长周期自主性。
  • 消费者使用。
  • 企业环境。

工作量。

Anthropic 目前的结论刻意保持宽泛:Model 2 整体上似乎比 Mythos 5 略胜一筹。

Anthropic 目前没有对外发布 Model 2 的计划

在 AIBase 那篇简短的文章中,最重要的实际细节很容易被忽略。

Anthropic 明确表示:

我们目前没有计划
对外发布该模型。

因此,不应将 Model 2 视为带有隐含发布日期的即将推出的 Claude 产品。

目前没有官方的:

  • 发布日期。
  • 公开模型名称。
  • Claude API 模型 ID。
  • 定价。
  • 上下文窗口规格。
  • 消费者可用性计划。
  • 企业部署计划。

任何声称 Model 2 将成为“Claude Mythos 6”、“Claude Opus 6”或其他命名产品的说法都只是猜测。

Anthropic 披露该模型是因为其内部模型与公司的风险评估相关。

这不同于发布产品。

Claude Mythos 5 实际上并不是广泛可用的公开模型

AIBase 原始标题称 Claude Mythos 5 是 Anthropic 最强的公开可用模型。

这一点需要稍作修正。

Claude Mythos 5 并非广泛可用。

Anthropic 目前通过 Project Glasswing 及相关可信访问计划,仅向有限的一组获批客户提供该模型。

广泛可用的对应版本是 Claude Fable 5

Anthropic 表示 Fable 5 和 Mythos 5 使用相同的底层模型

区别在于 Fable 5 在网络安全和生物学等敏感领域包含更强的安全防护措施,而 Mythos 5 则提供给经过审查的用户,这些用户在授权工作中需要较少的限制。

当前的产品关系是:

Claude Mythos 5
= 受限可信访问

Claude Fable 5
= 相同底层模型
  + 更强安全防护
  + 广泛可用性

因此,对于普通读者来说,更准确的说法是:Mythos 5 是 Anthropic 最强的受限访问前沿模型,而 Fable 5 是其能力最强的广泛发布模型。

Model 1 是真实的,但“Model 1 → Model 2”的产品故事纯属猜测

报告中还提到了 Model 1

这自然足以引发猜测:

Model 1
→ Model 2
→ 未来的 Claude 版本?

但 Anthropic 并未做出这样的声明。

它实际上对 Model 1 的描述相当克制。

该公司表示,Model 1 在能力上大致相当于:

  • Claude Mythos Preview。
  • Claude Mythos 5。

它获得的内部部署相对有限。

Anthropic 表示,绝大多数内部用户更偏好 Mythos 5,而 Model 1 的使用率在报告截至 7 月 15 日的覆盖日期时已经很低且在持续下降。

该公司还表示:

它预计 Model 1 未来
不会被外部部署
或广泛内部使用

因此,Model 1 看起来更像是一个内部开发分支或检查点,而不是一个等待公开发布的明确界定的前代产品。

Model 2 与 Model 1 在一个重要方面存在差异

Anthropic 对 Model 2 的处理方式明显更为慎重。

Model 1 仅被简要讨论,随后在风险分析中基本被排除在外,因为 Anthropic

认为 Mythos 5 是其风险的一个合理上限。

相比之下,模型 2 在报告的大部分内容中都被使用,因为它:

  • 整体能力更强。
  • 在内部使用更频繁。
  • 与 Anthropic 的前沿风险分析相关。

报告称,模型 2 的内部使用情况与 Mythos 5 类似。

这并不能证明即将公开发布。

但它确实表明,模型 2 在 Anthropic 内部具有重要的运营地位。

风险报告是模型被公众知晓的原因

模型 2 并非通过传统的发布博客文章推出的。

它之所以出现,是因为 Anthropic 的负责任扩展政策要求公司对实际正在内部开发和部署的系统进行风险分析。

2026 年 8 月的风险报告涵盖了 Anthropic 截至2026 年 7 月 15 日的活动。

当内部模型与以下问题相关时,Anthropic 会将其列出:

  • 高风险环境中的错位问题。
  • 自动化 AI 研发。
  • 生物和化学风险。
  • 模型安全。
  • 内部监控。

这就是为什么报告中关于模型 2 的信息比普通未发布模型会得到的更多。

这一披露首先是安全治理的产物,其次才是产品泄露。

报告告诉了我们什么,又没有告诉我们什么

说法 状态
Anthropic 有一个名为模型 2 的内部模型 已确认
模型 2 尚未发布 已确认
模型 2 整体上比 Mythos 5 略强 Anthropic 已确认
模型 2 在每个领域都比 Mythos 5 更好
模型 2 在报告显示的 CoBench 对比中得分 62.8% 在报告数据中已确认
Mythos 5 在同一对比中得分 50.3% 在报告数据中已确认
Anthropic 估计在 CoBench 上实现全技术员工替代率约为 85% 已确认
模型 2 在内部被大量使用 已确认
模型 2 已完成完整的常规外部发布评估套件
Anthropic 目前计划公开推出模型 2
模型 2 有正式的 Claude 产品名称
模型 1 是一个真实的内部模型 已确认
模型 1 确定是模型 2 的直接前身 尚未确定
模型 1 预计将公开推出
Claude Mythos 5 已向所有人开放使用
Claude Fable 5 是对应 Mythos 5 的广泛发布版本 已确认

常见问题

什么是 Anthropic 模型 2?

模型 2 是 Anthropic 2026 年 8 月风险报告中披露的一个未发布的内部前沿模型。Anthropic 表示,它整体上比 Claude Mythos 5 略强,并且已在公司内部广泛用于编码、数据生成、研究、工程以及其他智能体工作。

模型 2 比 Claude Mythos 5 更好吗?

总体而言,Anthropic 说是的——但只是略好。该公司还表示,模型 2 在某些领域更强,在其他领域更弱,因此不应将其描述为全面超越。

模型 2 的 CoBench 得分是多少?

报告中显示的对比显示,模型 2 得分 62.8%,领先于 Mythos Preview 的 54.8% 和 Mythos 5 的 50.3%。Anthropic 估计,一个完全具备能力的模型

其技术人员的替代能力在当前的评估中至少需要达到大约85%。

CoBench评估什么?

CoBench是Anthropic基于其技术人员以往解决过的历史研究和工程问题而设计的内部评估。模型会收到历史快照,包括代码、日志、内部消息和文档,并且必须诊断出底层的技术问题。

Anthropic会发布Model 2吗?

Anthropic表示,目前没有计划对外发布Model 2。该公司尚未公布产品名称、发布日期、API标识符、定价或公开访问计划。

Model 2是下一个Claude Mythos模型吗?

Anthropic并未如此表示。Model 2是风险报告中使用的内部标识符,将其对应为未来的Claude产品名称纯属猜测。

什么是Anthropic Model 1?

Model 1是同一份报告中披露的另一个内部模型。Anthropic表示,它与Mythos Preview和Mythos 5大致相似,内部使用率相对较低且呈下降趋势,预计不会对外部署。

Claude Mythos 5是否公开发布?

并非普遍可用。Mythos 5通过Project Glasswing等受限可信访问计划提供,而Claude Fable 5使用相同的基础模型,但带有更强的安全防护措施,并且广泛可用。

相关工具

  • Claude:Anthropic面向消费者和专业人士的通用AI助手。
  • Claude API:Anthropic为普遍可用的Claude模型提供的开发者平台。
  • Anthropic Console:用于测试Claude API模型和管理开发者访问权限的官方工作空间。
  • Project Glasswing:Anthropic针对高级Mythos级网络安全能力的可信访问计划。
  • Anthropic Transparency Hub:模型安全评估、系统卡片和风险信息的中央资源。

相关链接

摘要

Anthropic的2026年8月风险报告揭示了一个名为Model 2的内部模型,该模型已经

目前正大量用于研究、工程、编码、数据生成以及持久化智能体工作流。

该模型在Anthropic内部CoBench评估中强于Claude Mythos 5,得分分别为62.8%和50.3%。Anthropic还表示,Model 2整体上似乎略强一些,尽管在某些领域弱于Mythos 5,且提升幅度远小于此前的重大能力跃升。

报告还提到了Model 1,但证据不足以支持将Model 1和Model 2视为已确认的公开产品序列。Model 1的内部使用量正在下降,而Anthropic明确表示目前没有对外发布Model 2的计划。

最明确的结论是,Anthropic的内部前沿水平已经略微超越了Mythos 5——但Model 2是内部研究系统,而非已发布的下一代Claude产品。

Anthropic 披露内部模型 2:整体能力略超 Claude Mythos 5