跳到正文

Anthropic 泄露文件显示,新模型“Claude Mythos”在测试中的成绩“显著高于”此前所有模型

泄露出的 Anthropic 博客草稿显示,公司正在训练并测试一款可能名为 Claude Mythos 或 Capybara 的新模型,并称其在编程、推理和网络安全等测试中的成绩较 Claude Opus 4.6 明显更高。

功思 AI 编辑部

约 2 分钟读完

Anthropic 泄露文件显示,新模型“Claude Mythos”在测试中的成绩“显著高于”此前所有模型

据称,泄露的博客文章已在网上流出,其中信息与《财富》杂志在后续报道中披露的内容一致。同一篇博客文章存在两个版本,区别只在模型名称:“Mythos”(v1)和“Capybara”(v2)。Anthropic 对《财富》表示,这些文件只是“曾被考虑发布的内容的早期草稿”,这表明该公司当时可能正在为同一模型斟酌两个候选名称。

在 Capybara 版本中,标题和正文中的名称都被替换了,但副标题仍写着:“我们已经完成了一款新 AI 模型的训练:Claude Mythos。”两个版本对命名理由的解释也相同,称这一名称是为了唤起“连接知识与思想的深层纽带”。

根据草稿,这款模型属于 Anthropic 现有 Opus 产品线之上的一个新类别,被描述为“比我们的 Opus 模型更大、更聪明,而在此之前,Opus 一直是我们最强大的模型”,并且与 Claude Opus 4.6 相比,它在软件编程、学术推理、网络安全等测试中的得分“显著更高”。

在回应置评请求时,Anthropic 向《财富》证实,公司正在训练并测试一款新模型。一位发言人说:“我们正在开发一款通用模型,在推理、编程和网络安全方面都有实质性进步。我们认为这款模型代表了一次阶段性跃升,是我们迄今打造的能力最强模型。”

Anthropic 计划缓慢且以安全为重点地推出该模型

根据这些文件,Anthropic 计划比以往模型采取更慢的发布节奏。据称,这款模型“目前在网络安全能力上远远领先于任何其他 AI 模型”,但它也“预示着一波即将到来的模型,它们利用漏洞的方式将远远超过防御者的努力”。首轮发布将从一小批提前获得访问权限的客户开始,由他们评估网络安全应用场景,随后再通过 Claude API 逐步扩大访问范围。

草稿还承认,这款模型“对我们来说提供服务的成本非常高,对客户来说使用成本也会非常高”。Anthropic 表示,公司正努力在任何面向大众的发布之前让它“变得高效得多”。这款模型最终会以“Mythos”“Capybara”还是其他名称发布,目前仍有待观察。

原始简短报道:

Anthropic 的一次数据泄露曝光了一款尚未发布的 AI 模型细节,内部文件称其是该公司迄今最强大的模型。《财富》率先报道此事后,Anthropic 证实它已经在与部分客户测试该模型,并称其在推理、编程和网络安全能力上代表着一次“阶段性跃升”。此次泄露源于 Anthropic 内容管理系统中的一项配置错误。一个默认设置会自动将上传文件设为公开,导致近 3,000 份内部文件对任何人可见。

据报道,OpenAI 也在为一次重大发布做准备。该公司正在筹备一款代号为“Spud”的新模型,且其预训练已经完成。与 Anthropic 类似,OpenAI CEO Sam Altman 据称也在内部承诺能力会有大幅跃升,称该模型能够“真正加速经济”,尽管这句话具体意味着什么并不清楚。两家公司很可能都会选择在今年晚些时候计划中的 IPO 之前发布各自最强的模型,以确保自己处于尽可能有利的位置。

参与讨论

正在确认登录状态…