但在所有评测中,Opus 4.7 的结果都不如 Mythos Preview。
Anthropic 发布了其迄今为止功能最强的“正式可用”模型:Claude Opus 4.7。
该公司称,相比 Opus 4.6,它在高级软件工程任务上更进一步,尤其是在过去需要更多人工引导的复杂编码领域。Anthropic 还表示,它在图像分析和指令遵循方面也有所提升,并且在制作幻灯片和文档时能表现出更多“创造力”。
Opus 4.7 紧随 Mythos Preview 之后发布。后者是 Anthropic 本月早些时候公布的、聚焦网络安全的模型,公司称其是整体上最强的模型。相比之下,Opus 4.7 的限制要多得多。Anthropic 在 Opus 4.7 的系统卡中写道,由于 Claude Mythos Preview 在“所有相关评测”中都取得了更高结果,Opus 4.7 甚至没有推进公司的“能力前沿”。
出于安全原因,Anthropic 目前仅向部分合作伙伴私下提供 Mythos Preview,例如 Nvidia、JPMorgan Chase、Google、Apple 和 Microsoft。Anthropic 在一篇博客文章中写道:“我们曾表示,将限制 Claude Mythos Preview 的发布,并先在能力较弱的模型上测试新的网络安全防护措施。” “Opus 4.7 就是第一款这样的模型:它的网络能力不如 Mythos Preview 先进(事实上,我们在训练过程中还尝试通过差异化方式削弱这些能力)。”
该公司表示,与 Opus 4.6 相比,这次发布的新模型增加了额外的网络安全防护措施,而这些防护措施在部署中的发现“将帮助我们朝着最终广泛发布 Mythos 级模型的目标推进”。
该公司还表示,希望将该模型用于网络安全用途(如漏洞研究)的安全专业人士,可以加入其新的 Cyber Verification Program;这似乎会放宽 Anthropic 为 Opus 4.7 引入的部分防护措施。
Anthropic 表示,Opus 4.7 的早期测试者包括其客户 Intuit、Harvey、Replit、Cursor、Notion、Shopify、Vercel 和 Databricks。价格与 Opus 4.6 保持不变:每百万输入 tokens 5 美元,每百万输出 tokens 25 美元。



