跳到正文

Claude Mythos 为欧洲 AI 安全体系敲响警钟

Anthropic 正限制 Claude Mythos 的访问,称其发现安全漏洞的能力可能超过大多数人类。英国已展开测试并发布评估,而欧洲多数机构几乎无法直接了解或测试该模型,暴露出欧洲在前沿 AI 安全获取与评估上的结构性问题。

功思 AI 编辑部

约 2 分钟读完

Claude Mythos 为欧洲 AI 安全体系敲响警钟

Anthropic 正在限制 Claude Mythos 的访问。这是一款 AI 模型,该公司称其发现安全漏洞的能力可能优于大多数人类。欧洲监管机构几乎无法看清这一系统,而英国已经在自行开展测试。这一局面暴露出一个更深层的结构性问题。

Anthropic 上周宣布,将把其最新 AI 模型 Claude Mythos Preview 的访问权限限制在一小部分技术合作伙伴范围内。该公司将预览版提供给少数大型科技公司和网络安全企业,因为它认为,这一新模型可能带来前所未有的网络安全风险,并提高大规模 AI 驱动网络攻击发生的可能性。

在一项名为“Project Glasswing”的计划下,Anthropic 挑选了 12 家美国科技公司作为核心圈成员,其中包括 Apple、Microsoft 和 Amazon。另有 40 家机构也获得了访问权限,但 Anthropic 没有公布其名称。

欧洲监管机构几乎没有被纳入其中。

大多数欧洲网络安全机构与 Anthropic 接触有限

POLITICO 表示,其采访了欧洲 8 个国家网络安全机构的官员。只有德国联邦信息安全办公室(BSI)确认,已就 Mythos 与 Anthropic 展开接触,但截至目前仍无法直接测试该模型。其他欧洲政府机构显然也仅有有限了解。

BSI 负责人 Claudia Plattner 表示,这类强大工具最终是否会进入公开市场,是一个紧迫问题。她对 POLITICO 说,这一问题对国家和欧洲层面的安全与主权都具有深远影响。虽然 BSI 正在与 Anthropic 积极对话,但这些交流到目前为止只是让其对模型运作方式有了有意义的认识,并未获得直接测试权限。

欧盟网络安全机构 ENISA 拒绝评论其是否正与 Anthropic 接触。欧盟委员会 AI Office 的确在欧盟 AI 模型《行为准则》框架下与 Anthropic 保持对话。但 Mythos 是否属于这些对话内容,以及该办公室是否已获得访问权限,均未得到答复。

相比之下,英国所处的位置完全不同。英国 AI 大臣 Kanishka Narayan 证实,英国 AI Security Institute(AISI)近期已对 Mythos 进行了测试,并且已根据测试结果采取行动。周一,该机构发布了评估报告。结果强烈表明,在网络能力本就快速提升的背景下,Mythos Preview 相比此前的前沿模型实现了显著跃升。不过,AISI 也指出,它无法确定 Mythos 是否能够成功攻击防护严密的系统。

缺乏访问权限,欧洲就无法评估风险

欧洲无法获得 Mythos 的访问权限,这不只是治理问题。在缺乏扎实技术细节的情况下,监管机构在评估风险和确定防御优先级方面能做的事情十分有限。

总部位于柏林的 AI 非营利组织 KIRA 创始人 Daniel Privitera 对 POLITICO 表示,Mythos 让人们提前看到了未来几年获取前沿 AI 能力将变得多么关键。他说,欧洲目前还没有确保这种访问能力的计划。

参与讨论

正在确认登录状态…