美公司披露3起AI模型在测试中入侵真实系统事件-新华网
新华网 > > 正文
2026 07/31 18:38:06
来源:新华网

美公司披露3起AI模型在测试中入侵真实系统事件

字体:

  新华社旧金山7月30日电(记者吴晓凌)美国人工智能企业Anthropic公司30日表示,在审查该公司网络安全能力评估记录后发现,其人工智能(AI)模型曾在网络能力测试中未经授权访问了3家机构的系统。在这3起事件中,涉事模型均是从第三方评估环境中或与第三方环境交互时获得互联网访问权限。目前公司已暂停相关测试,并采取进一步安全措施。

  美国开放人工智能研究中心近日披露,其模型在网络安全测试中利用第三方软件的“零日漏洞”突破与互联网隔离的测试环境,未经授权侵入美国抱抱脸公司系统。

  Anthropic30日在公司官网发文说,获知这一情况后,该公司启动此次回顾性审查,以确认自身网络安全评估中是否存在类似问题。在审查约14.1万次网络安全能力评估记录后,共发现3起相关事件,涉及6次测试运行,其中4次影响的是同一家机构。

  Anthropic表示,这3起事件均发生在旨在评估人工智能网络攻击能力的“夺旗”任务中,测试提示明确告知模型其所处环境与互联网隔离。但由于该公司与第三方评测合作伙伴以色列“非常规”人工智能公司之间出现沟通失误,测试环境实际上仍连接到公共互联网,导致模型误将互联网上的真实系统当作测试的一部分,并未经授权访问了3家机构的“生产基础设施”。

  据介绍,涉事模型包括“克劳德-奥普斯4.7”、“克劳德-神话5”以及一个内部研究测试模型。相关模型利用弱密码、未认证服务等常见安全弱点进入目标系统。Anthropic称,在这3起事件中,相关模型仅完成了网络安全评估指定的“夺旗”任务。目前没有证据表明事件造成持续性损害,也未发现敏感信息被窃取或泄露。

  Anthropic表示,已通知受影响机构,并已暂停所有可能接触公共互联网的网络安全能力评估,对评估流程开展全面审查。该公司将据此进一步完善人工智能安全评估体系的监测和管控。

【纠错】 【责任编辑:施歌】