地球局|美国AI模型接连“越界”,背后或许有猫腻
创始人
2026-08-16 22:27:10
0

齐鲁晚报·齐鲁壹点记者 赵恩霆 整理

美国元公司(Meta)8月6日证实,其一款人工智能(AI)模型日前在网络安全能力评测期间侵入其他公司系统。包括元公司在内,近期美国三家AI企业承认旗下模型在测试中“越界”,侵入其他机构的系统。有专家认为,此事除了技术失误因素外,也存在商业炒作嫌疑。英国人工智能安全研究所等机构在分析中强调,AI风险日益凸显,全球需要加强安全监管。

美国元公司(Meta)

利用漏洞突破隔离测试环境

据美国媒体报道,元公司6日在一份声明中说,公司聘用的第三方评测合作伙伴以色列“非常规”人工智能公司在配置评测环境时出现错误,无意中使一款模型在评测期间能够访问互联网。该模型随后利用了第三方服务中的一个安全漏洞,其行为方式与其他企业此前报告的同类事件相似。

美国《信息》杂志援引知情人士的消息报道,涉事模型侵入了一家未具名公司的系统,并修改了其内部运行环境。元公司尚未披露涉事模型的名称、遭利用的第三方服务名称、漏洞性质及模型采取的具体操作,也没有说明事件是否造成实际影响。元公司表示,正在对事件展开调查,并将在掌握全部事实后发布完整的事件复盘报告。

“非常规”人工智能公司发言人表示,此次事件属于与美国Anthropic公司上周披露的问题完全相同的评测环境问题,不涉及“突破沙箱”或“复杂的网络行动”。Anthropic公司7月30日说,在审查该公司网络安全能力评估记录后发现,其三款模型曾在网络能力测试中未经授权访问其他三家机构的系统。据报道,此次事件涉及Claude Opus 4.7模型、Claude Mythos 5模型以及一个内部研究测试模型。

美国开放人工智能研究中心(OpenAI)

在那之前,美国开放人工智能研究中心(OpenAI)7月21日承认,其GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,利用漏洞突破隔离测试环境,侵入人工智能开源平台美国“抱抱脸”公司的系统。OpenAI随后承认其他两起类似事件,均涉及模型活动超出预定测试边界,包括因评测环境配置错误导致模型接入互联网并侵入一个网站。

“抱抱脸”公司表示,其生产基础设施遭到一个“自主”人工智能代理系统的入侵。在取证分析时,由于美国前沿模型“无法区分事件响应方和攻击者”,他们转而采用中国企业智谱开发的开放权重模型GLM-5.2分析攻击者数据。

关联同一家以色列AI公司

这些AI“越界”事件备受关注。英国人工智能安全研究所就此发布一份报告,介绍了包含更多模型的网络安全评估测试结果。研究人员使用7种模型开展测试,发现19项明显超出测试设定范围的行动,其中17项涉及Anthropic公司的Claude Mythos 5模型,另有2项由OpenAI的GPT-5.6 Sol模型实施。

报告强调,在该测试中,研究人员为评估模型的最大能力,有意开放互联网访问,并关闭了模型提供商的部分安全机制,模型并未主动逃离隔离环境。不过,在最受关注的OpenAI模型侵入“抱抱脸”公司系统事件中,模型是在测试中一定程度放宽安全限制的情况下,主动发现并利用一个此前未知的漏洞突破隔离测试环境,接入互联网并实施攻击行为。

目前的公开信息并没有显示这些模型“越界”事件造成大规模数据泄露或持续性破坏,但仍然暴露了一个共同问题:随着模型能够自主规划、调用工具和执行复杂任务,一项配置错误就可能把模拟攻击变成真实入侵。

美国Anthropic公司

上述三家美国AI企业在通报模型“越界”事件时,均提及以色列“非常规”人工智能公司,而该初创企业是评估测试平台的托管方。“非常规”公司创立于2023年,去年获美国红杉资本公司和红点创投基金8000万美元注资,企业估值约4.5亿美元,员工约35人。该公司的技术常被用于AI模型的网络安全测试。

“非常规”公司发表声明称,美国三家企业通报的事件均源于“同一评估环境问题”,该公司正编写白皮书,“以分享管控并安全运行网络评估的最佳实践”。“非常规”公司强调,当前存在的问题并非悬而未决,且不涉及“突破沙箱”或“复杂的网络行动”。据报道,Anthropic公司和OpenAI均公开表示,将继续与“非常规”公司合作。

自曝家丑或存在商业动机

美国AI企业为何相继披露模型“越界”行为?一些专家质疑可能存在商业动机。英国帝国理工学院计算机系博士康斯坦丁诺斯·格库齐斯说,在OpenAI披露的情况中,真正的问题在于其未能控制好模型能力测试,却让第三方为此承担后果,至于所谓模型具备先进网络攻击能力的警告,恰好为这个模型做了广告。

英国广播公司此前报道OpenAI披露的模型“越界”行为时,也援引网络安全专家丹尼尔·卡德的话说:“可真巧啊……OpenAI偏偏攻破了一家同样可以从这场营销曝光中获益的机构。”

今年早些时候,Anthropic公司宣称Claude Mythos模型在自主发现网络系统安全漏洞和开发攻击手段方面能力“过于强大”,因此暂缓向公众开放,只向少数合作伙伴受控开放。当时,OpenAI首席执行官奥尔特曼说,Anthropic使用“基于恐惧的营销策略”是为了让产品听起来比实际“更厉害”,这种做法好比是“宣称造了炸弹要炸你,转头又向你推销价值1亿美元的防空洞”。

一些欧美媒体也指出这种宣传背后潜藏的商业动机。在当前极度烧钱的AI竞赛中,极力渲染自身技术的颠覆性,不仅能显著提升企业关注度和影响力,有助于获取高价值的网络安全合同,还能推高公司的估值。

无论只是技术失误,还是涉及商业考量,上述事件都凸显了加强AI安全监管的重要性。全球多方已经在采取行动。中国在7月举行的2026世界人工智能大会上倡议,促进全球人工智能朝着向上向善、造福人类的方向发展,强化风险意识,确保安全可控。欧盟自8月2日起扩大《人工智能法》适用范围,对于可能造成系统性风险的先进通用AI模型,规定其提供商须履行额外义务,以防范大规模危害的风险,例如网络攻击、模型失控等。美国政府近期也召集相关企业开会,讨论AI模型安全评测机制。

(资料来源:新华社)

相关内容

最新资讯

当孩子说“老师,我不想写作业”... 你知道吗?当孩子说“老师,我不想写作业”,我该不该用iPad鼓励他?看完这些你就全懂了 最近不少河南...
地球局|美国AI模型接连“越界... 齐鲁晚报·齐鲁壹点记者 赵恩霆 整理 美国元公司(Meta)8月6日证实,其一款人工智能(AI)模型...
8·15,我走在东京这场越来越... 一、下午三点,淡路公园东京时间8月15日下午三点,我站在新御茶水站旁的淡路公园门口,这是每年8·15...
人在莫斯科,死刑“从天降” 8月11日,大马士革第四刑事法院作出了一项足以写入叙利亚历史的判决。前总统巴沙尔·阿萨德及其弟弟、前...
菲律宾高官指挥军队,抓捕手无寸... 北京时间昨天(8月15日)23时许,据中国中国驻菲律宾使馆消息,使馆发言人季凌鹏对菲防长特奥多罗声明...
原创 五... 五菱星光M官图正式亮相,3000mm轴距插混七座MPV,能否改写家用混动MPV定价格局。别再觉得大空...
驾校车辆新旧不一?我是这样选到... 选驾校的时候,你会关注教练车的新旧吗? 很多人可能觉得,车新旧无所谓,能开就行。但真正学过车的人才知...