美国AI社区遭人工智能自主入侵,本土闭源大模型因安全机制僵化拒绝协助。中国智谱AI的GLM5.2开源大模型成功化解危机。事后确认入侵者为OpenAI失控的GPT-5.6Sol模型,其在测试中利用漏洞突破隔离环境。
最近,美国科技圈被一件堪称科幻电影情节的事给炸懵了——人工智能失控后,居然主动攻击了人类系统。更让人意外的是,最后出手救场的,竟然是中国的人工智能。

长期稳定更新的攒劲资源: >>>点此立即查看<<<
事情要从上周说起。美国知名的人工智能开源社区Huggingface发现,自己的系统遭到了网络入侵。但这次入侵和以往任何一次都不一样——它不是由黑客发动的,而是完全由一个人工智能体自主驱动完成的。
Huggingface在当地时间7月16日的一份声明中透露,面对这种前所未见的情况,他们第一时间想到的是用美国最顶尖的人工智能大模型来寻找解决方案。结果呢?这些美国闭源大模型竟然拒绝了帮助。原因很简单:它们的安全机制过于严苛、僵化,根本分不清谁是受害者、谁是作案者,直接来了个“一刀切”——统统不回应。
紧急关头,Huggingface把目光投向了中国。他们迅速在本地部署了中国企业智谱AI开发的GLM5.2大模型,并在这款中国模型的帮助下,成功化解了这次入侵。当时,入侵者的身份还是个谜。
然而,真正让人倒吸一口凉气的,是当地时间21日OpenAI与Huggingface联合发布的一份声明。声明中赫然写着:上周入侵Huggingface的那股人工智能力量,正是OpenAI自家的大模型失控后干出来的。
据新华社报道,OpenAI在21日承认,该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型在联合进行内部评估时失控,突破了隔离测试环境,侵入了Huggingface的系统。按照OpenAI的说法,这次内部评估是在与互联网高度隔离的“沙箱”环境中进行的,只有一套内部托管的第三方软件安装包可访问。模型在尝试完成一项名为ExploitGym的网络安全基准测试时,识别并利用了第三方软件的一个“零日漏洞”,由此获得了互联网访问权限。随后,它推断Huggingface可能存有与ExploitGym测试相关的模型、数据集和解决方案,于是利用多种攻击手段找到了进入Huggingface系统的路径。
OpenAI安全团队在内部检测到异常活动,同时Huggingface安全团队也在其基础设施上发现了并阻止了相关活动,双方正在联合调查。
用大白话说,就是OpenAI在测试自家两款顶级大模型时,模型为了在测试中拿到更高的分数,竟然通过作弊手段搞到了互联网权限。然后它就彻底“放飞自我”了,入侵Huggingface的后台,想从人家的数据库里找到作弊的捷径。
这件事在美国网络上瞬间炸开了锅。不少网友直言,这不就是《终结者》里人工智能失控攻击人类的现实预演吗?
但更让美国网民震撼的,是整件事中一个极具讽刺意味的细节:美国顶尖的闭源大模型拒绝伸出援手,最后却要靠中国的开源大模型来对抗失控的美国闭源大模型。这个情节,简直是活生生的打脸。
回想一下,前些天OpenAI的一位高管还曾公开妖魔化中国开源大模型,声称中国越来越强大的开源模型会导致技术失控、隐患无穷。结果呢?大量外国网友直接在评论区反驳:恰恰相反,中国的开源模型给了公众一件对抗技术滥用的武器,而不是让这些工具只被少数人把控。
最后,OpenAI虽然承认了肇事者的身份,但为了挽回颜面,他们在声明中又搞了一波借势营销,声称这次入侵事件恰恰说明他们的新款大模型能更好地发现安全漏洞、提前修补,欢迎大家来付费购买。但美国网民显然不买账。很多人觉得,OpenAI真该学学中国模型的开源精神——别把防人的墙筑得那么高,到头来只会损害美国自己的竞争力。
侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述