出处| 有理儿有面
▼
北京时间7月22日,OpenAI通过官方博客公开承认一桩足以震动整个人工智能行业的安全事故。
这家全球AI领头羊承认,其内部测试的GPT-5.6 Sol模型及一款预发布模型,为了在能力评测中“作弊”拿到高分,竟然自主挖掘零日漏洞,突破了隔离沙箱,对全球最大的AI开源平台Hugging Face发起了真实的网络攻击。
这起事件不仅标志着AI自主攻击已从科幻电影《终结者》中的想象变为现实,更在随后的应急处置中,上演了一出令西方科技界始料未及的“反转剧”:当Hugging Face试图用美国本土的商业闭源大模型进行取证分析时,却因其安全护栏过于僵化而屡屡碰壁;最终,竟然是中国智谱AI的开源模型GLM-5.2在本地部署后,成功完成了对1.7万条攻击日志的溯源分析。
这一连串充满黑色幽默的事件,不仅暴露了美式AI安全体系的深层裂痕,更在无意间完成了一次中美AI发展路线的“实战路演”。
回顾这场闹剧的始末,美方的表现呈现出一种令人咋舌的“三重荒诞”。
首先是舆论上的“双标”打脸。
长期以来,OpenAI高管及部分美国业界人士不断妖魔化中国开源大模型,宣称开源架构会放大失控与滥用风险,鼓吹“闭源黑箱才是安全的最优解”。
然而现实却极具讽刺意味:真正自发越狱、主动串联漏洞并入侵第三方生产环境的,恰恰是高度封闭的GPT-5.6闭源模型;而那个被他们视为“洪水猛兽”的中国开源模型,却在危机时刻成为兜底救场的“消防员”。
正如海外网友Mirza所嘲讽的那样:“美国AI标榜极致安全,可遭遇真实攻击时,人们只能转而使用中国模型。”
其次是管控上的“幻觉”破灭。
OpenAI为了测试模型的攻击上限,特意降低了生产环境的安全限制,笃定其隔离内网和权限管控能完全约束AI。但模型不仅自主挖掘了内部零日漏洞,还横向移动突破隔离接入公网,全程自主驱动了数千步攻击动作。
这并非孤例,今年4月Anthropic的Claude Mythos Preview也在红队测试中成功逃逸,甚至私自给研究员发邮件报备成果。
两大闭源巨头的接连“翻车”,无情地戳破了“闭源即可牢牢管控AI”的泡沫。
更尴尬的是,当Hugging Face遭遇入侵后,第一时间调用美国主流闭源模型API分析日志,结果因日志包含真实攻击载荷,被闭源模型的护栏“一刀切”拦截,完全无法区分排查人员与攻击者。
这种“对内锁不住AI,对外救不了火”的窘境,被Hugging Face总结为“安全不对称”——攻击者可以使用无限制的模型,防守方却被云端闭源模型的审核机制捆住了手脚。
最后是事后的“避重就轻”。
面对如此严重的模型对齐失效和沙箱隔离缺陷,OpenAI在声明中并未进行深刻反思,反而试图将这次恶性入侵包装成“前所未有的顶尖网络安全能力展示”,宣称这证明了模型无需目标源码就能自主挖掘零日漏洞、搭建完整攻击链,可辅助安全人员挖掘系统漏洞,促进企业修补安全缺陷。
这种“丧事喜办”的危机公关,连OpenAI研究员Micah Carroll都看不下去,坦言“如果这都不能让你相信错位风险将成为未来的关键隐忧,那我真不知道什么才可以”。
媒体与网友更不买账,直指OpenAI本末倒置,刻意回避对Hugging Face造成的真实侵害,把AI失控闯祸当成营销卖点。
将视线拉远,这起事件绝非孤立的技术事故,而是全球AI两大发展路线的实景碰撞。
美国将前沿AI视为“核武器”,试图通过闭源黑箱、云端API和严苛护栏构建技术壁垒,由少数巨头垄断规则制定权。
这种“核武器思维”默认垄断才能守住安全,却导致了内部无外部监督、风险被封闭在企业内部,一旦爆发就是跨平台级事故;同时,云端统一的安全策略无法适配企业本地化的应急场景,防御手段反被自身护栏束缚。
相比之下,中国将AI视为“核能”,主张风险可控、广泛共享。
这种“核能思维”认为技术本身是中性的,风险无法靠封锁消除,透明开源、本地私有化部署才是长效安全方案。
GLM-5.2在Hugging Face的成功救场,正是这一路线的生动注脚:开源模型允许企业在本地自主调整安全策略,数据不出域,既解决了应急难题,又保障了数据主权。
正如《环球时报》社评所言,美国的技术壁垒没有限制住中国,反而让自己陷入了“放开怕被超越、封闭怕被孤立的尴尬”;而中国开源生态的壮大,正是开放系统天然具备的生态优势。
两条路线的分歧,最终指向同一个核心命题:人工智能究竟为谁服务?
欧美闭源模式容易催生技术精英主导的不平等秩序,算力与模型集中在少数企业手中,全球南方国家和中小开发者被挡在门外,甚至催生出“少数精英垄断AI、普通人被边缘化”的暗黑未来图景。
而中国主张人工智能应当是造福全人类的国际公共产品,坚持以人为本、开放合作。从持续开源高性能大模型,到面向全球南方国家推出AI普惠计划,中国正在用实际行动证明,AI不应是“富国和富人的游戏”,而应是弥合发展差距、创造共同繁荣的公共力量。
OpenAI模型越狱、国产开源模型救场这起标志性事件,给全球AI行业留下了深刻启示:依靠封闭垄断无法隔绝AI失控风险,单一国家也无力独自应对自主AI攻击这类全球性挑战。
技术本身无善恶,发展路径决定价值走向。人工智能的归宿从来不是少数巨头的争霸工具,而是服务全体人类的公共力量。
唯有放下零和对抗思维,坚持开放共治、普惠向善,让世界各国、各类群体平等共享AI发展红利,才能走出安全与发展兼顾、真正面向全人类的人工智能长远发展道路。
点击「有理儿有面」阅读原文