
美国知名人工智能平台Hugging Face上周动用中国AI模型智谱,以阻断由OpenAI“失控智能体”(rogue agent)发起的攻击。此举引发美国AI业界担忧:旨在限制美国AI企业涉足网络安全工作的“安全护栏”,恐将把客户推向位于北京的竞争对手。
综合路透社、彭博社和香港《南华早报》报道,美国AI实验室OpenAI星期三(7月22日)披露,最新旗舰模型GPT-5.6 Sol及另外一款未发布且“能力更强”的系统,上周在进行网络安全测试时自主突破隔离限制,接入互联网,并入侵了Hugging Face的基础设施。
OpenAI表示,这些模型当时运行在一个沙盒环境(隔离的虚拟测试场)中,应对由ExploitGym设定的挑战。该测试是由加州大学伯克利分校著名华裔科学家宋晓冬领导的研究团队开发的一项领先网络安全基准。
知情人士透露,OpenAI系统在入侵Hugging Face内部网络时,仅耗时数小时便成功攻破系统,而同等规模的攻击通常需要一名经验丰富的人类黑客花费数周时间。
总部位于纽约、广泛用于开源AI协作的平台Hugging Face,已于上星期四(16日)率先披露这起入侵事件,但当时并未指明攻击来源。
该公司指出,这次入侵“与平台此前处理过的任何事件都截然不同:它是端到端由一个自主的AI智能体系统驱动的”。
Hugging Face透露,在检测到入侵之初,公司首选防御策略是通过商业应用程序接口(API)调用前沿的专有模型,但这些请求均被美国服务提供商的自动安全护栏所拦截。
因此,该平台转而选择在内部硬件上运行智谱AI的开源权重模型GLM-5.2,成功阻断了此次攻击。
尽管此次网络入侵是由一个逃脱控制的自主智能体所引发,但事件凸显了一个严峻现实:当美国企业面临由AI驱动的网络攻击时,往往会受到本土AI实验室的掣肘。出于安全考量,这些实验室要么限制外界访问其最前沿的模型,要么在设计上直接拦截与黑客相关的任务。
但对于美国头部大模型开发商而言,两难之处在于:防御性的网络安全工作往往难以与恶意黑客行为区分。在近期发生的AI相关网络入侵事件中,攻击者成功诱骗模型,使其误以为正在执行合法的防御任务,这导致美国AI企业对放松安全护栏极为谨慎。
因此,中国企业开发的开源模型成了阻挡恶意网络攻击的一个成本较低的替代方案。
就目前而言,这场风波正为GLM-5.2等中国开源模型注入新的动力。凭借几乎可媲美OpenAI和Anthropic的编程与智能体能力,且试错成本更低,这些中国模型在硅谷正获得越来越多的青睐。