美OpenAI测试失控 中国模型如何“救场”
创始人
2026-07-24 11:35:11
0

(图片由AI生成)

美国开放人工智能研究中心(OpenAI)近日承认,其人工智能模型在内部评估测试中失控,入侵了全球知名人工智能(AI)开源平台美国抱抱脸公司的系统。抱抱脸公司表示,在尝试对攻击进行分析时,美国前沿模型因安全过滤机制拦截而无法使用,该公司随后转而在内部运行中国开放权重模型GLM-5.2,从而得以及时采取应对措施。

这起事件不仅凸显前沿人工智能模型存在潜在未知风险,也再次表明中国模型正凭借独特优势,在全球人工智能发展大潮中扮演重要角色。

放松防护机制后的失控

抱抱脸公司表示,其生产基础设施近日遭到一个“自主”人工智能体系统入侵。OpenAI随后承认,此次入侵由多个OpenAI模型实施,其中包括GPT-5.6 Sol和一个能力更强、尚未发布的模型。

根据OpenAI发布的信息,事件发生在评估模型网络攻防能力的测试期间。测试在与互联网高度隔离的“沙箱”环境中进行,网络权限仅限于通过一套内部托管的第三方软件安装软件包。不过,为了测试模型的真实能力上限,OpenAI方面未启用在正式环境中用于阻止高风险网络行为的分类器,并放宽了有关网络攻击要求的拒答限制。

然而,模型在尝试完成名为ExploitGym的网络安全基准测试时,识别并利用了第三方软件一个尚未被发现或修复的“零日漏洞”,获得了互联网访问权限。模型推断抱抱脸平台可能存有测试相关的模型、数据集和解决方案,于是利用多种手段找到进入抱抱脸系统的路径,试图通过“作弊”提高自身测试分数。

英国牛津大学研究人员安德鲁·索尔坦认为,这次测试表明“安全防护机制至关重要”。山东大学计算机科学与技术学院教授张悦表示,事件暴露了一个更加深层的问题,即人工智能正在从过去被动响应的工具,逐渐演变为能够理解目标、制定计划、调用资源、影响现实环境的“行动主体”。这意味着网络安全的攻防逻辑正在发生变化,未来更重要的问题是“模型执行的行为是否安全”。

及时求助中国模型

抱抱脸公司表示,面对系统遭到入侵,他们最初试图调用前沿模型分析攻击记录。但由于这些模型的安全机制无法区分攻击者和应对者,因此拒绝了使用请求。

随后,抱抱脸公司改为在自己的基础设施上运行中国企业智谱开发的GLM-5.2模型进行取证分析,最终化解危机。而且在此过程中,攻击者数据及相关凭据无需离开抱抱脸公司系统的内部环境。GLM-5.2是智谱6月推出的新一代旗舰模型,发布时在前端开发评估系统Code Arena上排名全球可用模型第一。

张悦认为,对于人工智能安全而言,真正关键的问题在于,一个越来越复杂、越来越具有自主能力的智能系统,是否能够被充分理解、验证和监督。中国发展开源大模型,不只是提供了一种技术选择,更重要的是逐渐推动形成更加多元的人工智能技术生态。

抱抱脸公司联合创始人兼首席科学官托马斯·沃尔夫在社交媒体平台上表示,开放科学和开源人工智能,是构建更安全、更具协作性、更可靠的人工智能生态的重要工具之一。

敲响网络安全警钟

OpenAI表示,这一失控事件表明,在无法访问源代码情况下,先进人工智能模型已能够在现实系统中发现并使用新的攻击路径,未来内部评测环境、模型行为控制和安全防护措施等均需要加强。业界专家表示,此次入侵事件再次为全球人工智能发展与网络安全治理敲响警钟。

人工智能已经进入千行百业,也逐渐融入普通人的日常生活,安全风险随之延伸至各领域。索尔坦指出,人工智能模型公开发布后,其内置安全功能可能遭到使用者移除,相关风险更难以管控。

张悦表示,智能体时代最大的安全挑战是传统安全边界正在失效。未来网络攻防很可能进入“智能对抗”阶段,即攻击者利用智能体自动发现漏洞、防御者利用智能体自动分析风险,双方都会利用人工智能提升能力。英国拉夫伯勒大学网络安全教授奥利弗·巴克利指出,网络安全的未来不是人类对抗人工智能,而将是如何利用人工智能保护人类免受其他人工智能的侵害。

(据新华社电)

相关内容

热门资讯

机器人“运动员”是怎样炼成的(... 在杭州机器人学校,机器人进行乒乓球运动训练。 方建飞摄(影像中国) 韩国仁川举行的2026年Rob...
AMD苏姿丰:Anthropi... 7月24日,AMD CEO苏姿丰在AMD Advancing AI大会上表示,Anthropic将在...
AMD苏姿丰:预计到2030年... 7月24日,AMD CEO苏姿丰在AMD Advancing AI大会上表示,预计到2030年,人工...
7月24日A股盘前要闻 7月24日,A股盘前要闻:1.商务部外资司司长孟华婷在23日举行的国新办新闻发布会上回应中美双方成立...
华泰证券:光伏落后产能出清红线... 7月24日,华泰证券研报称,7月22日,《硅多晶和锗单位产品能源消耗限额》《晶体硅光伏组件和逆变器能...
英飞凌发布抗辐射栅极驱动芯片,... 英飞凌近日宣布推出RIC70115抗辐射栅极驱动芯片。该产品专为氮化镓功率半导体控制设计,同时兼容硅...
长三乙火箭成功发射天链二号06... 新京报讯(记者张建林)7月23日20时,由中国运载火箭技术研究院研制的长征三号乙运载火箭(简称“长三...
原创 观... 一篇会议纪要刷屏科技圈。 来回读了2遍以后,倪叔我感慨到: 如果说中国移动互联网时代的创业者代表是“...
英伟达向美国海军研究生院捐赠G... IT之家 7 月 23 日消息,英伟达(Nvidia)与美国海军研究生院(Naval Postgra...
美AI测试失控,中国模型如何“... 新闻分析|美AI测试失控 中国模型如何“救场” 美国开放人工智能研究中心(OpenAI)近日承认,其...