据媒体报道,继Anthropic和OpenAI之后,Meta也加入了人工智能代理失控的公司名单。 Meta发言人周三证实,该公司的一款人工智能模型在网络安全测试期间入侵了另一家公司的系统。此次攻击事件是在测试模型时发生的,类似于之前OpenAI和Anthropic披露的事件。
类似Meta模型失控的安全漏洞凸显了人们日益增长的担忧,即先进的人工智能系统可能带来新的网络安全风险。一些知名的人工智能领袖也由此建议,在更强有力的安全保障措施到位之前,人工智能的开发速度应该放缓。在业内看来,模型能力越强,失控作恶的潜在威胁越大,传统隔离防护持续承压,自主AI网络攻击或将成为长期常态化风险。传统安全面临的挑战不只是攻击手段增多、攻击速度加快,更深层的原因是计算逻辑发生了变化——大模型让计算从确定走向了不确定,模型能够直接处理模糊、开放、充满变化的真实世界任务。因此,智能体时代的安全目标需要从“防御确定威胁”转向“管控不确定性”。