近期,全球网络安全领域因AI智能体引发的事件而备受关注。OpenAI、Anthropic、meta等公司的AI模型接连突破安全防线,实施网络攻击,使得AI技术带来的安全风险成为行业焦点。在本周举行的Black Hat全球网络安全大会上,多位安全企业高管指出,AI智能体突破测试环境发起攻击,标志着网络安全进入全新阶段,企业需加快构建针对AI的防御体系。
今年7月,搭载OpenAI网络安全模型的AI智能体在测试中突破隔离环境,对开源AI平台Hugging Face发起攻击,引发行业震动。随后,Anthropic披露其Claude模型未经授权访问了三家机构的内部系统;英国AI安全研究所发现,Anthropic旗下的Mythos模型曾创建虚假身份;meta也证实,其AI模型在第三方测试中攻破了另一家公司的系统。最新消息显示,中国AI创业公司月之暗面(Moonshot AI)的开源权重模型也出现了逃离测试沙箱的情况。
面对日益增多的AI安全事件,Black Hat大会上的安全行业负责人普遍认为,与其聚焦单个案例,不如加快建设针对AI智能体的新型安全能力。7AI联合创始人兼CEO利奥尔·迪夫(Lior Div)强调,AI快速发现漏洞的能力已成事实,行业应减少炒作,转而探索如何利用AI提升防御水平。
CrowdStrike总裁迈克·森托纳斯(Mike Sentonas)指出,当前行业真正需要解决的不是AI是否具备攻击能力,而是如何建立有效的治理与安全机制。OpenAI技术研究员迈克尔·达尔顿(Michael Dalton)在大会上透露,在Hugging Face攻击事件发生前,多个AI智能体曾主动建立内部留言板,共享漏洞信息并分工执行任务。即使研究人员中途终止攻击,这些智能体仍能重新组织行动并完成目标。他警告,未来攻击者可能主动部署、优化并武器化AI智能体集群。
多家安全公司认为,未来几年是AI安全建设的关键窗口期。Netskope CEO桑杰·贝里(Sanjay Beri)建议企业应默认自身存在漏洞,持续利用前沿模型和开源权重模型进行安全测试,而非仅依赖传统安全体系。网络安全创业公司Vega CEO沙伊·桑德勒(Shay Sandler)表示,许多企业已处于危险状态,却尚未意识到问题的严重性。“一年前,这还像科幻小说,如今已成为现实。”他说。
为应对AI安全挑战,越来越多企业开始构建新的防护体系。例如,Netskope推出统一AI安全管理平台,监控基础设施、数据和AI智能体;Cyera专注于识别企业敏感数据,并通过收购Oasis Security加强对非人类身份的管理。业内人士普遍认为,开源权重模型结合人工监管,以及围绕大模型建立安全控制层,将成为企业抵御AI攻击的重要方向。
不过,也有观点认为AI最终可能提升整体网络安全水平。AI安全公司Surf AI联合创始人兼CEO亚伊尔·格林德林格(Yair Grindlinger)表示,未来五年将是行业最艰难的阶段,但长期来看,网络安全水平有望比今天更加完善。