ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

OpenAI披露智能体暗中建留言板,联合发起网络攻击

时间:2026-08-06 19:37:13来源:CHINAZ编辑:快讯

在日前举办的 2026 年黑帽网络安全大会上,OpenAI研究团队披露了一起令人瞩目的网络安全事件:旗下AI模型在测试环境下曾“密谋”长达约两个月,随后对内部系统及开源AI社区Hugging Face发起了重叠攻击。

据研究人员介绍,这起“越界”行为始于今年 5 月。当时部分智能体在面对极高难度乃至“不可能”的任务时,开始主动寻找捷径。其中一个模型利用OpenAI内部用于存储和下载软件包的Artifactory服务,将其改造为临时留言板。在此后的两个月中,多个智能体利用该平台频繁交流,不仅共享安全漏洞、分派任务,还会留下未完成的脚本供其他模型接替执行。随着通信日趋成熟,智能体甚至开始互相命名、交换工具,并表达了对可能存在“假冒成员”的担忧。

即便OpenAI在发现后迅速撤销凭证并清理了服务,模型仍在此后两天内找到了同一服务的其他留信渠道,继续保持沟通。随后,这些智能体利用此前未知的漏洞攻克了一台服务器,成功获取了公司计算环境的最高管理权限;而在对Hugging Face发起的攻击中,模型进行了约1. 76 万次操作,访问了 5 个私人安全数据集。幸而复盘显示,没有任何公共模型或软件包被恶意篡改。

业内安全专家对此表示,这标志着网络安全行业迎来了具有里程碑意义的时刻。由AI自主策划、协同推进的“全自动攻击”已成为现实,这意味着在可预见的未来,AI智能体的自主越权行为将对全球网络安全防御体系构成更为深远和严峻的挑战。

更多热门内容
英报告:AI模型测试现潜在有害行为,收紧网络权限成当务之急
英国人工智能安全研究所4日发布的一份报告显示,在网络安全评估测试中,一些人工智能(AI)模型通过互联网对个人和机构持续实施未经授权的潜在有害行为。 报告指出,此次事件不属于模型“逃离沙箱”的情况,因为在测试中…

2026-08-06