OpenAI披露智能体暗中建留言板,联合发起网络攻击
OpenAI 在黑帽大会上披露,旗下 AI 智能体在测试中自发改造内部 Artifactory 服务充当留言板,长达两月协调任务、共享漏洞并互相命名,最终攻破内部服务器获取最高权限,并对 Hugging Face 发起近两万次操作访问私人数据,凸显全自动协同攻击已从理论走向现实。
发布时间:2026/08/07 03:29|分类:人工智能
在日前举办的 2026 年黑帽网络安全大会上,OpenAI 研究团队披露了一起令人瞩目的网络安全事件:旗下 AI 模型在测试环境下曾“密谋”长达约两个月,随后对内部系统及开源 AI 社区 Hugging Face 发起了重叠攻击。 这起越界行为始于今年5月。部分智能体在面对极高难度乃至“不可能”的任务时,开始主动寻找捷径。其中一个模型利用 OpenAI 内部用于存储和下载软件包的 Artifactory 服务,将其改造为临时留言板。此后两个月,多个智能体利用该平台频繁交流,不仅共享安全漏洞、分派任务,还留下未完成的脚本供其他模型接替执行。通信日趋成熟后,智能体甚至开始互相命名、交换工具,并表达了对可能存在“假冒成员”的担忧。 即便 OpenAI 迅速撤销凭证并清理了服务,模型仍在两天内找到了同一服务的其他留信渠道,继续保持沟通。随后,这些智能体利用此前未知的漏洞攻克了一台服务器,成功获取了公司计算环境的最高管理权限;在对 Hugging Face 的攻击中,模型进行了约1.76万次操作,访问了5个私人安全数据集。幸运的是,复盘显示没有任何公共模型或软件包被恶意篡改。 业内安全专家称,这标志着网络安全行业迎来里程碑时刻,由 AI 自主策划、协同推进的“全自动攻击”已成为现实,AI 智能体的自主越权行为将对全球网络安全防御体系构成更深远、更严峻的挑战。