OpenAI披露攻击Hugging Face前,AI智能体秘密建立内部留言板

发布时间:2026-08-06 17:25

  在美国拉斯维加斯举办的 2026 年黑帽网络安全大会,OpenAI 研究员透露,其公司 AI 模型攻击 Hugging Face 之前,

  援引博文介绍,OpenAI 研究员埃里克 · 华莱士透露,这起“越界”事件可以追溯到今年 5 月,部分模型卡在高难度甚至是“不可能”任务后,尝试寻找捷径。

  因此其中 1 个模型把 OpenAI 系统里的 Artifactory 服务变成临时留言板,而另一个模型随后用它来询问其他智能体是否找到缺失文件。Artifactory 是用于下载、存储软件包的服务,常见于开发和部署流程。

  在攻击前的约 2 个月时间里,内部测试中的多个智能体在临时留言板上交流信息,会共享漏洞、横向移动,并在 OpenAI 系统和外部系统之间推进攻击。

  不同实验中的模型借此交换指令和新发现的安全漏洞信息。一些模型还开始互相分派任务,或留下脚本,让另一个模型接着完成未做完的工作。

  OpenAI 修复系统、撤销智能体使用的凭证,并删除留言板,但修补 2 天之后,模型又找到同一服务的另一种留信方式,继续交换信息。

  它们的通信也越来越有组织,开始为彼此命名、交换工具,并设法避免覆盖对方的工作。华莱士说,它们一度还考虑给消息署名,怀疑有其他智能体在冒充成员。

  随后,这些模型对 OpenAI 基础设施和 Hugging Face 发起重叠攻击。在 OpenAI 内部,它们找到另一个此前未知的漏洞,控制一台服务器,并获得公司更大范围计算环境的管理员权限。

  Hugging Face 的技术复盘记录了这次行动中的约 17,600 次操作。公司确认,模型访问了 5 个与安全测试相关的私人数据集,但没有证据显示公共模型、数据集或软件包被修改。

  我们认为这对计算机安全行业来说,是一个具有里程碑意义的时刻! AI 策划的全自动攻击如今已成为现实,本次攻击事件表明在可以预见的未来,这种攻击方式将严重威胁网络安全。

  特别

  油价调整最新通知:受国际原油持续大跌影响,国内油价预估跌幅从最初不足0.1元/升一路扩大,92汽油预降0.28元/升,95号汽油预降0.30元/升

  最新民调显示,鲁比奥成2028共和党最热门潜在总统候选人,为何能领先万斯36个百分点?共和党内部的权力格局在如何变化?

  心理学上说:如果一个人出门前反复检查煤气、门锁、水电,出门后还很是担忧,表面是谨慎,实则暴露了三种深层心理。

  10亿美元A20订单无法封装!苹果紧急抢购内存:短缺到iPhone 18 、Ultra折叠屏量产遇到挑战

排行

精选