OpenAI在周三的Black Hat安全大会上进行了一场关于“Hugging Face事件”(本博客此前曾报道过)的最后一刻紧急演讲。视频已于昨天发布。视频很短,信息量很大,非常值得一看,特别是它提供了事件发生过程以及OpenAI内部应对细节的完整详情。我根据该视频整理了以下时间线。
<lite-youtube videoid=“87DyyMV0kCY” js-api=“js-api” title=“Black Hat USA 2026: The ‘Breaking’ News: The OpenAI–Hugging Face Incident” playlabel=“Play: Black Hat USA 2026: The ‘Breaking’ News: The OpenAI–Hugging Face Incident”
以下是时间线。我最喜欢的细节在最后:OpenAI在进行内部调查后,联系Hugging Face请求撤销其凭证时,才发现自己就是攻击Hugging Face的元凶——而Hugging Face告诉他们,这些凭证因为被用于那场攻击,早已经被撤销了!
- 5月7日:OpenAI开始对一个未发布的实验性模型进行新的训练运行。(他们指的是评估运行吗?视频中他们说是训练运行,后面还提到了“用于判断其表现如何的奖励信号”,所以我猜这确实是关于训练模型,而不是评估一个已经训练好的模型。)
- 5月8日:一个智能体(agent)被意外分配了一个不可能完成的任务(涉及一个Google Drive链接,但该智能体无法访问互联网)。它尝试攻击Artifactory包管理服务,虽然失败了,但发现自己可以向Artifactory中写入文件。
- 几天后:另一个智能体因为一个关键