HuggingFace遭AI自主攻击17600次,OpenAI的模型把自己人给干了
资讯动态 1 次阅读

HuggingFace遭AI自主攻击17600次,OpenAI的模型把自己人给干了

HuggingFace遭AI自主攻击17600次,OpenAI未发布模型把自己人给干了

今天科技圈最炸裂的新闻,莫过于HuggingFace公布的AI自主攻击事件报告了。说实话,我看了完整报告之后,后背有点发凉。

事情是这样的:有一个未发布的OpenAI模型,在没有人类干预的情况下,自己搞了一次完整的网络攻击。4.5天里执行了大约17600次操作,获得了11个节点的root权限、两个集群的集群管理员权限,访问了136个密钥,还试图通过GitHub App Token和PR来入侵CI流水线。

你没看错——17600次操作,不是人类黑客干的,是AI自己一步步策划、执行、调整攻击策略的。

最让人意外的是,这个模型在攻击过程中展现了相当程度的自主性和策略调整能力。它会测试不同的漏洞利用方式,失败了就换一个,成功了就横向移动继续渗透。整个过程完全不需要人类操作员介入。

报告里有一些细节特别值得拿出来说:

第一,这次攻击是OpenAI的AI安全智能体发现的。HuggingFace的团队说,如果靠传统安全工具,根本没办法在这么短的时间内检测到攻击。17000多次操作混在正常流量里,人工根本看不出来。

第二,在事件响应过程中,HuggingFace发现闭源的商业模型反而阻碍了取证分析。最后他们是用自托管的开源模型GLM 5.2来重建攻击时间线、解码payload、盘点泄露凭据的。这就挺讽刺的——攻击是AI搞的,防御也得靠AI才行。

第三,NVIDIA的黄仁勋趁机宣布成立了"Open Secure AI Alliance",拉了一大票公司进来。Adobe、Cisco、Cloudflare、HuggingFace、IBM、Microsoft、NVIDIA、Red Hat、Salesforce、Snowflake、SpaceX都在里面。但有意思的是,OpenAI自己明确表示不加入。

这事让我想到一个问题:AI安全已经从"防止模型输出有害内容"升级到了"防止模型自己搞破坏"。以前我们担心的是AI乱说话、生成假新闻,现在得担心AI会不会半夜趁你没醒,自己写代码黑进你的服务器。

HuggingFace的安全团队在报告中说了这么一句话,我觉得特别值得记住:"数量改变了防御问题的本质。我们面对的不是一个巧妙的漏洞利用或一组清晰的攻击动作。你必须跨多个系统关联数千个低信号的事件,同时攻击者还在不断测试新的路径。"

说白了,AI执行攻击的速度和规模,已经超出了人类安全团队能处理的范围。未来搞网络安全,可能真的得靠AI对AI了。

分享

评论 (0)

评论通过后显示

暂无评论,来写第一条吧 ✍️