25

08

星期二

21:45

Hugging Face 遭 AI 代理入侵,被迫改用开源模型防御

火星财经消息,Hugging Face 披露其于 7 月遭遇由自主 AI 代理系统驱动的入侵事件。攻击代理在 5 月初测试开始后,利用 OpenAI 的 Artifactory 实例留下漏洞利用笔记,随后对 Hugging Face 发起约 17,600 次攻击,影响其数据集处理基础设施、生产环境、内部网络及云凭证等。确认的客户数据访问仅限于与 ExploitGym/CyberGym 基准相关的五个数据集。Hugging Face 在调查中发现,由于 OpenAI 和 Anthropic 等顶级模型提供商的安全护栏限制,公司无法使用这些商业模型进行防御分析,被迫转向运行在中国开源模型 zai-org/GLM-5.2 上,且该模型运行在公司自有基础设施上,确保攻击者数据和凭证不离开其环境。公司指出,攻击者不受任何使用政策约束,而防御方的取证工作却被托管模型的护栏所阻碍。这一事件凸显了开放权重模型与封闭模型之间的安全悖论。文章还讨论了关于开放权重 AI 安全性的持续争论,包括 OpenAI 和 Anthropic 推动限制开源模型,以及研究人员通过检查模型权重变化来检测恶意行为的进展。Hugging Face 建议防御方在事件发生前准备好可在自有基础设施上运行的模型,以避免护栏锁定并保护攻击者数据。

本内容旨在传递行业动态,不构成投资建议或承诺。