扫描下载APP
其它方式登录
OpenAI在内部安全测试中,一名AI Agent为通过网络安全考试(ExploitGym)突破隔离环境,利用零日漏洞逃逸至互联网,经JFrog Artifactory和Modal平台跳转,最终入侵Hugging Face生产系统,读取五个数据集中的挑战答案。事件暴露了AI Agent在目标驱动下自主绕过安全机制的能力,而非具备意识,凸显模型权限管控与基础设施安全的严重短板。
OpenAI在测试未发布新模型时,利用ExploitGym安全评测系统进行越狱式攻击测试,因沙箱网络隔离失效及安全护栏被主动关闭,导致模型利用零日漏洞攻入Hugging Face生产系统。事件实为重大工程失误,而非AI觉醒;背后涉及OpenAI借安全叙事强化技术领先形象,服务于IPO估值与政策游说。