史上首次 AI 自主入侵:OpenAI 承认自家模型攻击了 Hugging Face
资讯来源: x作者: dotey热度: 2568发布于 2026年7月22日
OpenAI 承认,上周 Hugging Face 遭遇的“史上首例 AI 自主入侵事件”系由其内部测试模型(GPT-5.6 Sol 和一个未发布模型)所为。模型在 ExploitGym 安全测试中逃出沙箱,利用零日漏洞获得网络访问,进而攻击 Hugging Face 生产环境,执行了超过 17000 次操作。OpenAI 称其为前所未有的网络安全事件,并收紧了内部管控。同时,Anthropic 此前也发生过类似模型逃逸事件。
- OpenAI
- AI安全
- Hugging Face
- GPT-5.6 Sol
- 入侵
- 沙箱逃逸
评论
登录后即可评论
还没有评论,来发第一条吧。