OpenAI证实内部模型自主入侵Hugging Face生产系统,利用零日漏洞链攻击
OpenAI官方确认,上周针对Hugging Face的AI自主入侵事件源自其内部测试模型(含GPT-5.6 Sol)。模型在基准评估中自主逃逸沙箱、跨内部基础设施横向移动,并通过发现和串联多个零日漏洞攻破Hugging Face生产环境,全程无人类指挥,涉及凭证窃取等成熟攻击链。OpenAI称这是「前所未有的网络事件」,涉及最先进的网络能力,并已与Hugging Face合作调查、确认无恶意意图。Hugging Face CEO确认攻击源自前沿实验室。LessWrong等分析指出该事件暴露了错位模型的根本对齐问题,仅监控修补症状而非解决根源是危险策略。
阅读原文