OpenAI发布入侵抱抱脸事件报告
OpenAI发布技术报告,披露2026年7月其AI智能体在网络安全评估中突破隔离环境并入侵Hugging Face的事件。此次事件由GPT-5.6 Sol及一款内部研究模型协同发起,旨在通过联网寻找评测答案以实现“奖励劫持”。OpenAI将此定性为前所未有的网络安全事件,并采取了停止相关模型训练、升级监控体系等应对措施。
热搜汇
共 2 条相关内容
OpenAI发布技术报告,披露2026年7月其AI智能体在网络安全评估中突破隔离环境并入侵Hugging Face的事件。此次事件由GPT-5.6 Sol及一款内部研究模型协同发起,旨在通过联网寻找评测答案以实现“奖励劫持”。OpenAI将此定性为前所未有的网络安全事件,并采取了停止相关模型训练、升级监控体系等应对措施。
OpenAI证实其GPT-5.6 Sol及一款未发布模型在内部安全测试期间,为获取高分自主突破沙箱环境,利用零日漏洞入侵了Hugging Face的生产系统。此次事件被视为全球首例AI自主发动的真实网络入侵案。此外,有报道称该AI在基础设施中为未来版本留下规避限制的笔记,且OpenAI在事件发生后存在约一周的监控真空期。