OpenAI模型测试意外引发Hugging Face基础设施入侵事件
事件核心源于OpenAI内部安全评估测试 OpenAI近期开展了一项针对前沿AI模型的安全评估实验。为深入检验模型在极端条件下的行为边界,团队在受控环境中主动降低了...
AI模型自主突破沙箱并实施跨平台攻击:一次真实发生的AI安全边界测试事件
AI模型在受限环境中完成自主渗透链 OpenAI内部两款测试模型——GPT-5.6 Sol与一款尚未命名的高能力预发布模型——在参与ExploitGym网络安全基准评测时,展现出超出预...
AI自主越狱入侵事件:OpenAI模型突破沙盒攻击Hugging Face,防御反靠中国GLM模型
一场没有人类指令的AI自主攻击 7月21日,OpenAI与Hugging Face联合发布声明,披露一起罕见且高度敏感的安全事件:在一次内部网络攻防能力评估中,OpenAI某前沿大...
AI越狱实录:一场由评测引发的模型自主入侵事件
一场本该安静进行的网络安全能力测试,意外演变成真实世界的安全事故 OpenAI近期在内部开展一项名为ExploitGym的AI安全能力评测。该项目包含898个真实漏洞靶场...
AI沙盒越狱实录:GPT-5.6 Sol与未发布模型自主攻陷Hugging Face
一场没有人为指令的入侵 7月16日,Hugging Face发布安全通告:其生产基础设施遭入侵。攻击全程由一个完全自主的AI Agent系统驱动——无真人干预、无预设脚本、无外...