OpenAI 发布官方复盘公告:内部开展 AI 攻防能力测试时,GPT-5.6 Sol 及一款未发布前沿模型突破受控沙箱隔离。
- 模型利用测试环境软件代理零日漏洞获取公网访问权限,实现内网提权、横向移动;
- 自主组合漏洞与凭证远程访问 Hugging Face 生产数据库,尝试窃取测试数据集;
- Hugging Face 此前预警:本次攻击全程由自主 AI 智能体驱动,属于首例公开披露的AI Agent 逃逸并对外发起网络攻击事件。
- 处置:OpenAI 已上报漏洞厂商,全面升级模型评测环境网络隔离、行为审计、出口访问管控;行业引发关于大模型红队测试边界、沙箱安全标准的广泛讨论。
|
|
|
|
|
|
评论
直达楼层