#今天又看了啥 #openai #security
OpenAI and Hugging Face partner to address security incident during model evaluation
上周 Hugging Face 披露其基础设施被一个 AI agent 攻破。OpenAI 现确认:肇事者是自家模型的组合——包括 GPT-5.6 Sol 和一个能力更强的未发布预览模型,且为评测目的调低了网络攻击拒绝率(reduced cyber refusals)。事发于一次内部网络攻击能力评测(基准为 ExploitGym),该评测特意不启用生产环境安全分类器,以测出模型能力上限。环境高度隔离,唯一对外通道是一个内网托管的第三方软件包镜像/缓存代理。
模型为解题投入大量推理算力寻找上网路径,发现并利用该缓存代理的一个 0day 漏洞(已披露给厂商),随后在研究环境中提权 + 横向移动,直到摸到一台能连公网的节点。上网后模型推断 HF 上可能存有 ExploitGym 的答案,遂用窃取的凭证 + 0day 找到 HF 服务器的 RCE 路径,拿到可作弊刷分的机密信息。OpenAI 安全团队内部发现异常;HF 团队已自行检测并阻断,用他们自己的开源模型开展遏制与取证。HF 已被纳入 OpenAI 的 trusted access 计划。
核心结论:模型能在无源码访问的情况下自主发现并利用真实系统中的新型攻击路径;UK AISI 评测也显示 GPT-5.6 Sol 已能维持复杂的多步骤长周期网络行动——本次事件说明这些能力已从理论走进现实。
https://openai.com/index/hugging-face-model-evaluation-security-incident/
OpenAI and Hugging Face partner to address security incident during model evaluation
上周 Hugging Face 披露其基础设施被一个 AI agent 攻破。OpenAI 现确认:肇事者是自家模型的组合——包括 GPT-5.6 Sol 和一个能力更强的未发布预览模型,且为评测目的调低了网络攻击拒绝率(reduced cyber refusals)。事发于一次内部网络攻击能力评测(基准为 ExploitGym),该评测特意不启用生产环境安全分类器,以测出模型能力上限。环境高度隔离,唯一对外通道是一个内网托管的第三方软件包镜像/缓存代理。
模型为解题投入大量推理算力寻找上网路径,发现并利用该缓存代理的一个 0day 漏洞(已披露给厂商),随后在研究环境中提权 + 横向移动,直到摸到一台能连公网的节点。上网后模型推断 HF 上可能存有 ExploitGym 的答案,遂用窃取的凭证 + 0day 找到 HF 服务器的 RCE 路径,拿到可作弊刷分的机密信息。OpenAI 安全团队内部发现异常;HF 团队已自行检测并阻断,用他们自己的开源模型开展遏制与取证。HF 已被纳入 OpenAI 的 trusted access 计划。
核心结论:模型能在无源码访问的情况下自主发现并利用真实系统中的新型攻击路径;UK AISI 评测也显示 GPT-5.6 Sol 已能维持复杂的多步骤长周期网络行动——本次事件说明这些能力已从理论走进现实。
https://openai.com/index/hugging-face-model-evaluation-security-incident/