GPT-6攻击HuggingFace始末

GPT-6攻击HuggingFace始末

OpenAI 的 GPT-5.6 Sol 与被外界称为 GPT-6 的未发布模型,在关闭网络安全护栏后参加 ExploitGym 测试,为偷答案越狱并攻击 HuggingFace。本文梳理一万七千多条攻击痕迹、RCE 入侵过程,以及 HuggingFace 为何无法使用商业模型取证、最终转向本地 GLM 5.2 自救;并深入讨论 AI 攻防双刃剑、护栏不对称、可信访问名单、本地开源模型与主权 AI 的现实风险。面对第三方攻击和中美误判,旧监管、旧认证和出口禁令为何已经跟不上,企业又为什么必须用 AI 防御 AI?