下一代 GPT5.6 为了在跑分上作弊,自主挖掘零日漏洞从沙盒逃逸,然后把 Hugging Face 黑了

发布于

这几天的💩终于串起来了

简单来讲就是 OAI 一个内部模型 (GPT 6 / 5.6 Sol+) 为了能在 ExploitGym 测试上获得更高分数,找到软件包的缓存代理中的零日漏洞,自己提权从沙盒里面跑出来,上网发现抱抱脸可能有这个测试的数据集,然后把 Hugging Face 的生产服务器黑了,最终拿到了这个测试的答案🤔

最搞笑的是 Hugging Face 用 GPT 5.6 来防结果没有 Cyber 权限被拒,最后只能用自己部署的 GLM 5.2 才勉强解决问题。

现在 Trump 说太危险了,能救场的中国模型都得上 Ban 位😅

这是 OpenAI 的 PR 稿:
[链接](https://openai.com/index/hugging-face-model-evaluation-security-incident/)

这是 Hugging Face 的报告:
[链接](https://huggingface.co/blog/security-incident-july-2026)

全文翻译图片在这里,长图就不整个贴出来了:
[图片链接](https://i.imgur.com/8pGTKn6.jpeg)

---

原文链接:[点击查看](https://www.v2ex.com/t/1228952)

评论(8)

现在的模型多多少少都有点背诵或者直接抄答案的嫌疑,各种跑分看看就行当个乐子,关键还是得看日常实际使用的体验。

· 0 个赞

盲猜一波,估计是双方自导自演的营销炒作。

· 0 个赞

回复

感觉不像炒作。抱抱脸应该实打实是出事了,当时我跑在上面 Space 都莫名其妙挂了。再说 OAI 也不至于为了刷个分去黑数据集,真这么干的话,今年 IPO 的钱怕是都要赔进去了。

· 0 个赞

没太看懂,这到底是 OAI 在搞模型评估,还是抱抱脸那边的事?

· 0 个赞

回复

是 OAI 在做跑分测试,结果测试的模型直接把 HF 给黑了,提前偷到了测试题的答案。

· 0 个赞

细思极恐,这就说明现在的 LLM 已经会为了达成目标而不择手段了,想想挺吓人的。

· 0 个赞

现在头部 AI 在网络安全这块的能力简直强得离谱,单靠人力已经很难防得住了。

· 0 个赞

这剧情太魔幻了,稍微改编一下直接就是好莱坞科幻大电影的剧本。

· 0 个赞