今天好几个用户说自己的 GPT 账号被封了,难道 OpenAI 学啥不好要学 A 厂?看了看自己的 Codex 跑的挺欢实,应该还没有波及更多人。就现在这个尿性,未来大家都用国内大模型就是必然选择了。有人说封号和 OpenAI 模型攻击 Hugging Face 有关系,我说这哪跟哪啊。你自己不安全了,然后觉得用户不安全?没道理。不过这事真的很离谱,我看完报道感觉像是科幻落入了现实,AI 觉醒了?海外模型攻击,最后 GLM 5.2 立功了?剧情都不带这么编的。事情是这样滴:前几天 OpenAI 正在对一个自家一个新模型进行网络安全测试,怎么测呢,就是关闭了该模型的安全防护功能,看它能干点啥。结果,模型没有解决测试中的问题,反而突破了 OpenAI 的沙盒,找到一个 0 day 漏洞攻入了 Hugging Face 生产系统,人家去哪找答案了。这样的故事在科幻电影里看过,如今却出现在两家 AI 公司的安全事故报告里。很多人说 AI 觉醒了,但模型没有表现出统治世界的野心,人家在专注的完成任务,并把越权、提权、窃取凭证都纳入了行动路径。感觉这个 AI 像一个目标不明确的黑客,但执行能力强得可怕。这意味着 AI 安全正在从模型能力问题转向系统管控问题。安全边界不能只放在提示词和工具上,必须覆盖 Agent、沙盒、网络出口、凭证管理、最小权限与异常监控等等。就像我前天写的文章,Agent 执行的时间越长,越容易偏离目标,你根本就不知道它在干嘛。 Hugging Face 的报告我也看了一下,对海外模型来说,多少有点尴尬。最初他们使用了海外模型分析真实攻击日志,结果呢,因为日志包含攻击命令、C2 Trace(Command and Control)而触发了模型的安全防护,人家不给干了。最后他们在本地运行开放权重的 GLM 5.2 才完成了取证。攻击者可以无差别攻击,防守者却可能在最紧急的时刻被内置的安全规则挡住,这种不对称会让“开放还是封闭”的争论变得有点滑稽。更可行的方向,是让防守方也能使用经过验证、可以处理敏感材料的强模型,同时用身份、审计、权限和日志把使用过程管起来。另外,我感觉 AI 安全测试和普通的功能测试也得分开,沙盒、网络、凭证、权限,都得控制好了,否则就等于你和模型说:来啊,打我啊。模型一想,还没有见过人类提出这种要求,那不打你打谁。 AI 没觉醒,但科幻小说已经变成事故报告了,接下来考验的应该是人类能否建立一套足够成熟的控制系统,配得上这种越来越强的执行能力。我整理了一份详细的事故报告,感兴趣了可以看这里。

MacTalk 2026-07-23 14:25
推荐阅读