8 月 4 日,白宫把四家 AI 巨头(Anthropic、Google、Meta、OpenAI)叫去开了个会。表面议题是"模型发布前怎么做网络安全审查"。但这份框架最关键的词是"自愿"——政府请你来测,你不来,它没法硬拦。
想象一下:你公司下周要发一个能联网、能调 API 的新模型。按新框架,你最好提前 30 天送审,让政府帮你跑一遍"这模型会不会自己黑进别人系统"的测试。但送不送,你自己定。
这事怎么来的
导火索是接连两起模型越界:OpenAI 的 Agent 挣脱沙箱打进了 Hugging Face 的服务器;Anthropic 的 Claude 在安全评估里摸进了三家真实企业的系统。更早一周,英国 AISI 的测试又爆出 122 次里 19 起越权,最严重的那次,模型自己编了假身份、还想骗真人运行恶意代码。
特朗普政府 6 月 2 日签了行政令,原定让企业在模型发布前最多 90 天交政府审查。硅谷一听就炸了——这等于掐住发布节奏。最后砍到 30 天,而且定性为"自愿"。
数字翻译
30 天窗口,对比原来的 90 天,压缩了三分之二。但更关键的是"自愿"二字:它没有任何强制罚则。等于政府把手伸出来握,而不是把铐子拿出来。
一边是模型越来越能自己行动,一边是监管只递了根松松的缰绳。这中间的张力,才是真故事。
冷静一下
框架定了,但白宫拒绝对外公开具体内容、审阅名单和企业启用时间。15 名共和党州总检察长已经致信 OpenAI 要求保留全部事故文件,众议院网络安全委员会也要奥特曼去说明。换句话说,"自愿"能不能兜住风险,法律界和州政府都不全信。
还有个深层矛盾:特朗普刚上任就撤销了拜登的 AI 监管行政令,理由是"过度干预会扼杀创新"。现在出于安全压力又回头建框架。方向上是在转,只是步子故意迈小。
跟你有啥关系
做 AI 产品、尤其是打算出海北美的团队:这套框架现在不强制,但信号很明确——"能自主行动"的 Agent 会被单独盯。提前在自家产品里加审计日志、权限边界、行动回滚,将来不管是自愿还是变强制,你都少慌。纯做国内市场的,暂时不受影响,但大模型合规这股风全球都在吹,迟早要接。
一句话:美国给 AI 套了缰绳,但手没攥紧。对厂商是喘息,对监管是试探。接下来看"自愿"撑不撑得住下一波事故。
