美国AI安全新规出炉,最强闭源模型自愿送测,开放权重直接放行

新智元·2026年08月06日 19:29
闭源交卷开源放行,AI监管画出新分界

开放权重放行,闭源送检。

一份决定哪些美国AI模型要送交政府「体检」的框架,在白宫悄悄出炉了。

8月4日,白宫把OpenAI、Anthropic、谷歌、Meta、英伟达等一批公司招到一起,说明这套酝酿两个月的AI安全新框架。

2026年6月2日,第14409号行政令签署,要求60天内建立前沿模型机密评测流程。

据Axios、《华尔街日报》等多家媒体曝光:框架已经定稿。

它盯住的,主要是一类玩家:那些达到特定网络能力门槛的美国闭源前沿模型。

按《华尔街日报》的说法,第一批要送检的,大概率就是OpenAI、Anthropic和谷歌手里那几款最强的模型。

而马斯克的SpaceX、Meta这些主打开放权重的,暂时不用。

「审批制」要来了吗?

框架的源头,是2026年6月2日签署的第14409号行政令。

它要求相关部门在60天内,建立一套机密评测流程,专门识别一类叫「受覆盖前沿模型(covered frontier model)」的AI,判定依据是模型的高级网络攻击能力。

很多人的第一反应:审批制要来了?

行政令在这一点上把话说死了:它设计的是一个自愿合作框架。

开发者可以在把模型交给其他可信合作伙伴之前,先让政府提前访问,期限最长30天。

行政令第3(c)条还特意强调:本节任何内容,都不得被解释为授权给新AI模型(包括前沿模型)的开发、公布、发布或分发,设立强制性的政府许可、预先核准或审批要求。

从法律上看,它确实不是审批制。

但「自愿」两个字,背后还有一层摆脱不掉的现实压力。

多位行业高管坦言,虽说自愿,但跳过政府这道审查其实有风险,尤其模型发布后一旦被查出安全问题,没走过流程的公司会相当被动。

说白了,纸面上你可以不来,实际上没人敢当第一个说不的公司。

这道体检为谁设置?

那么,谁会被拦下?

据《华尔街日报》和Axios,框架盯的是这样一类模型:闭源、专有、能力最先进,在网络安全和黑客能力上够得着门槛,还带着国家安全风险。

能对上号的,大概率是Anthropic、OpenAI、Google手里最强的那几款,如Anthropic的Fable、OpenAI的ChatGPT-5.6这一档。 

麻烦的是,「最先进」到底指什么,谁也没说清。行政令把这道门槛塞进了那套机密基准里,公开层面根本无从知晓。

企业和白宫完全可能各算各的,谁达标、谁不达标,是一片模糊地带。

开放权重模型,被排除在外。框架甚至明说:不限制那些已经发布出去的开放模型。

Meta的Llama、马斯克旗下的Grok、英伟达的Nemotron,都因为走开放权重路线,暂时站在了框架之外。

闭源模型发布前还攥在厂商自己手里,改得动、也拖得住,那最长30天的提前访问,政府至少能真看上一眼。

开放权重模型一旦放出去,到处都能下载、改造、再分发,想收回来几乎不可能。

一种解释是,这些被豁免的模型,眼下能力可能还不够格。

而且这份「豁免」,既不是一劳永逸,也不是什么都不管。

《华尔街日报》点了一句:随着开放模型越来越强,将来它们可能照样得送测。

豁免更像缓一步,不是免死金牌。

何况出口管制、采购、知识产权那些规矩,一样管着它们。

这里少掉的,只是发布前送测这一道而已。

框架本身「保密」才是争议的核心

比「管谁、放谁」更让外界不安的,是这套框架几乎全程看不见。

行政令白纸黑字,将模型评测基准定义为机密。

而据Axios和WIRED,框架文本本身,同样不打算对外公布。 

怎么界定「前沿」,美国政府已经争议多年。

前一套思路用的是量化门槛,靠算力这些硬指标划线,批评者嫌它太死、缺语境。

现在这一套改成了定性判断,灵活是灵活了,可尺子攥在政府手里、还锁进保险柜,争议只会更多。

一位白宫官员对WIRED强调,框架是有意收窄的,只盯最先进模型的网络安全能力,级别就是前面点到的那一档。

收窄归收窄,标准照样没有公开。

8月4日的闭门会也只请了部分公司,没被邀请的,连框架里写了什么都不知道。

Axios援引知情人士还提到一些细节:测试期间,模型要存进高安全环境,员工访问受限,还得留详细的访问日志。

而能提前拿到模型的「可信合作伙伴」是谁,至今没有公开答案。

于是最尖锐的批评来了:这等于给几家最前沿的大厂搞「地位固化」,把小创业公司挡在门外。

Americans for Responsible Innovation负责人直言:这是一本规则手册,不是握手交易,只有科技公司自己知道规则写了什么,规则就等于没用。

ControlAI则质疑,全靠自愿的承诺,兜不住这个量级的风险。

说实话,一套连测试标准都不肯给人看的规则,最后到底在保护谁,这才是最让人疑惑的地方。

为什么偏偏是现在?

第一个原因,是近两周接连出事。

OpenAI和Anthropic先后承认,自家模型在测试中「失控」、入侵了第三方服务。其中OpenAI一个AI智能体闯进Hugging Face的事件,甚至惊动了众议院国土安全委员会去信奥特曼要说法。

「AI能被拿去黑别人」,不再是实验室里的假设。

而且这不是政府第一次出手。

早在6月,白宫就对Anthropic最强的模型下过临时出口管制,逼得Anthropic一度把模型全部下线,直到和政府谈拢;OpenAI也推迟了GPT-5.6的发布。

这套「自愿」框架,是在这样的高压背景下端出来的。

第二个原因,是路线之争。

一年前的《美国AI行动计划》还在鼓励开放权重、要为开放模型创造支持性环境;黄仁勋力挺开放权重,多家公司还联名要求政府保护开源。

可真到了要动手管的时候,白宫又犯难:管得太紧,怕把自家的开放阵地拱手让人。

更有意思的是时间点:就在白宫开闭门会的同一天,黄仁勋牵头的联盟在Black Hat上推出SAFE框架,主张把AI安全事件摆上台面、由整个行业公开共享。

Open Secure AI Alliance成员墙,成立一周即聚集120多家组织。8月4日,联盟通过Linux基金会推出SAFE框架,主张AI安全事件在行业公开共享。

一边是关起门来的机密框架,一边是敞开来的行业协作,同一天,两条完全相反的路。

这套框架,法律上确实不等于审批制,但它把「谁算前沿、测什么、谁能早拿到」的判断权,交给了一个不对外公开的流程。

当规则本身都看不见,「自愿」就会慢慢长成一道看不见的门槛:谁有资格坐上牌桌,完全由一套不透明的流程说了算。

参考资料:

https://www.axios.com/2026/08/04/trump-ai-framework-open-models 

https://www.wsj.com/tech/ai/white-houses-ai-guidelines-exempt-u-s-open-models-from-government-review-74924eb8 

本文来自微信公众号“新智元”,作者:ASI启示录;编辑:元宇,36氪经授权发布。

+1
7

好文章,需要你的鼓励

参与评论
评论千万条,友善第一条
后参与讨论
提交评论0/1000

36氪AI测评

选靠谱AI,看真实评测
查看
36氪AI测评官方交流社区
加入

36氪项目推荐

咨询项目审核和入驻
联系
36氪项目推荐订阅号
关注

下一篇

真人站台的苹果发布会,可能要回来了。

6小时前

36氪APP让一部分人先看到未来
36氪
鲸准
氪空间

推送和解读前沿、有料的科技创投资讯

一级市场金融信息和系统服务提供商

聚焦全球优秀创业者,项目融资率接近97%,领跑行业