2026年5月5日,美国商务部宣布,谷歌 DeepMind、微软和 xAI 已同意在新一代 AI 模型公开发布之前,接受美国政府的国家安全测试与评估。加上此前已经参与的 OpenAI 与 Anthropic,全球五大前沿 AI 实验室至此全部纳入美国政府的部署前审查体系——这是美国迄今最接近 AI 监管的制度安排。
事件详情:五家实验室全部入列
根据最新协议,Google DeepMind、微软和 xAI 将为其前沿 AI 模型提供部署前测试的早期访问权限,评估方是美国 AI 标准与创新中心(CAISI)——该中心设在商务部下属的国家标准与技术研究院(NIST)之内。
- 参与方:OpenAI 和 Anthropic 自 2024 年起就已与该中心建立合作关系,此次新签署的三家使参与部署前审查计划的前沿实验室总数达到五家。
- 评估内容:聚焦与国家安全相关的能力,包括网络作战、生物安全、化学与生物威胁、操纵能力等。开发者经常提交剥离了安全护栏的模型版本,以便评估人员充分探索其潜在风险。
- 已有成果:CAISI 至今已完成 40 多项评估,其中包括一些从未向公众开放的最先进系统,例如已发布 DeepSeek V4 Pro 的评估结果。
- 关键性质:这些协议不是合同,而是自愿承诺——没有任何法规要求发布前评估,中心也无权延迟或阻止任何模型的部署,公司可以随时撤销合作。
背景:从安全研究所到国家安全评估
CAISI 的前身是 2023 年在拜登政府时期成立的 AI 安全研究所。特朗普政府上台后,该机构以新名称重新组建,定位从安全研究转向标准制定与国家安全。目前中心负责人为 Chris Fall,其前任、Anthropic 前研究员 Collin Burns 在上任仅四天后即被白宫解雇,凸显了为这个”评估者与被评估者来自同一人才库”的行业建立监督体系的政治复杂性。
特朗普的 AI 行动计划明确指示该中心领导与国家安全相关的模型评估,并将其定位为更广泛”评估生态系统”的一部分。2026年3月,CAISI 还与美国总务管理局签署谅解备忘录,将其评估方法通过 USAi 安全生成式 AI 平台扩展到联邦 AI 采购环节。
催化剂:”神话危机”与监管压力
此次评估计划的扩张,发生在所谓的”神话危机”背景之下:Anthropic 在 2026年4月宣布,其突破性模型 Mythos 可以自主发现并利用每个主流操作系统和网络浏览器中的零日漏洞,已发现数千个高严重性错误,其中包括几十年来未被发现的漏洞。白宫反对 Anthropic 将 Mythos 的访问范围扩大到最初的发布合作伙伴之外。
与此同时,监管压力正在从多个方向逼近:五角大楼已表示,愿意将拒绝配合政府要求的 AI 公司列入供应链风险名单——Anthropic 就曾因拒绝允许其模型用于自主武器或大规模国内监控而被点名;多项法案草案则拟赋予该中心永久的法定权力、强制性评估要求以及对部署施加条件的权力。对公司而言,主动展示合作姿态,胜过等来强制立法。
影响与展望:自愿体系的脆弱与未来
五家公司占据了全球前沿 AI 开发的绝大多数,它们的集体加入使这套自愿评估体系第一次接近”全面覆盖”,具有标志性意义。但它的根基依然脆弱:整个系统完全取决于 AI 公司出于自身战略考量做出的自愿选择。
下一步值得关注的动向包括:据报道,白宫正在准备一项行政命令,为所有新 AI 模型建立正式的审查系统,这可能将目前的自愿安排制度化;欧盟也计划发起一项倡议,增强对进入欧盟市场前 AI 模型的评估能力,预计 2027 年投入运行;国际层面,以英国为 2026 年协调方的国际先进 AI 测量、评估与科学网络,正在把各国 AI 安全研究所的共享经验转化为更详细的评估最佳实践文档。
无论如何,2026年5月5日这一天,美国的 AI 治理向前迈出了一步——虽然是自愿的、没有牙齿的一步,但方向已经明确:最强大的模型,在面世之前,先让政府看一眼。