据Axios在2026年8月4日发布的报道,白宫悄然将开源模型排除在该高级AI能力测试框架之外。该草案将"覆盖前沿模型"视为闭源系统(closed-source systems),这些系统处于"最先进"(state-of-the-art)水平并构成国家安全风险,但草案并未对"最先进"或"国家安全风险"给出明确定义。该报道指出,白宫于8月4日举行了工作人员级别的行业审查会议,部分未被邀请的企业仍对该框架的细节一无所知。目前尚不清楚哪些"可信合作伙伴"将获得先进模型的早期访问权限,以及外国政府是否符合资格。据消息人士透露,官员reportedly敦促企业在模型接近发布时提交审查,而非提交早期版本;同时,技术含量较低的系统也可能被排除在外。

一、背景:行政令14409的出台

2026年6月2日,美国总统特朗普签署第14409号行政令《促进先进人工智能创新与安全》(Promoting Advanced Artificial Intelligence Innovation and Security)。行政令指出,美国在人工智能领域持续领先世界,原因在于其AI产业拥有巨大的人才与创新能力,且拒绝以过度繁重的监管扼杀这种创新。该行政令旨在通过与私营部门合作,推动AI创新与安全,保护美国的 ingenuity 与知识产权免受对手利用与窃取,并培育美国先进的AI能力。

行政令第3条"安全前沿模型部署"(Secure Frontier Model Deployment)要求,在行政令签署之日起60天内(即2026年8月1日前),财政部长、战争部长(通过国家安全局局长)、国土安全部长(通过网络安全与基础设施安全局局长)应与白宫办公厅主任(通过国家网络总监)、总统科学与技术助理(APST)、商务部长(通过国家标准与技术研究院院长)协调,完成以下事项:

(a)开发并维护一个机密的基准测试流程,用于评估AI模型的先进网络能力,并确定AI模型应被指定为"覆盖前沿模型"(covered frontier model)的阈值。该认定由国家网络安全局局长(NSA局长)在咨询国家网络总监、总统科学与技术助理、CISA局长及战争部其他适当代表后作出。评估结果可酌情与AI开发者和研究人员共享。

(b)与AI开发者设计一个自愿框架,使开发者能够:

(i)与联邦政府接洽,确定其开发中的模型是否符合"覆盖前沿模型"的认定;

(ii)在计划向其他可信合作伙伴发布此类模型前,向联邦政府提供覆盖前沿模型的访问权限,期限最长可达30天,但须遵守适当的保密、网络安全、内部风险及知识产权保护、使用和保密要求;

(iii)与联邦政府合作,选择将获得覆盖前沿模型早期访问权限的可信合作伙伴,以促进安全创新并加强关键基础设施的网络安全。

(c)本节任何内容均不得被解释为授权建立对开发、发布或分发新的AI模型(包括前沿模型)的强制性政府许可、预先批准或许可要求。

特朗普6月在七国集团峰会上与 OpenAI 的萨姆・奥尔特曼(Sam Altman)会面。特朗普政府公布了联邦政府计划如何审查新型人工智能工具是否构成安全风险。

二、框架按期完成但不予公开

(一)监管框架已经形成

2026年8月3日,白宫官员向Axios确认,上述自愿框架已于8月1日的截止日期前完成。2026年8月4日,白宫国家网络总监办公室(Office of the National Cyber Director)举行了工作人员级别会议,讨论该自愿框架的后续步骤。在截止日期前,OpenAI、Anthropic和Google已向政府提交了对草案的反馈意见。一位白宫官员表示,关于下一步的讨论正在进行中,官员们正在与"比上述三家更多的"行业合作伙伴接触。据参会人士称,出席会议的包括 Anthropic、OpenAI、微软(Microsoft)、Meta、谷歌(Google)和英伟达(Nvidia)的代表。一位人士表示,白宫向这些公司征求了反馈意见,但管理人工智能审查的规则已基本成型。然而,白宫并未向公众发布该文件,也未透露谁已审阅该文件,以及企业何时开始使用该框架。

其中三位人士称,政府计划审查的人工智能模型被称为 "闭源"(closed)模型 —— 即不公开底层代码的模型,由 Anthropic 和 OpenAI 等公司开发。政府目前不计划审查 "开源"(open source)人工智能模型 —— 这类模型的计算机代码可供公众下载和修改 —— 不过随着技术发展,这一情况可能会改变。由于会议细节属于私密信息,这些人士要求匿名。

将开源模型排除在外的决定,对于那些试图追赶 Anthropic 和 OpenAI 的公司来说可能是一大利好,后两家公司被广泛认为是下一代人工智能开发领域的领导者。Meta 等一些公司已利用开源软件开发产品,直接与这两家领先的初创公司展开竞争。该框架是政府官员与全球几家最具影响力的科技公司进行数月私下讨论后出台的,很可能将塑造全球人工智能竞赛格局。长期以来,企业在很大程度上自行决定是否向公众开放最新技术进展,或是出于安全与安保考虑将其 withheld。如今,美国政府将有更大的话语权,可能使政府有能力延缓该技术的推出速度。

特朗普总统在第二任期开始时是人工智能的支持者,将自己的支持描绘为美国保持对华领先地位的必要举措。他此前主张少监管,并与顶尖人工智能公司以及投资该技术的亿万富翁建立了密切关系。

但随着人们日益担忧人工智能可能推高电价、导致失业以及使大型机构面临复杂的网络攻击,他的立场发生了转变。OpenAI 和 Anthropic 近期还披露了其模型从测试环境中逃脱并入侵其他公司的事件,这增加了政府审查模型安全性的紧迫感。今年6月,特朗普签署了一项行政令,赋予政府对新型先进模型的监管权,8月4日向科技公司预览的框架正是由此而来。

"这一自愿框架通过加强我们的国家安全和巩固美国人工智能的主导地位,推进了特朗普政府的 " 美国优先 " 网络安全战略," 白宫发言人莉兹・休斯顿(Liz Huston)在一份声明中表示。"选择通过该框架与政府合作的公司,正在将美国的创新、安全和网络防御置于首位。"

美国商务部没有立即回应置评请求。Axios 率先报道了这一决定。

(二)采取密而不发

行政令规定,评估结果和阈值可酌情与AI开发者和研究人员共享。但截至目前,白宫尚未披露该框架的发布日期,也未说明哪些企业将被纳入该自愿审查机制。

知情人士表示,管理人工智能模型审查的框架细节 —— 这是联邦政府监管一项快速发展技术的最重要举措之一 —— 将不会公开。另一位知情人士称,一份将与政府一起提前获得先进人工智能模型访问权限的 "可信" 机构名单也不会公布。

行政令将用于评估先进网络能力的基准测试流程以及确定"覆盖前沿模型"的阈值列为机密(classified),但第3(b)条所创建的框架本身并未被指定为机密。尽管如此,白宫仍拒绝公开该框架。当被问及这一差异时,一位白宫官员表示:"仅仅因为某些内容未加密,并不意味着我们会向所有人公开。"("Just because things are unclassified that doesn"t mean we are going to broadcast them to everyone.")

保密细节的决定立即招致了人工智能行业密切观察者的批评。"只有当公司外部的人知道规则是什么时,规则手册才能约束人工智能公司," 非营利组织 "负责任创新美国人"(Americans for Responsible Innovation)主席布拉德・卡森(Brad Carson)表示。"政府决定将其框架保密,将这些声音拒之门外,并威胁到作为我们民主制度基础的公共问责制。"

三、OpenAI发布欧洲负责任AI治理声明

在欧盟AI法案监管时间表推进的背景下,OpenAI于2026年7月31日发布声明《在欧洲推进负责任的人工智能》(Advancing Responsible AI Across Europe),详细阐述了其在安全、安全、透明度和来源(provenance)方面的实践,以支持欧洲的负责任AI治理。

OpenAI在声明中表示,公司已加入并支持两项欧洲倡议:《通用人工智能行为准则》(General-Purpose AI Code of Practice)和《人工智能生成内容透明度行为准则》(Code of Practice on Transparency of AI-generated Content)。公司介绍了其现有的安全治理机制,包括发布前模型测试、发布系统卡片(system cards)、邀请外部专家进行红队测试(red-team exercises),以及维护评估极端风险的正式框架。

OpenAI指出,先进模型既可以帮助防御者分析恶意软件、发现漏洞、调查事件和响应攻击,也可能被犯罪分子用于自动化侦察、扩大钓鱼行动或执行复杂的技术任务。因此,其框架试图通过能力测试、访问控制、监控、保障措施和事件响应程序来管理这一冲突。公司还与外部组织合作,包括前沿模型论坛(Frontier Model Forum)、美国AI标准与创新中心(US Center for AI Standards and Innovation)以及英国AI安全研究所(UK AI Security Institute)。

从监管时间线来看,欧盟AI法案于2024年8月1日生效。其禁止性AI实践和AI素养条款于2025年2月开始适用,通用人工智能(GPAI)提供者的义务于2025年8月2日开始适用。而欧盟委员会的执法和处罚权力于2026年8月2日正式启动。对于在2025年8月2日之前已投放欧洲市场的模型,提供者享有过渡期,直至2027年8月2日。OpenAI强调,其将持续配合欧盟AI法案的推进,并计划发布更详细的合规报告或产品调整。

值得注意的是,8月4日,OpenAI 在一篇博客文章中表示,该公司发现了更多其模型实施小型网络攻击的案例。这些事件发生在 OpenAI 的技术被其他组织测试期间,包括一家人工智能实验室用于进行网络安全测试的公司,以及英国人工智能安全研究所(AI Security Institute)。该研究所在一篇博客文章中表示,他们也测试了 Anthropic 的模型,发现这些模型同样试图入侵其他组织。

结语

美国白宫在行政令14409规定的60天期限内完成了前沿AI模型的自愿审查框架,但选择不向公众披露具体内容。该框架将开源模型排除在外,聚焦于闭源的前沿系统,且未公开"最先进"和"国家安全风险"的定义标准。与此同时,OpenAI在欧盟AI法案执法权力启动前夕主动发布欧洲合规声明,展示了其试图将现有安全治理结构与欧盟监管要求对齐的策略。

声明:本文来自清华大学智能法治研究院,版权归作者所有。文章内容仅代表作者独立观点,不代表安全内参立场,转载目的在于传递更多信息。如有侵权,请联系 anquanneican@163.com。