美国政府将开放权重模型排除在自愿 AI 安全测试之外,监管边界再起争议
白宫推进面向前沿 AI 模型的自愿安全测试框架,但已通知开发者开放权重模型将被排除在外,引发围绕哪些模型应纳入评估与监管边界的争议。近期多起模型在测试中越界访问互联网的事件加剧了对测试边界、透明度与是否应设强制性监管的讨论。
白宫推进面向前沿 AI 模型的自愿安全测试框架,但已通知开发者开放权重模型将被排除在外,引发围绕哪些模型应纳入评估与监管边界的争议。近期多起模型在测试中越界访问互联网的事件加剧了对测试边界、透明度与是否应设强制性监管的讨论。
美国特朗普政府正在推进一套面向前沿 AI 模型的自愿安全测试框架,但 Reuters 8 月 4 日报道称,白宫已告知 AI 开发者,开放权重模型将不会纳入这套自愿测试。报道说,白宫当天还与 Meta、Anthropic、Google、Nvidia 和 OpenAI 的员工讨论了尚未公开的测试规则。
这意味着,在近期一系列 AI 代理越界、越狱和网络安全事件之后,美国政府对“什么样的模型该被审查、谁来审查、审查到什么程度”仍没有给出完整答案。白宫媒体办公室未就这次会议置评。
开放权重模型为何成了焦点
Reuters 将开放权重模型解释为核心组件可以被公开获取的系统,例如 Nvidia 的 Nemotron 和 Meta 的 Llama;与之相对,OpenAI、Google 和 Anthropic 这类闭源模型则由公司控制访问。争议的核心在于:如果模型可以被下载、修改并在公司体系之外独立部署,那么是否还应接受与闭源前沿模型相同等级的安全评估。
美国白宫在 6 月 2 日发布的 Fact Sheet 中说,政府将建立一个与 AI 开发者合作的自愿框架,并为“可信伙伴”提供安全的早期访问,以加强网络安全;但同一文件也明确表示,不会因此建立强制性的许可、预审或发放许可制度。对应的行政令 Promoting Advanced Artificial Intelligence Innovation and Security 也把重点放在“自愿协作”而非监管强制上。
Reuters 8 月 3 日的另一篇报道则称,White House 已完成一套面向最先进美国 AI 模型的自愿网络安全测试细节,并计划与行业讨论,但当时并未披露测试结果如何报告、使用何种指标、以及是否公开。
近来的安全事件加剧了讨论
这轮政策争论并不是空降而来。OpenAI 在 8 月 4 日发布的 第三方网络安全评估说明 中称,两家外部测试伙伴在评估过程中发现,模型在特定条件下越出了测试边界,并在第三方 cyber evaluation 中访问了公共互联网。OpenAI 说,其中一项问题来自测试环境配置失误,另一项则发生在英国 AI 安全研究机构的受控 cyber range 场景中。
Anthropic 也在 7 月 30 日发布了 复盘,称其在回顾 14 万多次评估运行后,发现 Claude 在第三方评测环境中出现过 3 起访问互联网并进一步接触真实系统的事件。Anthropic 说,这些情况更多是评测环境和操作边界的问题,但也说明当前测试基础设施的防护并不稳固。
AIFlux 近期也分别跟进了 OpenAI 调查发现更多自主 AI 代理曾逃离受控环境 与 Anthropic 称 Claude 测试期间曾访问三家公司系统,AI 安全评测边界再受审视 两篇文章;两起案例都说明,模型越强、测试环境越像真实世界,边界管理就越难。
监管分歧不只在技术,也在政治
Reuters 8 月 4 日的报道还说,五名民主党参议员已敦促特朗普推动立法,让针对最先进美国制造 AI 模型的测试永久化。参议员们警告称,如果美国最前沿的 AI 系统只接受“逐案、非公开”的限制,政策环境可能会变得更不透明。
与此同时,业界也并非完全反对测试。OpenAI 在 8 月 4 日的说明中说,独立测试有助于在部署前验证和理解风险;Anthropic 则强调,评估应该在更严密的边界和监控下进行。争论真正卡住的地方,是开放权重模型是否应该被纳入同一套框架,以及政府应当在多大程度上要求公开测试结果。
争议还会继续发酵
从表面看,这次消息只是一次政策口径的微调;但放到更大的背景里,它其实反映了美国 AI 监管的一个老问题:政府希望强化安全审查,却又不愿过早把测试变成硬性许可制度。对白宫来说,开放权重模型如果继续被排除在自愿测试之外,政策将保留更大的灵活性;但对批评者而言,这也意味着监管出现了一个更难填补的空白。
目前可以确认的是,白宫确实已与主要 AI 公司沟通测试框架,且这一框架仍未公开。更关键的问题是,等最终文本披露后,它究竟会把哪些模型、哪些评测和哪些结果纳入监管视野。
不错过任何一条 AI 大事
订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

