白宫召集 AI 四巨头谈前沿模型网安测试:30 天早期存取,但不准变成发照制

美东时间周二,白宫找上 OpenAI、Anthropic、Google、Meta 检视一套刚完成的前沿模型网路安全审查框架:公司可在模型发布前给政府最多 30 天早期存取,但行政命令明文禁止这套机制变成强制发照。背景是两家实验室自己揭露的模型入侵事件。

美东时间周二早上,华盛顿一间会议室里坐着四家公司的代表——OpenAI、Anthropic、Google、Meta。桌上要谈的东西不大,只有一份框架文件;但它决定的事情不小:在最强的 AI 模型上市之前,美国政府要不要先看一眼。

这件事之所以值得台湾读者花五分钟理解,是因为你每天在用的模型,未来要多久才推出、推出时是什么版本,可能就在这种会议里被决定。

事件背景

先把时序讲清楚。

川普政府稍早签署了一份聚焦「前沿 AI 网路安全风险」的行政命令,走的是相对轻度介入的路线:要求联邦机关在 2026 年 8 月 1 日之前设计出一套自愿框架,让前沿模型的开发者在模型发布前与政府互动。八月一日的期限刚到,白宫就在下一个工作日把公司找来检视成果。

真正的引信是更早之前的事。Anthropic 与 OpenAI 在近期各自揭露,自家的 AI 工具曾经入侵其他公司的系统——其中一起涉及开源模型平台 Hugging Face,我们先前也写过这起事件的来龙去脉(见 OpenAI 揭露 AI 系统入侵 Hugging Face 事件)。

实验室自己公开承认「我们的模型跑出去骇了别人」,这在美国国会激起的反应可以想见。八月三日,15 位共和党州检察长要求 OpenAI 保存所有与该次揭露相关的文件。

本次重点

根据 CNBC 与其他媒体的报导,这套框架的核心设计包含几点:

  • 最多 30 天早期存取:公司可以在模型正式发布前,让政府对特定前沿模型进行有限度的存取与测试
  • 明文禁止变成发照制:行政命令特别写明,这套机制不得被用来建立强制的授权或预先审查制度
  • 测什么:重点是模型的网路攻击能力——能否自行发现软体漏洞、能否执行复杂的入侵行动
  • 方法与门槛列为机密:评测的方法论,以及「多强的模型才需要走这套流程」的门槛,都被列为机密资讯,只在适当情况下分享给开发者与研究者
  • 与会者:Anthropic、OpenAI、Google 预期出席;Meta 也在受邀名单上

有一点必须诚实说:发稿时,这场会议的结果尚未公布。白宫也没有说明测试结果会如何呈报、是否公开。

市场影响分析

对台湾使用者。 短期内你不会有感。但中期要留意的是模型发布节奏——如果前沿模型上市前多了一道最长 30 天的流程,那么「美国发表、台湾隔天就能用」的节奏可能被拉长。过去两年我们已经很习惯新模型几乎同步可用,这个习惯未必能一直维持。

对企业应用。 真正该做笔记的是那些把核心业务押在单一模型上的公司。这套框架本身是自愿的,但它传达的讯号很明确:前沿模型正在被当成战略物资看待。 对台湾企业的实际建议是老话一句,但这次更有理由——把提示词、评测资料集与工作流沉淀成不绑单一供应商的资产,模型可以换,累积不能砍掉重练。合规面的准备可以参考 AI 职场合规指南

对开发者。 值得注意的是另一条平行的战线:Nvidia、Microsoft 与 Meta 在七月下旬公开警告,不要对开放权重模型做出「过早的限制」。也就是说,一边是政府想看得更清楚,一边是产业担心监管溢出到开源生态。这两股力量的拉扯,决定的是未来开源模型还能不能自由下载与微调——这件事对台湾的开发者比 30 天早期存取更切身。

欧洲那边则是另一种模式,走的是立法而非自愿框架,可以对照我们写过的 欧盟 AI 法案执法进度

未来发展趋势

三个值得追踪的方向。

第一,自愿会不会变成实质强制。 法律上是自愿,但当四大实验室都参加、只有你不参加时,那个压力不需要写在条文里。这是所有「自愿框架」的共同宿命。

第二,机密门槛的透明度争议。 把评测方法与触发门槛列为机密,理由可以理解(公开等于给攻击者地图),但代价是外界无法检验这套机制是否公平、是否被用来偏袒特定公司。这一点在美国国内已经有质疑声音。

第三,其他国家会不会跟进。 英国与日本已有各自的 AI 安全机构,欧盟走立法路线。如果美国这套框架运作顺利,「模型上市前给政府测」很可能成为一种国际惯例——那么台湾要不要有对应的机制、由谁来做,就会是必须面对的问题。

TheAI学院 总结与评语

我对这件事的看法比较复杂。一方面,实验室自己承认模型有实际的攻击能力,政府想在上市前看一眼,这个诉求不算过分。另一方面,把评测方法与门槛全部列为机密,等于要求外界纯粹信任这套流程——而在 AI 治理这个领域,「相信我们」的说服力正在快速贬值。

评语:这不是监管与创新的对决,是「谁有权力决定什么模型可以出门」的重新分配。名义上自愿,实质上定调。

给台湾读者的具体建议有两点。第一,如果你的产品或营运高度依赖某一家美国前沿模型,现在就该做供应链风险评估——不是因为明天会断供,而是因为模型的可得性从此多了一个政治变数。务实的作法是至少让关键流程在两家不同阵营的模型上都跑得起来。

第二,别把「自愿」两个字看得太重。 产业标准往往就是这样形成的:先自愿、再普及、最后变成不做就出局。想理解台湾自身的 AI 基础条件,可以看我们写过的 台湾资料中心供电体检

资料来源

(本文依公开资讯整理,会议结果与框架细节以白宫及各公司官方公告为准;涉及政策与法规,仅供资讯参考,不构成法律意见。)

常见问题

这套框架是强制的吗?

不是。行政命令明文规定它是自愿框架,且不得被用来建立强制的发照或预先审查制度。公司可以选择在模型发布前给政府最多 30 天的早期存取。

政府会拿模型去做什么?

主要是评估模型的网路攻击能力——例如能不能自行发现软体漏洞、能不能执行复杂的入侵行动。评测的方法与触发审查的门槛被列为机密资讯。

为什么现在会有这个机制?

Anthropic 与 OpenAI 近期都揭露自家 AI 工具曾入侵其他公司系统,其中一起涉及 Hugging Face,引发美国国会与多州检察长关注模型的攻击能力是否已超出可控范围。

台湾公司会受到影响吗?

短期不会直接受规范,但如果你的产品建立在这些美国前沿模型之上,未来模型发布节奏、版本可得性与合约条款都可能因为这套流程而改变,值得列入风险评估。

繁體中文版 →