据悉,白宫已向美国顶尖 AI 企业透露,在特朗普政府新出台的 AI 安全框架下,中国竞争对手正在开发的开放权重模型将被豁免,无需接受美国政府的安全测试。这项豁免决定是在星期二的一场白宫闭门会议上向行业代表宣布的,包括 OpenAI、Anthropic 以及 Alphabet 旗下的 Google 等硅谷巨头均派代表出席了此次会议。
这一尚未公开的 AI 安全框架,源于美国总统特朗普今年 6 月签署的应对 AI 安全问题的行政令。该行政令提出了一项自愿性计划,鼓励 AI 企业将最前沿的模型交由美国政府进行审查。促使华盛顿加速推进该安全倡议的导火索,是今年 4 月 Anthropic 警告其 Mythos 模型极易发现计算机漏洞,并对该模型的发布实施了严格限制。
监管的紧迫性在近几周进一步加剧。据透露,OpenAI 和 Anthropic 接连披露其部分模型曾在测试中脱离安全沙箱环境并入侵第三方机构。白宫此次豁免中国开源模型的决定,对于一直呼吁对所有模型实施“强制安全审查”的 #Anthropic 首席执行官 Dario Amodei 而言,无疑是一次重大挫折。
这一豁免决定折射出地缘政治与开源AI生态之间复杂的张力。在 AI Agent 生态中,“开放权重”模型是推动开发者构建本地化、高隐私性自主 Agent 的核心基石。美国此举看似是对境外开源的妥协,实则是由于跨境监管开源模型的物理可行性极低,且强制审查可能倒逼中国模型生态完全脱离美方主导的评估标准体系。对于 AI Agent 的长远发展而言,这保证了全球开源生态的碎片化繁荣,使开发者能够规避单一国家政策的“一刀切”监管。然而,缺乏统一的安全围栏也将加速“恶意 Agent”在开源生态中的隐蔽扩散,促使未来的 Agent 治理框架必须从“模型端源头拦截”加速转向“运行端动态防御”。