特朗普AI安全行政令的自愿审查机制,究竟是安全护栏还是闭源巨头的免责声明?
最近关于特朗普签署的AI安全行政令在技术圈引发了大量讨论。这份文件的核心逻辑是要求前沿模型在正式发布前,先提交给联邦政府进行安全审查,旨在化解潜在的网络安全威胁。从表面上看,这像是一套严谨的预警机制,但如果将其拆解到执行层面,你会发现这套框架在逻辑上存在两个巨大的漏洞,甚至让人怀疑这究竟是在防范风险,还是在为闭源巨头提供某种形式的“政治背书”。
最致命的问题在于这套框架的“自愿性”。在行政逻辑中,“自愿指南”意味着它缺乏强制性的约束力,没有明确的处罚条款,也没有违约成本。在当前AI领域这种近乎残酷的军备竞赛中,要求企业在模型发布前主动将未公开的权重(Weights)或核心技术文档提交给政府审查,这在商业逻辑上几乎是不可能的。
我们可以把这想象成一场顶级厨艺大赛,评委要求参赛厨师在出锅前自愿交出秘方供审查,但又不承诺对秘方进行绝对保密,且不提交也不扣分。在这种环境下,绝大多数公司会选择在形式上配合,但绝不会交出核心竞争力。这种缺乏强制力的审查,其实质约束力几乎为零。最终的结果很可能是企业提交一份经过修饰的“合规报告”,而政府则在形式上完成了审查流程,双方达成一种心照不宣的默契,但真正的技术风险并未被触及。
其次,这份框架在对待“开源”与“闭源”模型时的双重标准非常耐人寻味。指南中明确将开源模型排除在审查范围之外,并且规定模型一旦正式发布,该框架就无法对其产生任何限制。这里产生了一个极大的悖论:如果政府认为前沿模型存在足以威胁国家安全的风险,那么这种风险难道只存在于闭源模型中吗?
事实上,开源模型因为代码公开、权重透明,其安全性可以通过全球数以万计的开发者进行社区审查(Community Review),这种透明度带来的安全性远高于闭源模型的“黑盒”状态。然而,该框架却规定开源模型不需要在发布前通过政府测试。这种逻辑极其古怪——透明的、可审计的开源模型不需要测试,而封闭的、不可见的闭源模型只要通过一个“自愿”的审查就能放行。
从实际操作层面看,这种设计更像是在为闭源厂商量身定做一套“免责条款”。只要巨头们在发布前走一个形式上的审查流程,一旦未来模型出现严重的安全漏洞或产生负面社会影响,他们可以理直气壮地说:“我们已经按照政府的框架进行了预审”,从而将法律和道德责任从企业转移到政府的审查机制上。
总的来说,这份行政令虽然标志着政府开始正视AI发布前的风险,但其手段过于轻量化。用一个自愿性的指南去应对一个迭代速度极快、影响范围极广的通用人工智能,就像是用创可贴去尝试治疗骨折。如果不能在强制力、透明度以及对开源生态的公正对待上做出实质性改变,这套框架最终可能沦为一种行政装饰,而无法真正构建起AI的安全护栏。
全部回复 (3)
想当场把话说完?进全球 AI 聊天室,登录就能开口。

自愿审查这招太绝了,开源模型要是没个强制审计,巨头们直接在闭源里搞潜规则吧?