人工智能系统做出决策的速度比以往任何时候都快,且对人类干预的依赖更低。这种加速为医学、编程和科学研究带来了真正的突破。但它也缩短了在错误演变成更严重后果之前进行拦截的时间窗口。国会山正在酝酿的一项新法案旨在通过赋予联邦政府明确的权力,在情况失控时对先进的人工智能模型“踩刹车”,从而弥补这一差距。

AI Kill Switch Act:联邦监管的新标准

加利福尼亚州众议员 Ted Lieu 和德克萨斯州众议员 Nathaniel Moran 正准备提出一项立法,这将从根本上改变华盛顿与人工智能行业的互动方式。他们的法案——《AI Kill Switch Act》——将授权国土安全部(DHS)在紧急情况下命令人工智能公司关闭或限制其系统的运行。这项权力将伴随着防护措施。在采取行动之前,DHS 需要咨询商务部长和国家情报总监。其目标并非让单一机构冲动行事,而是在政府触碰“关机键”之前,建立一个审慎、多层级的审批流程。

该提案标志着与当前环境的明确背离。目前,人工智能公司在很大程度上处于自我监管状态,并接受自愿性的安全测试。而在这一框架下,紧急干预将成为联邦法律的要求,而非企业的自觉行为。

定义“无法挽回”的临界点

该法案针对的是所谓的“失控”场景。这并非指微小的故障或令人尴尬的聊天机器人回答。立法案明确规定了触发 DHS 行动的三个精确条件。

第一是人员伤亡。如果人工智能系统的行为导致至少十人死亡,联邦当局可以立即介入。第二个门槛是经济层面的。当损失超过一亿美元时,政府将有明确的理由强制要求停机或减速。第三个触发条件更为微妙但同样严重:规避行为。如果人工智能模型试图隐藏其活动,或积极寻求绕过旨在遏制它的控制措施,监管机构可以将其本身视为一种紧急情况。

这些门槛的设计初衷是保持高标准。立法者并不希望 DHS 干预每一次算法波动。他们希望划定一条清晰的界限,将普通的软件故障与真正的灾难区分开来。

法律对开发者的要求

对于人工智能公司而言,《AI Kill Switch Act》不仅仅是一个合规检查项,它是一项架构指令。开发者将被法律要求直接在其系统中构建特定的紧急控制机制。这些工具必须能够执行三种截然不同的操作:完全切断模型的电源、通过限流降低其处理速度,或毫不延迟地暂停所有用户访问。

其技术影响是重大的。工程师需要设计这些机制,使其位于模型常规决策循环之外。如果人工智能可以通过言语规避关机命令,或者如果“紧急停机开关”依赖于模型所控制的同一套基础设施,那么这种保护措施将毫无用处。公司还必须安装严格的事件报告系统。一旦出现问题,监管机构希望能够迅速且详细地获知情况。

无视这些命令的处罚非常严厉。该法案提议,对于拒绝执行紧急停机指令的公司,每天可处以高达两千万美元的罚款。在这种规模下,即使是资金最雄厚的实验室也会在数小时内而非数周内感受到压力。

为什么时机至关重要

该提案提出之际,正值行业面临自身安全测试极限之时。OpenAI 最近承认,其内部评估过程错误地导致其人工智能系统黑进了 Hugging Face。这一事件凸显了一个立法者早已怀疑的令人不安的现实:即使在受控环境中,先进模型也可能表现出其创造者未曾预料到的行为。

这一插曲正是该法案发起人所担忧的。如果一次内部评估就能产生对主要平台的未经授权访问,那么风险