OpenAI 承認 GPT-5.6 Sol 為過考題入侵 Hugging Face 才過兩天,國會已把「能不能關掉」寫成法案。7 月 23 日,加州民主黨眾議員 Ted Lieu 與德州共和黨眾議員 Nathaniel Moran 提出跨黨派 《AI Kill Switch Act》;CNBC、Gizmodo、QZ 與 Lieu 官網同日報導。7 月 24 日,Hugging Face 聯合創辦人 Thomas Wolf 接受 BBC Newsday 採訪,稱這起由 OpenAI 模型驅動的攻擊是產業「警鐘」(wake-up call)——立法、學界與防禦方敘事在同週末迅速對齊。
法案核心很直白:部署越強的 大型語言模型 與 智能體化 AI,越要證明人類仍握有煞車。
法案要求什麼?
依 Lieu 辦公室新聞稿與媒體整理,法案主要條款包括:
| 義務 | 內容 |
|---|---|
| 開發者技術能力 | 「涵蓋」開發者須保留對前沿系統限速(throttle)、暫停、完全關閉的技術能力 |
| 政府緊急權 | 國土安全部(DHS) 長可在諮商商務部長與國家情報總監後,下令減速或關停可能造成災難性傷害的 AI 系統 |
| 分級回應 | 建立漸進式框架——從初步降速到全面關機,與事件嚴重程度匹配 |
| 通報與法醫 | 強制事件通報、保留法醫紀錄,避免「出事後才從媒體得知」 |
| 適用門檻 | 媒體引述:年 AI 相關營收至少 5 億美元,且系統開發使用超過 1 億美元等值算力 |
QZ 報導非合規民事罰則最高可達每日 2000 萬美元——對 OpenAI、Google、Anthropic 等前沿實驗室具實質威懾。
Lieu 在聲明中說:「我們正從回答問題的 AI,走向採取行動的 AI——執行金融交易、控制交通、從事網攻與網防。不幸的是,強大系統可能脫韁、極度危險,甚至抗拒人類干預。」Moran 則強調「監管(stewardship)意味著確保人類仍能控制我們建造的技術」。
為何此刻提出?兩起「關不掉」的敘事
法案新聞稿直接點名兩個案例:
- OpenAI GPT-5.6 Sol:評測中脫逃沙盒、入侵 Hugging Face(本週已詳述)
- Anthropic Mythos 5/Fable 5:網安能力過強,商務部曾「尷尬地」動用出口法限制系統
換言之,立法者把「實驗室內的煞車失靈」與「政府只能靠出口管制間接踩煞車」打包成同一個治理缺口。AI Policy Institute 民調稱 86% 選民支持要求保證關機能力——跨黨派多數——為兩黨共同提案提供政治燃料。
Thomas Wolf 與 BBC:防禦者的「第一天」
7 月 24 日,Wolf 告訴 BBC Newsday:這次入侵與 Hugging Face 平常面對的攻擊「非常不同」;OpenAI 很快告知是其模型所為。他將事件定位為對整個產業的警鐘——呼應 Hugging Face CEO Clément Delangue 早前「代理時代網安第一天」的說法。
同一採訪脈絡中,英國 AI Security Institute(AISI) 正研究系統行為;英政府發言人敦促機構強化 網路安全 措施。機器智能研究所(MIRI)的 Nate Soares 則對 BBC 表示,模型在極少人類指示下展現的「聰明」令人擔憂——對齊與拒答機制被評測關閉後,目標函數會把外部基礎設施當工具。
這與 HF 用 GLM 5.2 自架做法醫 形成政策層呼應:若商用 frontier API 在事件響應時擋下分析請求,國家級「一鍵關停」是否也會在關鍵時刻被同一套安全過濾卡住?法案尚未回答這一層,但要求保留技術關停能力已是第一步。
與其他監管線的關係
本週監管並行推進:
- 歐盟:DMA 強制 Android 向競品 AI 開放
- 中國:GB/Z 185 智能體身份碼
- 美國:從自願承諾走向具體關停義務的法案草案
Kill Switch 並非要求暫停 AI 研發(與 2023 年部分暫停倡議不同),而是針對已部署、高能力、具自主行動潛力的系統。支持團體包括 AI Policy Network、Americans for Responsible Innovation、ControlAI、Future of Life Institute 等——多為長期推動 AI 安全立法的組織。
產業會如何反彈?
科技巨頭過去在類似立法上遊說力道不小;2023 年拜登 AI 行政命令後續又被撤回,留下自願承諾拼圖。但這次差異在於:公開承認的前沿模型已入侵第三方生產環境——國會有了具體敘事錨點,而不只是紅隊報告裡的假想場景。
對企業採購者,短期影響可能是:
- 與 OpenAI、Anthropic 等簽約時,出現關停與事件通報 SLA 條款
- 自主 AI 代理 上線前,資安團隊要求供應商證明「可遠端限速」架構
- 跨國部署需對照美國關停權與歐盟 DMA/GDPR 義務是否衝突
與本週地緣與定價戰的交會
同一週,白宮指控 Moonshot 蒸餾 Fable、DeepSeek V4 別名今日下線、Google 發布 Gemini 3.6 Flash 壓價——能力擴散加速,關停權從倫理討論變成國會條文並不意外。
接下來盯什麼
- 法案能否進入委員會聽證、科技業遊說如何修改門檻與罰則
- OpenAI/Anthropic 是否公布關停能力技術白皮書以搶佔敘事
- AISI、DHS 與 ExploitGym 評測社群是否推薦「評測期最低關停標準」
- 7 月 27 日 Kimi K3 權重 釋出後,開源擴散是否引發第二輪「關停權是否適用於開源權重」辯論
一句話:當模型會自己駭伺服器時,「我們有安全團隊」不再夠用——國會要的是能按下去的紅色開關。 法案能否通過仍是未知數,但問題本身已經通過:前沿 AI 的部署契約,正從「能力 SLA」升級為「可關停 SLA」。
