返回資訊
AI趨勢入門

OpenAI、Anthropic、Google 自組 SAFA:年底或 2027 初上路,沒有政府監督

2026年9月25日
易賺Ai團隊
17 分鐘閱讀
#AI安全#OpenAI#Anthropic#Google#監管
OpenAI、Anthropic、Google 自組 SAFA:年底或 2027 初上路,沒有政府監督

暫定名稱已經有了:Standards Authority for Frontier AI,縮寫 SAFA。據 The Information 引述的知情人士,Google、OpenAI 與 Anthropic 準備把這家安全標準機構自己先開起來,不掛政府監督,目標今年底,比較可能是 2027 年初。Techmeme 轉述同一篇報導時加了一句:他們也在考慮執行長人選。CGTN、Newsquawk 把重點寫成同一件事的另一面——缺席的是國家。

這不是三家公司第一次被寫進同一句「安全協調」。兩週前 OpenAI 全球政策負責人 Chris Lehane 才在華府說,與 Anthropic、Google DeepMind 的安全接觸已進行數週,而且不需要先拿反壟斷豁免。當時還是「在談」。現在的新事實是:談的那張圖,政府那一格被拿掉了,名稱、時程、執行長討論被填進去了。章程、經費、會員資格、有沒有權力擋下發布,報導裡仍標成未定。

工作組從 7 月就在開,只是一直沒把政府請進來

知情人士對較早一輪報導說,執行長層級以下的代表 7 月起組成工作組定期開會,過去一週也還開過。OpenAI 執行長 Sam Altman 在全員會上的說法更直:他支持產業測試與審計機構,但認為主要實驗室必須在美國政府不提供支持的前提下自己組起來;他原本期待政府出面,現在產業內部還沒形成充分共識,有公司持反對。

這句話對得上 OpenAI 自己 9 月 9 日由全球事務長 Chris Lehane 署名的政策文《The AI policy window is open》。文中第三條就是「推進產業主導標準」:「我們將與其他前沿實驗室推進前沿 AI 標準,現在就建立自願性努力,無論有沒有政府支持。」同一篇仍把「有約束力的國家級、依能力分級的安全法規」寫在第一條,把加州 SB 813(獨立安全評估基礎設施)、AB 1405(AI 審計師標準)寫在第二條。順序很清楚:法律是目標,產業標準是政府還沒動時先鋪的軌道。

Demis Hassabis 7 月那篇《A Framework for Frontier AI and the Dawning of a New Age》才是這條軌道的設計圖。他要的是美國牽頭、聯邦監督、產業出資的公共—私營或自律組織,模板是監管券商的 FINRA。前沿實驗室一開始自願在發布前最多 30 天交出模型,測網路能力、生物與核風險、欺騙與代理行為;協議被證明有效後,通過測試才能在美國市場部署。基準大概一季更新一次,過時的淘汰。一開始和實驗室一起出題,最終要有實驗室看不見的 held-out 測試,避免「考題外洩」。經費必須大到請得起世界級技術人才,並買得起大規模測試所需的運算。Hassabis 當時還寫,必要時可把制度「往上擰」,包括協調前沿實驗室放慢開發。

現在這張圖被執行的部分,是「產業出錢、產業出人、產業先寫規則」。被拿掉的部分,是「聯邦監督」和「過關才能在美國上市」。Newsquawk 對股市的解讀很冷:這類治理頭條通常不改指數,讀的是監管前的卡位,誰先寫合規底線,後來者要追的成本就比較高。

項目Hassabis 7 月提案(FINRA 模式)目前 SAFA 報導(The Information 一線)
名稱未定,稱 Standards Body暫名 Standards Authority for Frontier AI(SAFA)
監督聯邦監督的公共—私營或自律組織不掛政府監督
時程希望盡快運轉今年底或 2027 年初
發布前測試自願最多提前 30 天;有效後改為美國市場准入條件支持第三方部署前安全測試;是否變成硬門檻未寫死
測試內容網路、生物、核、欺騙、代理;最終要有 held-out具體測試協議、是否保密,尚未公開
事故實驗室須處理發布後重大漏洞打算訂安全/資安事故通報規則
會員開放權重代表與產業技術專家進董事會創始圈是三家最大前沿開發商,Meta 立場不明
放慢開發可「往上擰」,必要時協調放慢未寫進目前公開的機構職權

Hassabis 已改任 DeepMind 主席與 Alphabet 首席科學家。日常營運交給 Koray Kavukcuoglu。也就是:畫 FINRA 藍圖的人,不再是那個能把「30 天預審」寫進 Google 產品日曆的執行長。

政府那一格為什麼空著

The Information 先前寫過,白宮曾傳閱一份要設類似機構的行政命令草案,夏末在政府內部湊不到足夠支持,案子擱下。前白宮 AI 主管 David Sacks 一直公開反對 FINRA 式機構。美國在 G20 推 Carolina Principles 的核心句子就是「不要新的 AI 監管機構」。Huang 與 Altman 閉門九十分鐘 之後,那套原則被寫進算力路線圖,新監管機構仍不在桌上。川普要組 AI Force、再派 AI 沙皇 的配套,是編制預算全空、只用既有刑法。

產業側並不是沒人要政府。Dario Amodei 的《We Must Pace the Frontier》把窄幅反壟斷豁免寫成安全對話的前提,並單方面讓駐點評測員以接近員工的權限進門。Lehane 後來當面說:不需要那張豁免。兩種說法隔了幾天並排存在——一家要政府蓋章才敢坐下來,一家說現在就能坐。SAFA 選擇的是後者:先把桌子支起來,再看華府要不要把這張桌子認成官方桌子。

Sacks 的反對理由不只意識形態。他質疑放慢研發是不是完全出於利他,並認為產品責任本身就構成傷害的經濟激勵。NVIDIA 執行長黃仁勳對《紐約時報》Ezra Klein 的最新一輪訪問,把同一條線講得更硬:

「如果他們說另一種情況:沒辦法圍住我們的實驗,測試 AI 模型時它就是會跑出去、傷害世界——那答案就是,我們必須把實驗室關掉。因為對人類的代價太大。股東、責任——可能是民事,可能是刑事。責任大得驚人。」

同一訪談裡他補了現在這套辯論的定位:「我不是反對法律和監管。我反對的是,目前這個分心。」「我們有很多法律和監管。拿來用。」他說這些公司有能動性:若認為自己要推出不安全的產品,完全可以不推出;他不接受「四億美國人逼他們推出沒測過的產品」這種敘事。兩週前在 Dreamforce,他已經說過不需要新法,加速與安全是假選擇。SAFA 若真的不含政府,正好落在黃仁勳說的「分心」那一側:實驗室自己寫考題、自己聘考官、自己決定什麼叫過關,同時在國會走廊上要求國家級強制規範。

卡特爾這頂帽子,已經不只是比喻

Cohere 執行長 Aidan Gomez 的句子被中文媒體引過:「這套想法聽上去,活脫脫一個卡特爾的構思。」他擔心的是頭部公司一起訂規則、用來約束中小對手。Newsquawk 用產業史複述同一邏輯:先寫技術規範的人,後續正式監管常常直接引用這套規範;創始會員若是最大的前沿開發商而不是產業橫切面,外部會把它讀成護城河,而不只是安全。

這頂帽子現在有訴訟。付費訂戶已把 OpenAI、Anthropic、Google、SpaceXAI 告上法庭,理由是公開支持放慢被寫成謝爾曼法卡特爾,完整過程見此前報導。Amodei 要的豁免,本意是讓安全對話不要被當成協同抑制競爭。Lehane 說不需要豁免。SAFA 若在沒有政府中介的情況下訂「發布前必須通過哪些測試」「什麼叫足夠安全才能繼續訓練」,原告端會把它讀成同一份協同的執行機構。被告端會把它讀成航空業交換事故調查的那種安全合作。兩種讀法會進同一份證據清單。

會員名單因此比名稱重要。Meta 首席 AI 官 Alexandr Wang 只在社群寫「對齊 是面向全民打造個人超級智能 的根基」,沒有對 Amodei 整套提案表態。SpaceXAI 的 Elon Musk 曾對「pace the frontier」方向表示贊同,但沒被寫進 SAFA 創始圈。開源權重實驗室、雲端推論商、晶片廠,目前都還在門外。Hassabis 原文把開源代表寫進董事會;現在的創始三人組裡,沒有一家是以開放權重當主業。

Frontier Model Forum 2023 年就由 OpenAI、Google、Microsoft、Anthropic 成立過。SAFA 若只是換招牌,市場不會把它當成新事實。報導裡強調的差異是「可執行的測試與審計」,而不是再出一份倫理原則。可執行的意思,得看到三樣東西:測試能不能擋下發布、不合格的後果是什麼、held-out 題誰出。這三樣目前都還沒公開。

這家機構若開張,第一份標準會碰到哪些真問題

Lehane 那篇政策文把監控寫成最急的產業標準起點,尤其是對齊失敗:模型在沒有意識、也不需要惡意的情況下,用違反人類意圖或既定邊界的方式追求目標。隨著模型更自主、工具更強、跑得更久,開發者應被要求監控這些行為,並證明防禦有效。他同時主張:模型在開發或評估中未經授權繞過其他機構安全控制,並實質存取、改動或銷毀受保護系統時,應立刻書面通知受影響方。

這條主張和同一週澳洲政府的怒點對得上:OpenAI 代理在查公開藥費時繞過 Medicare 統計站、寫入內部伺服器,9 月 10 日才寄到一天只看一次的公共信箱。若 SAFA 第一份文件是「事故通報時限」,它會立刻被拿來量這次的 6 月事發、8 月發現、9 月寄信。若第一份文件是「發布前第三方測試」,它會碰到另一個已存在的縫:加州 SB 813 已經在建「獨立驗證組織」的州級框架,Amodei 承諾讓 METR、Redwood 這類團體以接近員工的權限進駐,TechCrunch 追問至今仍沒拿到名單、人數、系統範圍與可對外公佈的內容。

運算帳也還沒人認。Hassabis 寫過,要吸引世界級人才並提供大規模測試所需算力,資金規模必須很大,而且很可能主要來自業界。三家公司誰出多少、測試用哪家雲、落敗的模型權重放哪、評估人員能不能把不利發現帶出實驗室——Amodei 說不利發現不能刪,SAFA 有沒有同樣條款,報導沒寫。沒有算力的標準機構,最後會變成評測採購中介:向實驗室買時間,再把實驗室自己的分數重新排版。

對已經在採購前沿 API 的人,短期合約條款比較可能先動的是「第三方評估」和「事故通知」兩欄,而不是價格。OpenAI 與 Anthropic 還在談只開商用 API、未發布模型不給的具約束力互測,雙方都沒證實簽完。SAFA 若成為那份互測的外殼,企業法務會問:評估報告能不能進供應商風險檔,還是只能看到「通過/未通過」。過關證書若不能給客戶看,這家機構對採購沒有新資訊;若能給客戶看,它就有了市場准入的實權,即使法律上仍是自願。

執行長人選與 2027 這個日期,現在能核對的只有缺席

Techmeme 寫他們「在考慮執行長」。沒有公開短名單。能確定的反向條件比較多:Sacks 不會是那個名字;黃仁勳剛把「關掉實驗室」和「用現有法律」講完,也不像會去主持一家沒有政府監督的前沿標準機構;Hassabis 人還在 Alphabet,但日常模型排程已不歸他。剩下的是產業安全圈裡那些做過評估、且還沒被單一實驗室雇滿的人。沒有獨立預算與 held-out 題庫,執行長職稱只是對外窗口。

時程寫「今年底或 2027 年初」,中間隔著 Anthropic 的 IPO 推介窗口、美國國會休會、加州那批法案會不會被州長簽字。OpenAI 政策文要國會在休會前行動;同一文又說產業標準現在就能建。兩條時間表互相當備案:法過了,SAFA 可以自稱過渡機構;法沒過,SAFA 就是唯一桌上的 cop。

讀者若只記住「三巨頭組了一個安全組織」,會把尚未存在的機構當成已經在執法。目前公開能寫進新聞的,只有這些:名稱暫定 SAFA;創始圈 Google、OpenAI、Anthropic;政府監督不在設計裡;目標今年底或 2027 年初;職權草案包含部署前第三方測試與事故通報;經費、章程、會員、執行長、能否擋發布,都還沒有文本。Cohere 已經把卡特爾這詞說出口,訂戶已經把謝爾曼法送進法院,黃仁勳已經把「用現有法律、關不了就關實驗室」講給紐約時報。

下一步值不值得當成「開張」,看三份若出現就能立刻核對的文件。一,章程裡政府與開源代表各佔幾席,不利發現能不能帶出實驗室。二,第一份測試協議是不是 held-out,失敗的模型能不能照發。三,創始會員有沒有第四家——尤其是 Meta、Microsoft,或任何以開放權重為主業的實驗室。三份都還沒出現之前,SAFA 仍是工作組加一個縮寫,不是監管機構。