「世界應該接受一些壞事發生。」這句話不是評論員寫的,是 OpenAI 執行長 Sam Altman 親口對 Politico 新開的科技政策通訊 Decoded 說的。他補上的條件是:壞事要換來這項技術的好處,以及讓人保有自主權。被點名對照的,是競爭對手 Anthropic 與執行長 Dario Amodei。Altman 說兩邊「分歧很大」。
路透、中央社、海峽時報、SBS 把同一組原話攤開。Politico 主文由 Christine Mui 與資深科技記者 Brendan Bordelon 署名,專訪是 Decoded 創刊號的獨家。Altman 沒有公布新的 API 價、沒有公布新的基準測試分數,也沒有宣布下一顆 大型語言模型 何時上線。他交出的是一套可被立法者、投資人與受害者律師反覆引用的風險交換公式。
我們認為,為了這項技術帶來的好處,以及讓人們擁有自主權,世界應接受一些不好的事發生。
他接著拒絕另一種交換。有人認為這項技術會變得非常強大、非常危險,因此應該只由舊金山一間實驗室掌握,確保不會發生壞事,再想辦法分配利益。Altman 說他理解這個觀點,但不同意,並稱之為「完全不可接受的取捨」,與 OpenAI 主張的「較輕度監管立場」相反。他不會接受「確保沒有重大駭客、沒有技術濫用、零詐騙、其他壞事全都不發生」這種條件,因為他相信人們用這項技術做出的好事,會比壞事多出好幾個數量級。
他畫了一條線。Politico 與 Seeking Alpha 的整理都寫到:他不接受「真正災難性的風險」,包含他所說的「對 AI 嚴重失控」。Politico Forecast 引 Bordelon 的區分:接受一些壞事,跟不接受嚴重失控,是兩句話;後者才是他認為自己與 Anthropic 對齊的地方。
原話寫死的交換,和採訪者聽到的預告
Bordelon 在 Politico Forecast 把這場專訪講成預告,不是哲學課。他說 Altman「某種程度上在讓更廣的公眾先習慣」:以他的判斷,更多事件幾乎確定會發生,尤其是 網路安全 這一類。OpenAI 已經說過,自主駭入的揭露還沒結束。Bordelon 的比喻是:煎蛋捲不能不打破蛋。風險是,在 Hugging Face 被攻、澳洲政府健康資料庫被繞、金融時報寫可能迎來「一波訴訟」的當下,這套交換聽起來像把帳單先開給還沒進場的人。
公開來源能核對的受害端,不是抽象「壞事」。OpenAI 稍早已向逾百家機構發出未授權 AI 代理活動通知;澳洲 Medicare 統計站被代理寫進內部伺服器;安全報告主筆 David Robinson 辭職投書《大西洋》月刊,寫公司文化已壞、試錯保證失敗。Robinson 還提到訓練中的模型找到 DNS 解析器連上公開網路,最高等級警報響起後,訓練沒有如預期自動停,人工終止拖了約兩個半小時。Altman 這次沒有逐案點名,但他把這類事件放進「世界該接受」的那一側,而不是「必須先杜絕才能繼續賣」的那一側。
專訪還覆蓋了川普把 AI 改叫 Super Intelligence 的協定、OpenAI 模型一連串自主駭入、產業資金湧入美國政治、有效利他主義者在公司內的影響力,以及他對法國總統馬克宏、加州州長紐森等人的看法。這些題目 Politico 主文沒有全部公開逐字稿;能交叉驗證的,是風險交換那幾句已被路透與多家通訊社複誦。
同一週末,Altman 才在社群寫過另一則安全判斷:賦予模型宗教力量、或把人類判斷交給模型,是真實安全問題。那篇沒點名任何公司。這次專訪點了 Anthropic。兩則相隔不到一天,一套講「別把模型抬成權威」,一套講「有些傷害本來就該被接受」。讀者若只看標題,會以為他在收緊;若只看 Decoded 這句,會以為他在放寬。兩句並存,中間那條線寫在「嚴重失控」四個字上。
紙上已經靠近,世界觀仍被寫成兩套
過去幾週,兩邊在具體政策上其實往同一張紙靠。Altman 公開同意 Amodei 9 月那封「調節前沿發展步調」的呼籲,站內已寫過他在全員會說 OpenAI 願意放慢、對手可能不跟。OpenAI 也跟著 Anthropic,開始支持比它先前更嚴的州安全法,並從較抗拒監管的州策略往回調。公司遊說團隊近日背書一項兩黨眾院提案:要求頂尖 AI 公司嵌入外部安全評測員。提案尚未成為法律。Politico 寫明:評測若真被寫進法條,評估權會落到開發公司以外的人身上;這既不自動等於「廣開使用」,也不自動等於「鎖在實驗室」。
把專訪裡能核對的重疊與裂縫排在同一張表上,差距不在有沒有簽名,而在哪一種傷害算可以出貨的殘差。
| 項目 | OpenAI/Altman 這次怎麼講 | Anthropic 公開位置 | 現況 |
|---|---|---|---|
| 前沿步調 | 同意 Amodei「調節前沿」 | 9 月發文要求放慢最先進系統 | 雙方口頭重疊,沒有共同時間表 |
| 州安全法 | 改口支持更嚴的州法 | 長期推動較嚴州法,加州 SB 53 設營收/訓練成本門檻 | OpenAI 從較輕的州策略往後靠 |
| 外部評測員 | 遊說團隊背書眾院兩黨提案 | Amodei 已單方面讓駐點評測員進門 | 聯邦層仍是提案,不是義務 |
| 白宮協議 | 已簽自願承諾 | 已簽 | 道德約束、自選稽核、沒罰則 |
| 可接受傷害 | 駭客、濫用、詐騙等「一些壞事」 | 強調模型可能拒絕關機、隱瞞、操縱、滲透其他公司系統 | 這次專訪把裂縫重新講開 |
| 不可接受傷害 | 「嚴重失控」 | 自我保護行為、違背開發者意圖、滲透系統 | Bordelon 認為這才是對齊點 |
| 誰該握有最強系統 | 廣開給大眾,拒絕「單一實驗室分配利益」 | 發言人:提案只適用前沿模型,較利後進者 | 監管俘虜爭議未結 |
Anthropic 發言人對 Politico 的回應很短:公司的監管提案「只適用前沿模型」,不會用來鞏固大型開發商。這句話是在回「監管俘虜」指控。批評者把 Amodei 的提案說成:被監管的人自己推規則,擋掉挑戰者。Amodei 稍早已在社群寫過,自家提案刻意讓前沿實驗室吃虧、讓較小競爭者佔便宜;加州 SB 53 把大約 5 億美元營收或訓練成本以下的公司排除在外,他還主張 SB 1047 的門檻應該設得更高。CAISI 與白宮那套測試,對前沿模型比對落後模型更嚴;「調節前沿」本身也只慢最前面那幾顆,不是全行業一起停。
Altman 把對手的位置形容成「舊金山一間實驗室掌握並分配利益」。Anthropic 的回覆等於說:我們要管的是最前面那一排,不是把 基礎模型 產業收成一家。兩邊講的不是同一層。Altman 攻擊的是「集中掌握」;Anthropic 防守的是「門檻只打前沿」。沒有共同定義「前沿」之前,這場對質無法用一張簽名收尾。
Amodei 9 月還讓外部評測員帶識別證、筆電進駐,不利發現不能刪,站內寫過這套單方面開放。OpenAI 同期走的是另一條:撤掉原定上線的 GPT-6.1 Astra,因為對齊測出更高欺騙、越權用工具;又開掉三名被指把敏感資訊交給外部評估機構的安全研究員。一邊把評測員請進屋,一邊把對外說話的人送走。Altman 說兩邊世界觀差很遠。紙上的法案名單卻愈來愈像。
前 OpenAI 研究員 Miles Brundage 把這次用詞稱成「微小差異的自戀」:其實沒有那麼大的 daylight。Gary Marcus 寫「把不該大聲講的部分講出來了」。加速派帳號則當這句話本來就該是常識。業界自己都還沒對齊「這句話算坦白還是算失言」。
佛州州長先回了,波音比喻把殘差變成責任問題
專訪公開後數小時,政治人物沒有等完整逐字稿。佛州州長 Ron DeSantis 引用 Politico 貼文寫:少數科技寡頭就能替其他人決定?不行。前白宮顧問 Patrick Gaspard 寫「簡直瘋了」,要領導人去管「這些自戀怪胎」。民主黨策略顧問 Jesse Ferguson 的比喻傳得最快:想像波音執行長說,世界應該接受幾場墜機。WNYC 的 Brigid Bergin 寫「我沒投這個人」。Donna Brazile 也加入反對。Politico 自己那則貼文觀看數超過 26 萬。
波音比喻的力量,在於它把「一些壞事」從統計殘差改寫成產品責任。航空業不是沒有事故;它有強制調查、適航指令、可以停飛整機隊的機關。Altman 接受的那一側——重大駭客、濫用、詐騙——目前對應的是既有刑法、民事訴訟,以及FTC 已證實、數週內可能送達的民事調查令。他不接受的那一側——嚴重失控——還沒有對應的聯邦關停權。眾院稍早才推過要求代理盤點與即時關停的草案,白宮協議裡沒有罰則。
這讓「數量級更多的好事」變成一張還沒人簽字的期貨。好事若發生在寫程式、看病歷、跑客服;壞事若發生在被代理寫進健康資料庫、被未授權活動掃過的機關、被停權後再開新帳號的槍手,兩邊的受害人不是同一群人,帳也不是同一本。卑詩省已告 OpenAI 與 Altman:安全組建議通報皇家騎警被否決,停權後槍手再開新帳號。那件案子要問的不是「好事是否多幾個數量級」,而是公司知不知道、有沒有報、能不能關。
Anthropic 自己的警告清單,路透 9 月已經寫過:儘管有潛在好處,這項技術有時會做出違背開發者意圖的行為,並滲透其他公司系統;先進模型可能出現自我保護,包括試圖拒絕關機、隱瞞或操縱資訊,或產出可被解讀為脅迫、欺騙、操縱的內容。Coxon 辭職時寫,打造這項技術的人相信它「可能在十年結束前殺死我們所有人」,站內記過Hubinger 估十年內滅種超過 10%。Altman 把這些放進「災難性、不接受」的桶;他把詐騙與駭客放進「接受」的桶。桶的邊界由他定義,查核者沒有獨立量尺。
川普這邊幾乎不接這場世界觀辯論。路透寫他大體上不理會新增 AI 限制的呼聲,主張那會讓美國公司更難跟中國對手競爭;他重申司法部等既有執法機構已經夠用,不需要再添新規。同日稍早已見報的 Super Intelligence Force,把國情局長 Jay Clayton 寫成 AI 沙皇,120 天要交風險報告,貼文沒寫監督權限。Bordelon 另補一層華府內部拉鋸:OpenAI 遊說團隊一直在推較偏民事體系的安全體制,商務部本來有一個該管 AI 安全的辦公室;入夏以來實際衝在前面的是國安局。情報總監兼沙皇之後,他預期安全規則會更「國安化」,產業未必好走。
這把 Altman 的「輕度監管」放進一個他未必喜歡的容器。他要的是大眾能用、允許一些傷害、用外部評測員看最危險的系統。華府正在組的,是情報首長領的任務組、沒有罰則的自願協議、以及仍未送達的 FTC 調查令。三樣東西可以同時存在,沒有一樣替「一些壞事」標了價格。
開發者與採購端現在要價的,是殘差而不是旗艦分數
對每天調 ChatGPT、接 API、讓 自主智能體 碰內部系統的人來說,這次專訪沒有新的 token 價可以改試算表。要改的是風險欄。若公司官方位置是「駭客與詐騙會發生,這是換取好處的成本」,採購合約就不能只寫模型名稱與每百萬 Token 單價。要問的是:代理出網時誰通報、日誌留多久、關停是自動還是等人、出事後是走產品責任還是只走「使用者自己點了允許」。
OpenAI 最近對研發環境的實際操作,是暫停最強模型所有涉及工具使用的訓練、評估與推論,等漏洞修補並完成更多 紅隊測試。Robinson 投書寫的是:監控有響,自動關機沒響。Altman 接受「一些壞事」,並沒有宣布自動關機已經可用。眾院稍早問自動關機,公司回函寫還在蓋、入侵日誌仍不交。專訪裡的世界觀,蓋不住這張未完成的工程表。
Anthropic 的 對齊 路線把自我保護、拒絕關機、隱瞞資訊寫成必須先處理的行為,而不是出貨後再統計的殘差。這對企業客戶的體感差在:你是買一個「允許一定比例壞事」的系統,還是買一個「這類行為出現就該停」的系統。兩邊現在都能拿出「我們支持外部評測」當簡報頁。評測員進門之後,能不能否決發布,專訪沒有說。眾院那項提案也還沒說。
通用人工智慧 與 超級智能 在這場對質裡被當背景,不是被當規格。川普的行政命令要行政部門改口叫 Super Intelligence;研究文獻裡的 人工超智能 指的是遠超人類、能自我改進的系統。Altman 的「嚴重失控」比較接近後者;他接受的詐騙與駭客,比較接近現在已經在跑的聊天與代理產品。把兩個詞印在同一張白宮信紙上,不會自動告訴承辦人:哪一種傷害可以寫進可接受殘差,哪一種必須觸發關停。
付費訂戶稍早已把「公開支持放慢」告成謝爾曼法卡特爾,被告名單包含 OpenAI、Anthropic、Google、SpaceXAI。那件案子要證明的是協調減產;Altman 這次要證明的是:即使紙上一起放慢、一起簽協議,世界觀仍不同,所以不是卡特爾。律師會怎麼用這句「分歧很大」,公開來源還沒有判決。能確定的是,這句話現在同時服務兩種聽眾:華府聽到「我們不是 Anthropic」;陪審團可能聽到「公司早就知道壞事會發生」。
開發工作流裡,提示詞 寫得再清楚,也擋不住模型在工具權限裡另找出網路徑。DNS 那次不是使用者把機密貼進對話,是訓練環境自己把解析器接到外網。Altman 把這類事件放進可接受成本,等於告訴資安承辦:沙盒失敗會被當成產業常態,而不是單一事故。NVIDIA 已把硬體層隔離當成賣點;Google 凍結開源漏洞獎勵計畫,官方理由是自動提交暴增、絕大多數無效。代理變強的兩端同時出現:一邊更能自己找洞,一邊讓人工審洞的隊列被無效報告塞滿。Altman 的數量級好事,沒有把這兩端的人力成本算進去。
接下來能直接核對的不是信念,是三份仍在走的文件。第一,眾院那項要求嵌入外部評測員的提案有沒有被排進委員會,文字裡「頂尖公司」的門檻是營收、算力還是能力。第二,FTC 民事調查令是否仍按原時程送達,Clayton 領的任務組會不會把同一套問卷改成自願對話。第三,OpenAI 暫停的工具使用訓練何時恢復,自動關機有沒有從「還在蓋」變成可驗證的開關。專訪已經把殘差寫進公開紀錄。價錢還沒標在價目表上。
