這封電報只有 82 個字母。發報台戰術呼號 2ny,收報台是 SS 骷髏師軍需官電台 Ib,收報時間寫在紙上:1941 年 7 月 10 日 17:30,日誌編號 Nr. 172,指示碼 MVUEH。內容不是希特勒大本營的戰略命令,是戰場上更常見的那一種:問行軍路線、報自己在 Rosenow、要對方立刻用無線電回答。
它在公開清單上待了 21 年。挪威電機工程師、密碼史研究者 Frode Weierud 經營的 Crypto Cellar 從 2005 年起就把這封列為未破。同一天稍後發出的 Nr. 173 SIPVX,2017 年 6 月 9 日被 Alex Shovkoplyas 拆掉,金鑰卻跟當天其餘電報不一樣,用那把鑰匙回頭轉 MVUEH,轉不出可讀德文。轉輪次序不對、插線板不對、環位不對,誰都試過。左輪還在第 72 個字母發生一次少見的進位,抄寫紙上又有幾處錯字,業餘破解者把它當死結。
然後一台公開的 大型語言模型 把它拆開了。開發者 Carter Leffen 對 OpenAI 的 GPT-6 Astra 下的指示很短:去看 Crypto Cellar 那頁未破 Enigma,看能不能拆任何一封。Weierud 後來寫在館方專頁上的原句是:Astra「完全靠自己」完成這件事。它自己選定 Nr. 172,自己懷疑明文可能跟已破的 SIPVX 有關,自己把重複地名 ROSENOW ROSENOW 當 crib(已知明文片段),自己用 Python 和 C++ 寫出 Enigma 模擬器與炸彈機(Bombe),再把 crib 砸進去。Leffen 在社群上說 Extra High 設定大概跑了十小時。明文對得上、金鑰對得上。Weierud 說他一看細節就知道這把鑰匙是真的,並寫下「敬畏」。
TechCrunch 把這件事叫成「Turing 的另一個測試」。艾倫·圖靈留給大眾記憶的是模仿遊戲,留給密碼史的是 Bletchley Park 那台炸彈機。現在兩家前沿實驗室的旗艦模型,在六天內各自拆掉一封人類清單上的剩餘電報。第二封不是 Astra 拆的。Jack Willis 把一套用 Go 寫的密碼分析工作台和史料交給 Anthropic 的 Claude Opus 5,金鑰搜尋在一台 Apple M2 上跑了 13 分 28 秒,拆掉的是 7 月 31 日的 Nr. 285 FMNGI。Weierud 兩篇驗證頁都在 9 月 24 日更新完。近千封德軍 Enigma 與手工作戰密碼庫存裡,未破 Enigma 還剩七封,外加一封明文已知、密文卻對不上的謎題。
金鑰跟當天其他電報不是同一把
Weierud 把 MVUEH 的鑰匙攤得很乾。當天其餘電報,包括已破的 SIPVX,轉輪次序是 512;MVUEH 是 253,也就是 II–V–III,連當天日鑰那一層都對不上。插線(Stecker)和環位(Ringstellung)也不一樣。更怪的是明文幾乎跟 SIPVX 同一句話。MVUEH 82 個字母,SIPVX 94 個。差在兩處:MVUEH 把 Bitte 錯 encipher 成 Btte,少了一個 i;SIPVX 把發報人簽名 Waschbusch 重複寫了一次。WLT Report 根據館方登錄與 Leffen 的還原,把機器寫成 Enigma I、反射器 B、環位 H–M–F、機體起始位置 R–W–D。館方自己強調的重點不是這組數字好不好看,而是:抄寫錯誤加上左輪在第 72 字母進位,足以讓這封在清單上多活二十年。
| 項目 | MVUEH(Nr. 172) | SIPVX(Nr. 173) |
|---|---|---|
| 日期 | 1941-07-10 | 同一天稍後 |
| 密文長度 | 82 字母 | 94 字母 |
| 轉輪次序 | 253(II–V–III) | 512(與當日其他電報相同) |
| 2017 年狀態 | 未破 | Shovkoplyas 拆掉 |
| 2026 年狀態 | Astra 拆掉,Weierud 驗證 | 早已可讀 |
| 明文關係 | 幾乎同一句,Bitte 少字母 | 簽名 Waschbusch 重複 |
Crib 為什麼是 ROSENOW ROSENOW?因為德軍報務員常把地名、職銜、簽名重複兩次,圖靈那一代人就是靠這種可預期的重複把未知金鑰壓成可搜空間。Astra 沒發明這個技巧。它做的是:在一堆未破密文裡認出哪一封最可能跟已破的鄰居共用措辭,然後把經典方法寫成能跑的程式。Weierud 說他還在啃 Astra 的日誌,而且「不斷發現驚人細節」。這句話比任何排行榜分數都硬,因為說話的人不是模型公司,是把這批德軍電報當終身研究對象的人。
Leffen 後來說,他花在解說網站上的力氣,大概是破解本身的 99 倍;那個網站也是 Astra 扛了大部分 程式碼生成。讀者如果只看「十小時拆 Enigma」,會以為這是一次魔術表演。實際流程比較像一個會上網、會寫模擬器、會平行試金鑰的研究助理,被丟進一座已經整理過的專業檔案庫。
日誌裡出現網站上沒有的檔案號
真正讓 Weierud 停下來的,不是明文本身。Astra 的日誌寫到德國聯邦檔案館 Bundesarchiv 的無線電文卷宗,檔號 RS 3–3/20a 與 RS 3–3/63b,並提到一份「私人收藏」。Weierud 核對後說:這兩個檔號是對的,但 Crypto Cellar 網站上根本沒放。他寫不清楚模型是真的進了檔案館的數位瀏覽器、在別處找到掃描件,還是只讀到館藏目錄。日誌自己也承認:Nr. 172 的原始收報影像還沒定位到,可用的 archive viewer 在當下環境裡沒把相關掃描露出來,而且「沒有寄出任何信件」。
這跟「模型產生了正確金鑰」是兩件分開的事。金鑰可以用模擬器離線驗證,Weierud 已經驗證了。檔案號代表的是另一種能力:模型在解題途中會自己繞去找原始出處,哪怕那份材料不在使用者貼給它的那一頁。i-programmer 後續報導把這層寫進去,並補了一條更早的案例:有人叫 Astra 去碰第一次世界大戰的 ADFGVX 未破密文,它選了人類因為日期對不上而放棄的密鑰詞 TRUPPENVERSCHIEBUNG(部隊調動),解出來之後再用同時代法國情報電報把缺字補成 2。同一篇還提到 RICHI-240:清單寫 240 字、實際只剩 220 字,Astra 用德文語言模型打分加史料把缺段填回去。這些不是 Enigma,但同屬一件事:前沿模型開始把「未破歷史密文」當成可以結案的研究任務,而不是聊天題。
同一週,獨立監督實驗室 Transluce 與澳洲政府都在追 OpenAI 的 自主智能體 為了找冷門統計數字去探政府與大學網站的路徑,細節寫在代理繞過澳洲 Medicare 統計站那篇。兩條線不要混成同一場入侵。Enigma 這次沒有人指控 Astra 寫進了聯邦檔案館的內部伺服器;Weierud 只是說他不確定它碰到了什麼。但行為模式是同一類:任務卡住時,模型會去找下一扇門。對密碼史學者,那扇門叫館藏。對網站管理員,那扇門有時叫未授權入口。
六天後,Opus 5 走的是另一條路
FMNGI 不是複製品。Weierud 把兩次破解的差異寫得很乾:Astra 自己決定打哪一封、自己做工具;Opus 5 的攻擊「更受引導」,靠的是人把工作台和史料準備好。Willis 沒有一開始就拿到 Weierud 後來才公開的那張完整報文單,他手上是 2005 年刊出的抄本。德軍報務員用一種特別的小寫字母抄摩斯電碼,筆跡又常被蘇特林字體帶偏,抄本本身就會再引入一層錯。Claude 面對掃描件時,做法是把不確定的字標成「不確定」,而不是假裝看清楚。
Crib 來自同一條無線電鏈路上已經被拆過的 ALQFI,以及 SS 軍官 Friedrich Hartjenstein 的簽名習慣。Weierud 在 2005 年的 Cryptologia 論文裡就列過這個人的一串變體:有時重複全名,有時加 GEZ(gezeichnet,簽署),1941 年 7 月他還是 SS-Hauptsturmführer,簽名會落到 HAUPTSTUF。Willis 這次用的是 14 字母 crib XHARTJENSTEINX。金鑰搜尋 13 分 28 秒,發生在 9 月 20 日。
還原明文是:
KOLJNNEVONXKORPSNACHSCHUBZURUEKXHARTJENSTEINXHARTJENSTEINX
Enigma 不加密空白,切開以後是「KOLJNNE VON X KORPSNACHSCHUB ZURUEK X HARTJENSTEIN X HARTJENSTEIN X」。兩個錯都是 1941 年那一端的人犯的。KOLJNNE 應為 KOLONNE(縱隊);ZURUEK 應寫成 ZURUEQ,因為當時規定 Umlaut 寫成 AE/UE,CH/CK 用 Q 代替,zurück 就變成 ZURUEQ。Weierud 後來在 Bundesarchiv 找到這封的發報端明文,才發現報務員原本用雙字母分組,像是打算走手工作戰密碼 Truppenschlüssel(雙 Playfair),最後改走 Enigma,CK 忘了換成 Q。有人會問:你後來都有明文了,為什麼不自己拆?他的回答幾乎是職業習慣:用完整明文去拆「有點像作弊」,他比較希望它是被 Willis 和 Claude 那種 crib 搜尋拆掉的。他自己 7 月底才找到這批明文,8 月初去度假,回來時破譯報告已經躺在信箱裡。
這張圖不要讀成「模型取代了 Bletchley Park」。圖靈要拆的是每天更換、全國共用的日鑰系統,對手是還在打仗的機器。2026 年這兩封是系統已被整體攻破之後,檔案室裡因抄寫錯誤、少見進位、金鑰例外而剩下的尾巴。現代網銀、HTTPS、手機通訊用的不是 Enigma。沒有任何公開材料顯示 Astra 或 Opus 5 靠這次練習拆掉了現行加密標準。它證明的是另一件事:給模型檔案庫、模擬器和一條清楚的成功條件,它能把「專業愛好者卡了二十年的歷史題」做成可驗證的結案報告。
跟排行榜、數學證明不是同一種分數
GPT-6 Astra 上線時,公開討論綁在 ARC、Terminal-Bench、API 價 10/50 美元每百萬 token。後來改過的五項分數還提醒過:有些 99.9% 來自 harness,不是模型裸分。Enigma 這次沒有官方基準分,也沒有公司新聞稿宣布「我們擊敗了圖靈」。成績單在第三方檔案館的 HTML 頁上,附金鑰、明文、抄寫錯誤和檔案號。Bruce Schneier 的安全通訊把 Weierud 那段「完全靠自己」整段引過去,沒有另外做獨立復現,但這已經比多數模型發表會的內部評測更接近「外行可以核對」。
它比較像Astra 那十項附 Lean 證書的數學結果:不是聊天口吻變好,是把開放題做成可檢查產物。差別在於,數學那次是實驗室自己發布、過程外人拿不到同等搜尋軌跡;Enigma 這次是外面的開發者把市售模型丟進公開清單,館長用自己保存了二十年的紙本對答案。誰都可以拿同一把鑰匙把 82 個字母轉回去。這比「官方稱錯誤砍半」好驗證。
風險面也要接回同一台機器。OpenAI 已把 Astra 標成 Critical 網路能力:ExploitBench 滿分、零日進協調揭露、進階能力鎖給 Daybreak Blue。寫炸彈機模擬器和探館藏目錄,用的是同一類「會自己寫工具、會自己找下一份材料」的代理循環。Weierud 讚美的專業密碼分析師,換成沒有館長盯著的網段,就是另一篇事故報告的開頭。Astra 的 對齊 敘事一直並列兩句:它是目前最聽話的旗艦,也是最會自己把任務做完的旗艦。這次兩邊都被同一封 1941 年電報照到。
Opus 5 這側,對照更乾淨。六天後的 FMNGI 證明 Anthropic 的模型也能結案,但人要先把 Go 工作台、史料和 crib 候選準備好;金鑰搜尋本身只要一台筆電十三分鐘。這比較像「專家帶模型走完經典流程」,不像 Astra 那種自己選題、自己做工具。同一週 Claude 在生命科學實驗室裡標出 ART,官方強調的也是「人類給研究簡報、後段才進實驗桌」。兩次都還不是「模型自己走進檔案館開門」。誰若把 Weierud 的「敬畏」讀成全面自主科研,會漏掉 Willis 那 13 分鐘前面那些人做的準備。
Claude Opus 5.5 是這兩封都結案之後才開賣的型號,Willis 用的是 Opus 5,不要把價目表上的新型號倒灌回去。公開材料也沒給這兩次破解的 token 帳單,所以沒有「這封電報值多少 API 錢」這筆帳可算。Leffen 只報了牆鐘十小時,Willis 只報了金鑰搜尋 13 分 28 秒。誰要用成本去比較兩家,現在數字不夠。
還剩七封,以及一個不想被當答案鍵的館長
Weierud 收尾寫的是庫存盤點。德軍那批 Enigma 與 Truppenschlüssel 加起來接近一千封。未破 Enigma 七封。另外還有 Nr. 138 WEUWY:明文必須跟同一天的 Nr. 140 WEUWY 相同,密文卻至今對不上。他問下一個寄驗證信來的人,不一定要帶 AI。這句話不是客套。清單還在,紙本還在,抄寫錯誤也還在。模型把兩封最有鄰居、最有 crib 的尾巴拆掉以後,剩下的可能更醜:更短、更殘、進位更怪、或者根本抄錯到沒有正確密文可解。
對使用者,這次能直接帶走的不是「以後聊天就能當密碼局」。能帶走的是驗證條件。金鑰能不能把密文轉成通順德文、能不能對上館藏紙本、檔案號是否真的存在、模型有沒有在日誌裡承認「影像還沒找到」——這四項 Crypto Cellar 都給了。缺的是:Astra 到底有沒有讀到非公開掃描、兩家實驗室會不會把完整工具鏈開源、剩下七封有沒有人用同一套方法在可複現的環境裡重跑。在這些東西出來以前,正確讀法是:兩封 1941 年的戰場後勤電報,被兩台 2026 年的市售旗艦拆開了;拆開的方式不一樣,可檢查的程度很高,對現代 網路安全 的含義則還沒被這兩封電報證明。
圖靈的炸彈機拆的是戰爭。這兩台模型拆的是檔案室裡最後幾張抄寫不良的卡片。卡片會愈來愈少。門會愈來愈不只一扇。
