6 小時對上 217 年:GPT-6 Astra 把拿破崙密信讀成一份兵力清單
密碼本遺失兩百多年的一封拿破崙加密信件,由 SentinelOne 工程師以 GPT-6 Astra 從掃描影像出發、花六小時完成辨識與解讀,本文整理信件來歷、破解流程、還原出的兵力內容與驗證方法。
密碼本遺失兩百多年的一封拿破崙密信,由單一模型用六小時完成辨識、破解與重建,還原出 1809 年開戰前夕的兵力部署。
一封寫於 1809 年 3 月 16 日的法文密信,因為解讀所需的密碼本早已遺失,兩百多年來沒有人能完整讀懂。把它變回可讀文字的,是一個 AI 模型和大約六個小時。
10 月 4 日消息公開:SentinelOne 的 AI 工程師卡特·丘奇使用 OpenAI 的 GPT-6 Astra,從一張歷史文獻的掃描影像出發,破解了這封拿破崙·波拿巴的加密軍事信件。值得留意的是流程的形態:文件辨識、符號分類、密碼推理與文本重建,過去分屬不同領域的專家工作,這次由同一個模型在一個下午之內走完。
信是寫給誰的
1809 年 3 月,奧地利正準備對法國開戰。拿破崙寫信給繼子、時任義大利總督的歐仁·德·博阿爾內,要他以加密信件把軍事情報轉達給將領奧古斯特·德·馬爾蒙。馬爾蒙當時駐防達爾馬提亞,遠離拿破崙的主力部隊,這封信的用意是讓他掌握整體戰局,並做好行動準備。
現存文件的開頭是一行普通法文,其後接著 24 行密文,由數字、字母與自創符號混雜組成。全信約有 1,300 個密碼單元、155 種不同符號;部分符號對應單一字母,部分直接對應完整的法文單字。字母與整詞並用的設計,意味著破解者不能只靠字母頻率統計,還得同時重建一整套詞語對照表。研究者先前僅確認 33 個符號的意義,其餘部分就此懸置了兩個世紀。
六小時裡發生了什麼
據丘奇說明,GPT-6 Astra 先分析掃描影像,把文件切分為多個區域、辨識其中的符號,接著嘗試推測密碼結構。模型採用模擬退火演算法等方法,對符號可能對應的字母與單字組合進行大量測試,再以歷史法文文本的字母與詞語規律比對,評估各個候選解讀的合理性。參考文本包括大仲馬、維克多·雨果的作品,以及馬爾蒙本人的相關著作。過程中,模型也確認部分符號對應的是完整法文詞彙。
換個說法,這套流程接近邊猜邊校:先提出大量符號與文字的對應假設,再看拼出來的法文像不像那個年代的法文,不像就修正假設。人力做同樣的事,需要古文書學、密碼學與法語史的背景湊在同一張桌子上;這次,模型把這張桌子併進了單一流程。
讀出來的東西,補上歷史缺的一塊
破解後的內容,是拿破崙在奧地利戰爭爆發前夕的兵力部署:法軍與盟軍在巴伐利亞、波蘭、薩克森與義大利各方向的部隊狀況,以及向奧地利推進的俄軍動態。信中還包含先前歷史紀錄缺席的細節,例如奧軍的部署情形、馬爾蒙所在的位置,以及法方下一步的軍事計畫。馬爾蒙遠在達爾馬提亞,這封信等於是他了解整條戰線的唯一窗口;在它被讀懂之前,這個窗口對後世是關著的。對研究者而言,如今等於多出一份此前無人讀過的開戰前情報彙整。
驗證:把參考資料拿掉,再跑一次
AI 交出歷史解讀時,第一個該問的問題是:這是推理出來的,還是從既有史料裡直接背出來的?丘奇的作法是把與拿破崙、馬爾蒙相關的歷史文本從參考資料中移除,重新執行整套分析,模型仍得出相同的解讀結果。這個動作相當於考試時收走課本,剩下的答案才算是自己寫的。
破解結果隨後獲得歷史密碼研究資料庫 Cryptiana 維護者 Satoshi Tomokiyo 的認可,該資料庫已把馬爾蒙信件標記為已破解密文。這一關不能省:沒有可重跑的流程與外部審核,模型輸出只能算候選答案。這與我們先前介紹過的AI 科學計算必須留下可重算紀錄是同一套紀律,差別只在這次驗收的對象,是兩百年前的法文。
這不會是最後一封
同一個模型近來已有相近紀錄:先前也有開發者藉 GPT-6 Astra 破譯 83 年前的德軍無線電密文。兩件事放在一起看,方向相當一致:大量已數位化卻從未解讀的文獻與密文,正處於被重新檢視的窗口期。
丘奇對成果的定位也值得記下。他表示這類破解工作理論上人工也能完成,但通常需要大量時間和專業知識;AI 的價值在於把多個領域的工作壓進同一條流程,這次只用了六小時。這句話同時畫出了界線:模型交付的是候選解讀,成立與否仍取決於重跑驗證與具名審核,這次由 Cryptiana 扮演這個角色。要求每個主張附上證據與負責人的邏輯,也出現在OpenAI 自家前沿模型訓練的安全案例裡。
接下來可盯的訊號並不抽象。Cryptiana 這類資料庫裡仍標記為未解的條目,會不會在接下來一段時間陸續改寫狀態,考驗的是產能;下一則 AI 解讀歷史文獻的新聞,有沒有附上移除參考資料的重跑紀錄與外部認可,考驗的是紀律。兩者都齊備,這六小時留下的才會是一套可用的方法。