一封1809年写给法军将领的加密信件,因为密码本遗失,两个多世纪里始终没有完整译文。如今,一名此前没有密码学经验的工程师只交给模型一张低清扫描图,六个小时后便拿到了全文。这件事不只关乎历史:图像识别、资料检索、编写程序和结果核对这些原本要分头找人做的活,如今可以由同一个模型连续完成。
据快科技报道,9月30日,美国AI工程师卡特·丘奇在社交平台公布,他用OpenAI的GPT-6 Astra模型破译了一封1809年写给法国将领奥古斯特·德·马尔蒙的加密信件。丘奇就职于网络安全公司SentinelOne,长期从事安全运营与自动化,此前没有历史密码破解经验。他已于9月18日公开完整研究记录,包括转录文本、密码表以及可供他人复现结果的脚本。按他的说明,模型执行时间约6小时,此后他又用了数个晚上整理材料、核查历史背景。
这封信并非拿破仑亲笔,而是按其命令发出的加密简报。1809年3月16日,拿破仑致信继子、意大利总督欧仁·德·博阿尔内,要求他把法国及盟军主要部队的位置告知正在达尔马提亚指挥法军的马尔蒙,并注明消息要“以密码写成”,由可靠的军官送达。现存文件第一行是普通法语,之后是24行由数字、字母和自创符号组成的密文。由于完整密码本没有流传下来,这封信长期被历史密码数据库Cryptiana列为未破解条目。目前公开的完整图像,仅来自法国军事史期刊1969年刊登的一张1202×1836像素低清扫描件。
丘奇统计,密文约有1300个密码单元、155种符号。这是一种同音替换密码:高频字母可以用多种写法表示,部分符号还直接对应整个法语单词,传统词频分析因此效果有限。此前,密码史研究者丹尼尔·唐特整理出33个符号的对应关系,可解释约三分之一的内容,其余约865个单元一直没有进展。GPT-6 Astra的处理流程是:先把扫描图切成多个区域,逐个识别手写符号,再把同一符号的不同写法合并;随后以已知的33个符号为锚点,编写基于模拟退火算法的求解程序,反复测试不同字母与单词组合,并用19世纪法语语料判断结果是否通顺。
用于判断语言是否自然的材料,包括大仲马、雨果的作品以及马尔蒙本人的回忆录。模型还识别出部分符号并不代表单个字母,而是代表整个词,对应de、que、les、vous、général等常见法语词汇。为排除“模型只是调取已知史料”的可能,丘奇让求解器移除马尔蒙回忆录及拿破仑时代文本后重新运行,结果仍恢复出相同的主要内容。解密结果随后由Cryptiana维护者、研究者Satoshi Tomokiyo检查,该数据库已将这条记录标记为“已解决”,并把此前标注的1807年更正为1809年。
解出的内容是一份战前兵力简报:巴伐利亚军队约4万人部署在慕尼黑与帕绍一带,波兰军队约3万人位于维斯瓦河附近,萨克森军队在德累斯顿附近;达武、马塞纳、乌迪诺等法军将领所率部队的位置与兵力也被逐一列出。信中称俄军正开赴对奥作战,并判断奥地利将从多个方向遭到攻击。结合解出的兵力数字、将领头衔与部队位置,丘奇把这封信的时间重新确定为1809年3月下旬,距离奥军4月发动进攻约两周。此前还有类似案例:开发者卡特·莱芬用同一模型破译了一封1941年的德国陆军Enigma电报,密码研究者弗罗德·韦耶鲁德复核后确认了明文与密钥。
信息来源:快科技
免责声明:本站转载的文章,版权归原作者所有;旨在传递信息,不代表本站的观点和立场。