
一条自2005年起一直没人解开的二战密文,被AI用两天恢复了明文。更反常的是,它没有停在“给答案”,而是自己查档案、找上下文、写密码机模拟器,最后还做了一个解释过程的网页。可同一份日志又提到一份“私人收藏”,连验证者也无法确认,AI究竟有没有看过它。
开发者卡特·莱芬要求OpenAI的Astra从恩尼格玛数据库中找一条未破解消息并解码。TechCrunch 9月25日报道,Astra自行查档案、建立模拟器并还原明文。退休工程师弗罗德·魏耶鲁德随后验证;他说,Astra两天完成的工作,人类可能要做数周甚至数月。
另一条密文由网络安全高管杰克·威利斯用Claude Opus 5破解,也经魏耶鲁德验证。但两次任务的人类提示不同,不能当成同条件比赛。公开记录中仍有7条未破解,说明结果真实,也不能包装成“AI攻克所有二战密码”。
过去看AI,多问它能否答题、写代码。这次它更像一个会自己找工具的研究者:缺资料就继续查,缺程序就自己搭,最后解释过程。Agent进入这种长任务后,变化不只是“回答更聪明”,而是能跑完一段原本反复查证的流程。
争议藏在来源里。Astra日志提到一份不由魏耶鲁德托管的“私人收藏”,后者推测可能来自其他研究者或德国公开档案,但无法确认模型是否真的看过。答案经专家验证,资料路径却未必能完整复现。研究结论若说不清证据来自哪里,后来者只能相信另一个结论。
普通人为什么关心?越来越多人让AI找资料、写报告、解释合同。它能省查档时间,但来源断了一截,用户很难判断它查到了原文,还是把相似材料拼成了“看起来对”的答案。答案正确与过程可复核,不是一回事。
我的判断:这算AI研究协作能力的真实进展,但应记作“人设定目标、AI执行调查、专家验证”,不是AI独立发现。两条结果都经专业人士验证,两次也都有人的参与,且一处资料来源仍不明。平台若想让人信任,应保留可检查的检索记录、文件来源和无法确认的缺口。
如果AI两天给出研究结论,却说不清看了哪些材料,你敢直接把它写进报告吗?#AI智能体 #人工智能 #科技热点
声明:本文由AI辅助生成,已完成人工核验与编辑。















