桃子桃子快讯
返回首页
研究论文

论文称多家大模型加密推理痕迹可被完整还原

Reddit 用户分享 arxiv 论文,声称多家厂商的加密推理内容可被 100% 还原。

2026.08.11 · 周二2 分钟阅读

一项关于大模型「加密推理」痕迹可被还原的研究论文近日在 Reddit r/LocalLLaMA 社区被分享。该论文标题为「Encrypted reasoning from ClosedAI et al 100% recoverable」,由用户 /u/Dany0 发布,其中「ClosedAI」是社区中对 OpenAI 的常见戏称。

研究主题

根据分享者的描述,论文声称多家大模型厂商(包括被戏称为「ClosedAI」的 OpenAI 及其他厂商)的「加密推理」(encrypted reasoning)痕迹可以被 100% 还原。所谓加密推理,是指近年来 o1、o3、Claude 等推理模型在输出最终答案前,对内部思维链(chain-of-thought)进行加密或隐藏处理的安全机制,旨在防止用户直接窥探模型的推理过程。

涉及的模型

原帖在评论中提到了「Opus 5」,按照 Anthropic 的产品命名习惯,这应指 Claude Opus 系列的后续版本。结合标题中「et al」的表述,该论文的研究范围可能同时覆盖 OpenAI 与 Anthropic 等主流推理模型厂商。

论文链接与社区反响

论文链接指向 arxiv(编号 2608.09867)。分享者表示链接中包含「有趣的示例」,并以调侃口吻写道:这是「在厂商修复此漏洞之前,从 Hugging Face 上抓取 1000 万行 Opus 5 推理轨迹的邀请」。该帖目前已引发 r/LocalLLaMA 社区一定讨论。

信息局限

需指出的是,该 Reddit 帖子本身信息量极为有限,仅包含论文标题、arxiv 链接和一句评论,并未透露:

  • 具体的技术还原方法与攻击路径
  • 涉及的模型版本与厂商完整名单
  • 实验数据、成功率统计或评估基准
  • 论文作者团队与所属机构

因此,论文的具体技术细节、实验结果与适用范围均无法从该帖子中直接确认,读者如需进一步了解,需自行查阅原论文以核实相关结论。

信源