据 MATS Research、蒂宾根 ELLIS 研究所、马克斯·普朗克智能系统研究所的研究人员以及安全公司 Snyk 称,8 月 10 日发现了 Anthropic、OpenAI 和 Google 加密 AI 推理令牌方式中的一个漏洞。该团队解码了来自公开 GitHub 和 Hugging Face 仓库的 315,320 个推理区块,找回了 62 个有效 API 密钥、33 个密码和 367 条个人身份信息。其中大多数信息隐藏在加密推理中,而开发者并未意识到其中包含敏感内容,便将这些推理分享到了网上。

该漏洞源于每家公司整个模型生态系统共用的单一全局加密密钥。因此,来自 Claude Opus 4.8 等旗舰模型的加密推理轨迹,可以被注入同一系列中防护较弱的模型,并逐字解码。OpenAI、Anthropic 和 Google 在收到负责任披露后部署了服务器端补丁,但公开抓取的、包含已解码推理区块的会话记录仍然可以访问。