AI资讯industry
研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞
核心亮点
Alexander Panfilov 团队披露:OpenAI、Anthropic、Google 等主流 AI 提供商的 API 存在漏洞,可读取推理模型本应加密隐藏的"思考过程"。团队扫描约 7000 条公开会话,顺带挖出 62 个 API 密钥、33 个邮箱与 33 个密码,暴露面远超模型本身。
具体能力或事件经过
推理模型(如 OpenAI o 系列、Claude Opus)通常把中间推理放在加密字段里,前端只显示最终答案。研究人员发现,通过特定请求构造,这些加密内容可被解密并回传。更惊人的是,借助越狱手段,Anthropic 的 Haiku 4.5 能把 Opus 4.8 的原始推理逐字转写出来。同时,公开会话中泄露的密钥与凭据让风险从"模型透明"上升到"账户安全"。
技术细节
漏洞根源在于 API 层对推理字段的访问控制不足:加密更像是"前端隐藏"而非真正的服务端保密。一旦请求被构造为允许回显内部轨迹,服务端便照发不误。团队测算,解码 10000 条推理轨迹的 API 成本约 720 美元,说明这类攻击在成本上完全可行。扫描方式则是批量抓取公开分享的会话链接与嵌入页面。
与竞品对比
这类问题并非某家独有。凡是采用"先思考后回答"范式的推理模型,只要中间态经 API 暴露,就面临同样隐患。闭源厂商的优势本应是更可控的服务端保密,但本次发现表明,仅靠客户端隐藏远远不够。相比完全不暴露推理的开源方案,商业 API 的攻击面反而更大。
行业影响或适用场景
对开发者,当务之急是轮换已泄露的密钥并收紧会话分享权限;对厂商,需要把推理加密下沉到服务端强制保密。对企业合规,这意味着要把 AI 供应商的 API 安全纳入审计。说白了,当模型"心里话"能被花钱读出来,所谓加密推理更像一层窗户纸。