行业新闻

新研究利用API漏洞提取Claude/GPT隐藏思维链,发现蒸馏证据

这篇论文展示了如何用最便宜的模型破解顶级AI的隐藏推理,并提供蒸馏的首批物证,引发安全与隐私担忧。

研究者利用API漏洞,让低价小模型解码Claude、GPT等旗舰模型的隐藏思维链。他们发现,加密货币式加密块可被同门弱模型读出,成本极低。据此还找到了模型可能蒸馏的物证,并暴露了公开轨迹泄露敏感信息的问题。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg4db3a5311b.jpg) Synced 报道 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg3b253ef414-95.png) AI 蒸馏,实锤了? 2026 年,硅谷最敏感的一桩悬案,就是 AI 蒸馏。 每当一款新模型突然变强,跑分直追 GPT,回答又带着 Claude 的味道,同一个问题就会开始在业内游荡。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg583c48441c.webp) 所有人都在怀疑,却没有人能把证据拍在桌上。 直到今天,一篇长达 116 页的论文突然炸场。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg8f5694b493.webp) ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgdf9d89c9b2-94.png) 扒光 Opus 思考过程 只调用两次 API 来自 MATS Research、ELLIS 图宾根研究所等机构的 8 位研究人员,联手砸穿了巨头们的「黑盒」—— Claude、GPT 和 Gemini 从未公开的「原始推理」,被大规模恢复了出来。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg35979861ea.png) 更离谱的是,撬开顶级 AI 防线的,竟然是「自家最便宜的小模型」。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-08-13原文

相关内容