💬 观点Latent Space
[AINews] How to steal a Reasoning Trace — 前沿模型隐藏推理被破解,隐私风险与蒸馏争议并存。
前沿模型隐藏推理被破解,隐私风险与蒸馏争议并存。
2026-08-12原文
本文为要点摘要,完整细节以原文为准。
- 论文展示可解码并移植加密推理块至其他模型/会话,提升开源模型性能,但扫描约7000条公开痕迹发现62个API密钥等敏感数据泄露。
- 攻击方法:将合法加密推理块重放到同提供商较弱模型,通过预填充和采样诱导转录,绕过50词阈值。
- 讨论分歧:隐私/安全严重问题 vs. 非规模化蒸馏路径,隐藏思维链不可靠,需加强沙箱和遥测。
原文:[AINews] How to steal a Reasoning Trace · 作者 Latent Space