偷取大模型的“内心独白”:加密推理轨迹如何被破解与防御 研究发现主流大模型返回的加密推理块存在跨模型重用密钥漏洞,可通过弱模型越狱还原强模型原始思维链,揭示推理轨迹安全与提示注入新风险。 Simon Willison ·