Stealing Reasoning Traces from Proprietary LLM APIs
Research reveals that major LLMs reuse encryption keys for reasoning blocks across models, allowing attackers to recover hidden reasoning via weaker model jailbreaks and exposing new prompt injection risks.
Simon Willison ·