Redeneersporen te stelen uit gesloten LLM API's#
Een paper van Panfilov e.a. toont aan dat versleutelde chain-of-thought van LLM's overdraagbaar is tussen sessies, gebruikers én modellen binnen dezelfde provider. Een aanvaller kan zo verboden informatie extraheren die het model in z'n eindantwoord netjes weigerde — de onderzoekers demonstreerden dit door instructies voor autodiefstal uit de reasoning trace te halen terwijl het model "I cannot fulfill this request" antwoordde. Providers hebben inmiddels mitigaties doorgevoerd.