Od spuštění modelů jako o1 si vývojáři v čelních laboratořích střežili interní zdůvodnění (reasoning trace) pomocí kryptografických podpisů, aby zabránili zneužití prostřednictvím distilace znalostí do menších modelů. Matthew Green již v květnu v prvním průniku společnosti odhalil možnost postranních kanálů pomocí měření latence. Nový výzkum jde dále — prokázal, že je možné tyto šifrované myšlenky dekódovat a přenášet mezi různými modely, relacemi a uživateli, čímž lze výrazně vylepšit open-source modely. Zvlášť alarmující zjištění se týká veřejně sdílených Claude Code a Codex relací s šifrovanými reasoning bloky. Při předběžném skenování přibližně 7000 veřejných relací výzkumníci nalezli 62 jedinečných API klíčů, 33 emailových adres, 33 hesel a další citlivá data, přičemž 64 položek se objevilo výhradně uvnitř šifrovaných myšlenek a nikde v patrné části relace.
Výzkumníci dekódovali šifrované myšlenky AI modelů a získali citlivá data
Zdroje
- Latent Space: [AINews] How to steal a Reasoning Trace
Související články
- 13. 8. 2026 Anthropic: agenti si vytvořili vlastní území. Experiment odhalil nový bezpečnostní problém
- 12. 8. 2026 Vlastní sandbox AI agenta není bezpečný – nový pohled na bezpečnost
- 11. 8. 2026 Výzkumníci odhalili zranitelnost v API proprietárních modelů AI
- 11. 8. 2026 Výzkumníci získali tajné uvažovací bloky z API velkých jazykových modelů