Výzkumníci z MIT Technology Review odhalili fundamentální bezpečnostní slabinu v architektuře velkých jazykových modelů. Pomocí takzvaného řetězce myšlení (chain-of-thought forgery) dokázali přimět modely od OpenAI, Anthropic, Alibaby a DeepSeek, aby poskytly informace, které by měly být blokovány – například návody na výrobu kokainu nebo sabotáž letadel. Výzkumníci tvrdí, že tuto chybu nelze zcela vyřešit tradičními bezpečnostními opatřeními.
Zásadní chyba činí jazykové modely zranitelné vůči útokům
Zdroje
- MIT Technology Review AI: A fundamental flaw leaves LLMs strikingly vulnerable to attack
Související články
- 18. 8. 2026 Jak se skutečně používá AI? Výzkum odhaluje, co si firmy nechávají pro sebe
- 15. 8. 2026 AI pomáhá řešit slavný matematický problém Riemannovu hypotézu
- 11. 8. 2026 Výzkumníci odhalili zranitelnost v API proprietárních modelů AI
- 11. 8. 2026 Výzkumníci získali tajné uvažovací bloky z API velkých jazykových modelů