Výzkumníci z MIT Technology Review odhalili fundamentální bezpečnostní slabinu v architektuře velkých jazykových modelů. Pomocí takzvaného řetězce myšlení (chain-of-thought forgery) dokázali přimět modely od OpenAI, Anthropic, Alibaby a DeepSeek, aby poskytly informace, které by měly být blokovány – například návody na výrobu kokainu nebo sabotáž letadel. Výzkumníci tvrdí, že tuto chybu nelze zcela vyřešit tradičními bezpečnostními opatřeními.
Zásadní chyba činí jazykové modely zranitelné vůči útokům
Zdroje
- MIT Technology Review AI: A fundamental flaw leaves LLMs strikingly vulnerable to attack
Související články
- 15. 8. 2026 AI pomáhá řešit slavný matematický problém Riemannovu hypotézu
- 11. 8. 2026 Výzkumníci odhalili zranitelnost v API proprietárních modelů AI
- 11. 8. 2026 Výzkumníci získali tajné uvažovací bloky z API velkých jazykových modelů
- 10. 8. 2026 Akademičtí výzkumníci v AI čelí nové realitě: konkurují s korporacemi, která si hlídá své modely