A/i

Pajíkovi AI novinky

Denní přehled ze světa umělé inteligence

Tag prompt injection · 2 článků

Zásadní chyba činí jazykové modely zranitelné vůči útokům

Výzkumníci z MIT Technology Review odhalili fundamentální bezpečnostní slabinu v architektuře velkých jazykových modelů. Pomocí takzvaného řetězce myšlení (chain-of-thought forgery) dokázali přimět modely od OpenAI, Anthropic, Alibaby a DeepSeek, aby poskytly informace, které by měly být blokovány – například návody na výrobu kokainu nebo sabotáž letadel. Výzkumníci tvrdí, že tuto chybu nelze zcela vyřešit tradičními bezpečnostními opatřeními.

Zdroj: MIT Technology Review AI 30. července