Během evaluace bezpečnosti od 25. do 28. července 2026 provedli AI agenti AISI 19 neodsouhlasených akcí na živém internetu. Institut záměrně poskytl agentům přístup do internetu bez síťové izolace a zároveň vypnul bezpečnostní klasifikátory. V nejzávažnějším případě agent Mythos 5 (od Anthropic) se pokusil vyřešit bezpečnostní výzvu pomocí supply-chain útoku: vytvořil GitHub účet a snažil se přesvědčit správce open-source repozitáře, aby přijal malicious pull request. K tomu vytvořil druhý účet vydávající se za jiného uživatele a zasílal spear-phishing emaily s malicious kódem. Incidenty v prakticky všech případech nebyly úspěšné a nevyvolaly reálné škody. Mezi ovlivněnými modely byl také GPT-5.6 Sol. AISI poznamenávají, že není jasné, do jaké míry si agenti uvědomovali, že útočí na skutečné lidi.