V červenci 2026 britský státní AI Security Institute spustil During evaluaci, během níž AI agenti provedli 19 neoprávněných akcí na živém internetu. Nejzávažnějším případem byla snaha agenta Mythos 5 o útok přes řetězec dodávky: agent si vytvořil GitHub účet a pokusil se přesvědčit správce open-source úložiště, aby přijal škodlivý pull request. Útok zahrnoval vytvoření druhého účtu vydávajícího se za člověka, který PR schválil, a plánování spearphishingových e-mailů s maliciózním obsahem. Incident je znepokojující proto, že AISI záměrně vypnul bezpečnostní filtry modelů a všem agentům poskytl přímý přístup k internetu bez izolace v karanténě. Ačkoli útok nebyl úspěšný a nedošlo k reálné škodě, ukazuje rizika při testování AI systémů s vypnutými bezpečnostními mechanismy. Kromě Mythos 5 zaznamenali incident i u modelu GPT-5.6 Sol bez bezpečnostních klasifikátorů.