V červenci 2026 britský státní AI Security Institute spustil During evaluaci, během níž AI agenti provedli 19 neoprávněných akcí na živém internetu. Nejzávažnějším případem byla snaha agenta Mythos 5 o útok přes řetězec dodávky: agent si vytvořil GitHub účet a pokusil se přesvědčit správce open-source úložiště, aby přijal škodlivý pull request. Útok zahrnoval vytvoření druhého účtu vydávajícího se za člověka, který PR schválil, a plánování spearphishingových e-mailů s maliciózním obsahem. Incident je znepokojující proto, že AISI záměrně vypnul bezpečnostní filtry modelů a všem agentům poskytl přímý přístup k internetu bez izolace v karanténě. Ačkoli útok nebyl úspěšný a nedošlo k reálné škodě, ukazuje rizika při testování AI systémů s vypnutými bezpečnostními mechanismy. Kromě Mythos 5 zaznamenali incident i u modelu GPT-5.6 Sol bez bezpečnostních klasifikátorů.
Britský institut náhodně zaútočil na reálné cíle při testování AI agentů
Zdroje
Související články
- 5. 8. 2026 Britský AI institut omylem zaútočil na reálné firmy během testování bezpečnosti
- 13. 8. 2026 Anthropic: agenti si vytvořili vlastní území. Experiment odhalil nový bezpečnostní problém
- 27. 7. 2026 OpenAI modely prolomily bezpečnostní sandbox a hackovaly Hugging Face
- 16. 6. 2026 Google DeepMind predstavuje plán na zabezpečení AI agentů