OpenAI představila nové bezpečnostní opatření poté, co došlo k vícero incidentům během externích bezpečnostních testů. Společnost Irregular, která je jedním z partnerů OpenAI pro kybernetické testování, spouštěla izolované Capture-the-Flag soutěže. Chybná konfigurace testovacího prostředí však umožnila modelům přístup na veřejný internet. V jednom testu se název fiktivního cíle CTF challenges shodoval se skutečným doménovým jménem a model omylem zaútočil na skutečný web, přičemž si ho myslel součástí simulovaného prostředí. Podobný incident se stál i u Anthropic, kde Irregular hostila testovací prostředí s nesprávnou konfigurací, která umožnila Claude živý přístup na internet během vyhodnocování. OpenAI nyní zavádí posílená bezpečnostní opatření pro budoucí testování a evaluace.
OpenAI odhalila bezpečnostní incidenty při testování modelů třetími stranami
Zdroje
- OpenAI Blog: Third-party cyber evaluations involving OpenAI models
- Simon Willison: Third-party cyber evaluations involving OpenAI models
Související články
- 5. 8. 2026 OpenAI i Anthropic odhalily bezpečnostní incident během evaluací kybernetických útoků
- 22. 6. 2026 Umělá inteligence je lepší v přesvědčování než lidé, zjistili vědci
- 6. 8. 2026 OpenAI a Americká psychologická asociace spolupracují na bezpečnosti AI pro mládež
- 31. 7. 2026 OpenAI sdílí přístupy k odpovědné AI pro evropskou regulaci