OpenAI zveřejnila nový systém GPT-Red, který kombinuje automatizované red teaming s principem self-play. Cílem je zvýšit bezpečnost a zarovnání (alignment) AI modelů, zejména jejich odolnost proti prompt injection útokům. Systém funguje na principu, kdy se modely střídají v rolích — jeden hraje útočníka hledajícího zranitelnosti, druhý se brání a učí se odolávat. Tento iterativní proces umožňuje kontinuální zlepšování robustnosti bez nutnosti ručního zásahu bezpečnostních specialistů. Automatizace red teamingu představuje významný posun v testování AI bezpečnosti, protože tradičně byly tyto procesy časově náročné a omezené lidskými kapacitami.