OpenAI zveřejnila sdílený metodický rámec pro prováděné nezávislých evaluací frontierních AI systémů. Dokument nabízí komprehenzivní náhled na to, jak by měly být posuzovány schopnosti modelů, jejich bezpečnostní mechanismy a celková validita. Příručka vychází z praktických zkušeností OpenAI a je určena pro evaluátory, výzkumné instituce a další třetí strany, které chcete ověřit bezpečnost a funkčnost pokročilých AI systémů. Iniciatíva zapadá do širšího trendu zvýšené transparentnosti a externí kontroly v oblasti vývoje a nasazení generativních modelů.