A/i

Pajíkovi AI novinky

Denní přehled ze světa umělé inteligence

Tag GPT-5.5 · 11 článků

Výzkumníci získali tajné uvažovací bloky z API velkých jazykových modelů

Badatelé publikovali studii popisující, jak se daly extrahovat zašifrované řetězce myšlení z API společností Anthropic, OpenAI a Google. Útok spočíval v přehrání těchto bloků slabšímu modelu a jejich následném dešifrování prostřednictvím prompt injekce. Všechny tři společnosti problém již opravily.

Zdroj: Simon Willison 11. srpna

AI systémy zvládly týdenní programovací úkoly. Nový benchmark MirrorCode měří jejich schopnosti

Organizace Epoch a METR vydaly benchmark MirrorCode, který testuje, jak dobře umělá inteligence zvládá složité programovací úkoly trvající řadu týdnů. Claude Opus 4.7 a GPT-5.5 úspěšně znovuvytvořily existující programy o desítkách tisíc řádků kódu, přestože některé úkoly zůstaly stále příliš obtížné.

Zdroj: Import AI (Jack Clark) 27. července