Badatelé publikovali studii popisující, jak se daly extrahovat zašifrované řetězce myšlení z API společností Anthropic, OpenAI a Google. Útok spočíval v přehrání těchto bloků slabšímu modelu a jejich následném dešifrování prostřednictvím prompt injekce. Všechny tři společnosti problém již opravily.
Organizace Epoch a METR vydaly benchmark MirrorCode, který testuje, jak dobře umělá inteligence zvládá složité programovací úkoly trvající řadu týdnů. Claude Opus 4.7 a GPT-5.5 úspěšně znovuvytvořily existující programy o desítkách tisíc řádků kódu, přestože některé úkoly zůstaly stále příliš obtížné.
OpenAI zahájila program Bug Bounty zaměřený na biobezpečnostní hrozby v modelu GPT-5.5. Cílem je identifikovat a zmapovat potenciální rizika před jejich zneužitím.
Systém Fable vytvořil nejrychlejší megakernel na benchmarku KernelBench-Mega s 18,71x zrychlením oproti PyTorchu. Výsledky ukazují, že AI systémy se stále lépe naučují vytvářet součásti potřebné pro vývoj samotné AI.
Výzkumníci z NVIDIA představili ENPIRE, framework umožňující robotům autonomně se zlepšovat přes iterativní učení a experimentování. Systém dosahuje 99% úspěšnosti u složitých manipulačních úloh včetně vkládání GPU do základních desek.
Inženýři ze společnosti Nextdoor si osvojili techniku s Codexem a GPT-5.5 k ladění těžko reprodukovatelných chyb a vývoji aplikací na více platformách. Přístup jim umožňuje soustředit se na produktové výsledky místo manuálního programování.
Společnost Wasmer použila model Codex s GPT-5.5 k vývoji Node.js runtime pro edge computing. Pomocí AI nástrojů urychlila vývoj desetinásobně až dvacetkrát a projekt se podařilo dokončit v řádu týdnů místo měsíců.
OpenAI představila, jak firma Braintrust využívá model Codex spolu s GPT-5.5 k transformaci požadavků zákazníků přímo na funkční kód. Inženýři tak mohou spouštět experimenty a psát kód výrazně rychleji.
Warp integruje model GPT-5.5 od OpenAI do svého vývojářského prostředí. Platforma tak koordinuje kódovací agenty napříč lokálními, cloudovými a open-source pracovními toky.
Ramp využívá Codex od OpenAI s modelem GPT-5.5 k automatizaci recenzí kódu. Výsledkem je výrazné zrychlení zpětné vazby z hodin na minuty.
Databricks integroval model GPT-5.5 do svých enterprise agentních workflow. Model dosáhl nového vrcholu výkonnosti na benchmark OfficeQA Pro.