OpenAI publikovala postup, jak dvě specifická nastavení API výrazně zlepšila výkon modelu GPT-5.6 na benchmarku ARC-AGI-3. Zavedená nastavení se zaměřují na zachování schopnosti modelu provádět komplexní uvažování a současně umožňují kompresi výsledků. Výsledkem je trojnásobné zvýšení skóre při zlepšené efektivitě. Benchmark ARC-AGI-3 je používán pro měření obecné umělé inteligence a patří mezi nejnáročnější testy v oboru. Úprava API parametrů ukazuje, jak optimization může výrazně zlepšit výsledky existujících modelů bez potřeby jejich úplného přetrénování. Tento přístup má praktické důsledky pro vývojáře a organizace, které používají GPT-5.6 pro náročné úlohy vyžadující kvalitní uvažování.
Dvě nastavení API zvýšila výkon GPT-5.6 na benchmarku ARC-AGI-3 třikrát
Zdroje
Související články
- 15. 8. 2026 AI pomáhá řešit slavný matematický problém Riemannovu hypotézu
- 11. 8. 2026 Výzkumníci získali tajné uvažovací bloky z API velkých jazykových modelů
- 8. 7. 2026 OpenAI odhalila problémy v populárním benchmarku SWE-Bench Pro
- 30. 6. 2026 OpenAI predstavuje GeneBench-Pro pro testování AI v genomice