Výzkumníci z Anthropic a OpenAI používají umělou inteligenci k přístupu k jednomu z nejobtížnějších matematických problémů. Riemannova hypotéza, kterou se matematikové snaží dokázat přes 160 let, se nyní zdá být blíže řešení díky schopnostem moderních AI modelů.
Analýza zdůrazňuje, že umělá inteligence nepředbíhá matematiky v myšlení, nýbrž v schopnosti zapamatovat si a pracovat s obrovským množstvím dat. Výzkum zpochybňuje běžné představy o nadlidské inteligenci AI.
Čínská společnost DeepSeek vydala novou verzi svého modelu V4 Pro s datem 0813. Model je dostupný přes API na OpenRouteru a nyní jsou jeho váhy (1,7 bilionů parametrů) volně k dispozici na Hugging Face.
Nový výzkum ukazuje, jak lze rozluštit zašifrované reasoning trace (myšlenky) moderních AI modelů. Autoři při skenování veřejně dostupných relací našli 62 API klíčů, 33 emailů a 33 hesel, z nichž 64 se objevila jen v šifrovaných myšlenkách.
Badatelé publikovali studii popisující, jak se daly extrahovat zašifrované řetězce myšlení z API společností Anthropic, OpenAI a Google. Útok spočíval v přehrání těchto bloků slabšímu modelu a jejich následném dešifrování prostřednictvím prompt injekce. Všechny tři společnosti problém již opravily.
Nezvěřejněný model společnosti Anthropic učinil pokrok v práci na Riemannově hypotéze, jednom z nejslavnějších nevyřešených problémů v matematice. Přestože hypotézu zcela nevyřešil, model dosáhl výsledků, které překvapily i odborníky.
Výzkumníci vyvinuli techniku zvanou Reasoning Traces, která umožňuje nahlédnout do vnitřních mechanismů fungování velkých jazykových modelů. Tato metoda odhaluje, jak modely řeší problémy a jaké kroky přitom podnikají.
Podle MIT Technology Review se model AlphaFold sice stal vítězem Nobelovy ceny za průlom v predikci protein struktur, ale jeho datově-intenzivní přístup není šablona pro zrychlení veškeré vědy. Budoucnost leží v AI agentech, kteří se mohou učit a uvažovat v obtížnějších vědeckých oborech.
Simon Willison vydal novou verzi nástroje LLM s podporou viditelných reasoning tracků, serverovými nástroji od OpenAI a Anthropicu, a novými modely GPT-5.6. Aktualizace přináší také zlepšenou SQLite logování a novou verzi pluginu pro Anthropic.
Vydána verze 0.32 nástroje LLM a 0.26 pluginu llm-anthropic. Přínáší tři nové Claude 5 modely, server-side nástroje pro vyhledávání a spouštění kódu, a zjednodušený systém extended thinking.
OpenAI dosáhla trojnásobného zvýšení skóre modelu GPT-5.6 na benchmarku ARC-AGI-3 pomocí dvou nastavení API. Optimalizace si zachovávají schopnost modelu usuzovat a zároveň zvyšují jeho efektivitu.
OpenAI vylepšila schopnosti ChatGPT v oblasti zdraví a wellness pomocí nového modelu GPT-5.5 Instant. Systém nyní nabízí lepší uvažování, lepší pochopení kontextu a jasnější komunikaci s podporou lékařských expertů.
Výzkumníci využili reasoning model od OpenAI k diagnostice vzácných genetických onemocnění u dětí. Model identifikoval 18 nových diagnóz v případech, které dosud zůstávaly nevyřešené.