Čínská společnost DeepSeek vydala novou verzi svého modelu V4 Pro s datem 0813. Model je dostupný přes API na OpenRouteru a nyní jsou jeho váhy (1,7 bilionů parametrů) volně k dispozici na Hugging Face.
Čínská společnost DeepSeek přinesla nové přístupy v oblasti umělé inteligence, které upoutaly pozornost globální AI komunity. Jejich inovace mění pohled na vývoj a efektivitu velkých jazykových modelů.
DeepSeek spustil veřejnou beta verzi V4-Flash API s výrazným zlepšením agenčních schopností, které nyní překonávají V4-Pro-Preview. Model dosáhl skóre 82,7 v Terminal-Bench, což je nárůst o 25,8 bodů oproti dubnovému návrhu, ačkoli se velikost ani architektura nezměnila.
Výzkumníci z MIT Technology Review odhalili fundamentální bezpečnostní slabinu v architektuře velkých jazykových modelů. Pomocí takzvaného řetězce myšlení (chain-of-thought forgery) dokázali přimět modely od OpenAI, Anthropic, Alibaby a DeepSeek, aby poskytly informace, které by měly být blokovány – například návody na výrobu kokainu nebo sabotáž letadel. Výzkumníci tvrdí, že tuto chybu nelze zcela vyřešit tradičními bezpečnostními opatřeními.
Startup Poolside vydal nový model Laguna S 2.1, který překonává výkonem lepší variantu Deepseek V4 Pro při nižší ceně. Model je zároveň desetkrát menší než konkurenční řešení a nabízí lepší efektivitu než čínské modely.