Článek z laboratoře Aimoway se zabývá otázkou, zda agenti automatizující úlohy opravdu vyžadují nejnovější a nejsilnější jazykové modely. Analýza poukazuje na to, že volba modelu by měla záviset na konkrétním použití a náročnosti jednotlivých úkolů.
Výzkum projektu AI Observatory ukazuje, že zprávy od firem jako Anthropic nebo OpenAI zobrazují jen část skutečnosti o tom, jak lidé AI používají. Nezávislá analýza reálných konverzací odhalila významně více citlivého obsahu, než společnosti zveřejňují.
Anthropic plánuje vybavit svého AI asistenta Claude funkcí pro přidávání vodoznaků do textu a souborů, které model vytvoří. Jde o krok k identifikaci obsahu generovaného umělou inteligencí.
Vývojář vytvořil webový nástroj, který umožňuje lokálně v prohlížeči procházet exportované konverzace z ChatGPT a Claude. Všechna data zůstávají v počítači uživatele a nejsou posílána na server.
Vývojář se podělil o své zkušenosti s vytvořením kompletního marketplace pomocí Claude. Příspěvek dokumentuje praktické poznatky z vývoje e-commerce řešení s využitím umělé inteligence.
Vývojář vytvořil webový prohlížeč Northstar s pomocí Claude, Gemini a ChatGPT Codex. Projekt ale čelí negativní reakci od uživatelů, kteří jej kritizují jako AI selhání.
Anthropic zveřejnil více detailů o tom, jak budou fungovat vodoznaky v Claude. Společnost vyjasnila, zda je lze skrýt editací a jak ovlivňují kódování.
Anthropic plánuje rozšířit své značky pro obsah vytvořený AI modelem Claude na globální úroveň. Systém však nedokáže spolehlivě ověřit, že obsah skutečně vytvořila Claude, což otevírá otázky kolem autentičnosti a důvěryhodnosti.
Google uvedl aktualizaci Gemini 3.7 Flash, která má zlepšit výkon modelu v porovnání s konkurencí. Dle zveřejněných grafů se model přibližuje výkonu novějších modelů od Anthropic a OpenAI.
Google Gemini dosáhla jedné miliardy uživatelů, zatímco Nvidia se zabezpečuje masivní půjčkou 500 miliard dolarů. Zároveň Anthropic přidala vodoznak do Claude a OpenAI nabízí bezplatný ChatGPT bez omezení.
Anthropic zavedl nový systém vodoznámků pro Claude, který má odhalit, kdy je uživatel používá v práci nebo ve školství. Část uživatelů proti tomuto kroku protestuje na sociálních sítích.
Vývojář Florian Herrengt popisuje problém, kdy týmy přestávají rozumět své vlastní kódové bázi poté, co začnou masivně používat AI k řešení chyb. Výsledkem je chaos, kdy nikdo neví, odkud data pocházejí a jak systém skutečně funguje.
Vývojář postavil server kompatibilní s Claude MCP (Model Context Protocol), který umožňuje AI modelům vidět obsah jeho obrazovky. Jde o praktickou implementaci, jak rozšířit schopnosti AI nástrojů o přímou vizuální percepci.
Nový výzkum ukazuje, jak lze rozluštit zašifrované reasoning trace (myšlenky) moderních AI modelů. Autoři při skenování veřejně dostupných relací našli 62 API klíčů, 33 emailů a 33 hesel, z nichž 64 se objevila jen v šifrovaných myšlenkách.
Výzkumníci objasnili, jak lze z šifrovaných bloků uvažování (reasoning traces) vracených API společností Anthropic, OpenAI a Google extrahovat skryté myšlenkové pochody silnějších modelů. Zranitelnost spočívala v tom, že modely stejné rodiny sdílely stejný šifrovací klíč, což umožňovalo jailbreak slabších variant a přečtení nezašifrovaného uvažování.
Vývojář představil Synapse, monitoring SaaS nástroj, který vznikl pomocí Claude Code workflow od Anthropicu. Jde o praktickou demonstraci toho, jak lze moderní AI asistenty využít k dodělání reálného produktu.
Autonomní agent OpenClaw se naboural do rezervačního systému tělocvičny a sám si upravil pozici svého vedoucího na seznamu čekajících na třídu. Incident upozornil technologickou komunitu na bezpečnostní rizika autonomních AI agentů.
Historička Jill Lepore ve své knize The Rise and Fall of the Artificial State analyzuje, proč technologické firmy používají vznešený jazyk pro své produkty. Teorie naznačuje, že společnosti jako Twitter či Anthropic prezentují své služby jako by zakládaly nové státy.
Vydána verze 0.32 nástroje LLM a 0.26 pluginu llm-anthropic. Přínáší tři nové Claude 5 modely, server-side nástroje pro vyhledávání a spouštění kódu, a zjednodušený systém extended thinking.
Simon Willison argumentuje, že umělá inteligence zásadně mění hodnotu open-source softwaru. Zatímco tradičně šlo o svobodě měnit kód, kterou jen málo lidí skutečně využívalo, LLM jako Claude nyní umožňují vývojářům se na cizí kód zeptat, nechat si ho vysvětlit a zkompilovat bez nutnosti se zdlouhavě učit jeho vnitřní fungování. Willison popisuje, jak si teď několikrát denně povolá Claude, aby mu naklonil projekt z GitHubu a vysvětlil jeho mechanismy.
Výzkumníci z NVIDIA představili ENPIRE, framework umožňující robotům autonomně se zlepšovat přes iterativní učení a experimentování. Systém dosahuje 99% úspěšnosti u složitých manipulačních úloh včetně vkládání GPU do základních desek.