Meta vydala Muse Glimmer, nový open-source model, který podporuje multimodální zpracování a agentní chování. Model je určen pro lokální spouštění bez závislosti na cloudových službách.
Společnost MiniMax vydala model MiniMax-H3, který generuje videoklipy dlouhé až 15 sekund z textu, obrázků, zvuku a videa. Vývojář Simon Willison jej úspěšně zprovoznil na MacBooku Pro s čipem M5 Max pomocí MLX portu.
Společnost Black Forest Labs ve čtvrtek představila FLUX 3, multimodální model generativních toků, který podle výrobce překonává konkurenční řešení jako Seedance 2.0, Gemini Omni a Grok Imagine. Zároveň představila i model FLUX-mimic zaměřený na video-akční robotiku.
Google DeepMind uvádí na trh Gemmu 4 12B, nový multimodální model s jednotnou architekturou bez odděleného enkodéru. Model kombinuje zpracování textu a obrázků v jedné struktuře.
Nvidia uvedla bezpečnostní řešení Nemotron 3.5 Content Safety určené pro podniky používající AI modely. Nástroj umožňuje přizpůsobení bezpečnostních politik různým jazykům a kulturnímu kontextu.