Google DeepMind představil Gemmu 4 12B, multimodální model navržený jako jednotný systém bez tradičního enkodéru. Model může zpracovávat jak textové, tak obrazové vstupy v rámci jedné jednotné architektury. Tento přístup se liší od klasických multimodálních řešení, která oddělují zpracování jednotlivých typů dat. Gemma 4 12B se řadí do portfolia modelů Gemma, která Google DeepMind vyvíjí pro efektivní inference. Model je určen vývojářům a výzkumným institucím, kteří pracují s multimodálními úkoly. Zjednodušená architektura bez enkodéru může přispět k nižší latenci a efektivnějšímu využití výpočetních prostředků.
Google DeepMind představil Gemmu 4 12B: multimodální model bez enkodéru
Zdroje
- Google DeepMind: Introducing Gemma 4 12B: a unified, encoder-free multimodal model
Související články
- 10. 8. 2026 Meta představila Muse Glimmer: lokální, agentní a open-source model
- 13. 8. 2026 Writer představil nový AI model s nižšími náklady na tokeny
- 11. 8. 2026 Meta vydala otevřené váhy modelu Muse Glimmer, Zuckerberg představil vizi osobní superinteligence
- 4. 8. 2026 LFM2.5-2.6B: Lokální agenti pro všude bez cloudu