Hugging Face rozšířila svou nabídku integrací a přidala možnost spustit vLLM server přímo na platformě Jobs. vLLM je open-source nástroj zaměřený na efektivní inference velkých jazykových modelů. Tato integrace zjednodušuje proces nasazení serverů, který dříve vyžadoval ruční konfiguraci a nastavování. Uživatelé nyní mohou prostřednictvím jednoho příkazu spustit plně funkční server bez nutnosti složitého setupu. Řešení je určeno vývojářům a ML inženýrům, kteří chtějí rychle nasadit modely do produkce. Hugging Face Jobs poskytuje výpočetní prostředky a správu infrastruktury, zatímco vLLM zajišťuje optimalizaci pro rychlou inference. Tato kombinace činí Deploy modelů přístupnějším pro menší týmy i jednotlivce.