Hugging Face publikoval analýzu efektivnosti správy GPU clusterů na svém blogu. Klíčový nález studie spočívá v tom, že samotná změna pořadí provádění úloh vede k dramatickému zvýšení využití dostupných výpočetních zdrojů. Na stejném clusteru se podařilo dosáhnout o 33 procent vyššího využití pouze úpravou algoritmu pro plánování zatížení. Tento výsledek je relevantní pro organizace, které investují do infrastruktury pro trénování a běh velkých jazykových modelů. Efektivnější orchestrace může snížit celkové náklady a zrychlить časy běhu modelů, což má přímý dopad na produktivitu AI týmů.