Allen Institute for AI (Ai2) har infört en ny schemaläggare för GPU-kluster som använder budgetanslag och hierarkisk rättvis resursfördelning för att avgöra vilka forskningsjobb som körs. Varje projekt får en fast andel av GPU-timmarna – till exempel får Project A1 35 % av den totala kapaciteten – och endast jobb som har en budget skyddas från att avbrytas till förmån för andra jobb. Schemaläggaren kräver också ett avtal om minsta körtid, vilket gör att resurserna kan tas i anspråk för andra jobb när den tiden har gått. Ingenjörerna uppger att förändringen känns som en 30-procentig ökning av den användbara beräkningskapaciteten och att det manuella reparationsarbetet minskat med 74 %.
Varför det spelar roll
Forskare får nu en förutsägbar andel av GPU-tiden, och jourpersonalen behöver lägga betydligt mindre tid på att manuellt stoppa långvariga jobb.