Amazon heeft een referentiearchitectuur aangekondigd waarmee verschillende interne teams hetzelfde GPU-cluster kunnen delen, terwijl hun workloads gescheiden blijven en de kosten apart worden bijgehouden. De oplossing gebruikt SageMaker HyperPod op Amazon EKS, Kubernetes-namespaces voor isolatie en HyperPod Task Governance om eerlijke resourcequota af te dwingen. Het identiteitsbeheer verloopt via AWS IAM Identity Center, dat kan synchroniseren met bedrijfsdirectory’s zoals Microsoft Entra ID. Teams krijgen toegang tot het cluster via de SageMaker Studio-interface of de CLI, en blijven daarbij beperkt tot hun eigen namespace.
Waarom het ertoe doet
Bedrijven kunnen meerdere AI-projecten uitvoeren op één dure GPU-pool, zonder risico op datalekken of onvoorspelbare kosten.