A Amazon anunciou uma arquitetura de referência que permite que diferentes equipes internas compartilhem o mesmo cluster de GPUs, mantendo as cargas de trabalho isoladas e os custos separados. A configuração usa o SageMaker HyperPod no Amazon EKS, namespaces do Kubernetes para isolamento e o HyperPod Task Governance para aplicar cotas justas de recursos. O gerenciamento de identidade é feito pelo AWS IAM Identity Center, que pode ser sincronizado com diretórios corporativos, como o Microsoft Entra ID. As equipes podem acessar o cluster pela interface gráfica do SageMaker Studio ou pela CLI, cada uma restrita ao seu próprio namespace.
Por que importa
As empresas podem executar vários projetos de IA em um único conjunto de GPUs de alto custo sem correr o risco de vazamento de dados ou gastos imprevisíveis.