Oossa

Allen Institute, 예산 기반 GPU 스케줄러 도입

AI 인프라팀은 우선순위 시스템을 예산 기반 공정 할당 스케줄러로 바꿨다. 연구자들은 GPU 사용 시간을 배정받고, 온콜 수리 업무는 74% 줄었다.

짧은 소식작성: Oossa 게시일: 1 분 읽기

Allen Institute for AI(Ai2)가 예산 할당과 계층형 공정 할당을 바탕으로 연구 작업의 실행 순서를 정하는 새로운 GPU 클러스터 스케줄러를 도입했다. 시스템은 각 프로젝트에 GPU 사용 시간의 고정 비율을 배정한다. 예를 들어 Project A1은 전체 용량의 35%를 할당받는다. 예산이 뒷받침되는 작업만 선점으로부터 보호된다. 또한 스케줄러는 최소 실행 시간 계약을 요구하며, 이 시간이 지나면 다른 작업에 자원을 다시 배정할 수 있다. 엔지니어들은 이번 변화로 실제 활용 가능한 컴퓨팅 자원이 30% 늘어난 듯한 효과가 있었고, 수동으로 복구 작업을 하는 일은 74% 줄었다고 말했다.

왜 중요한가

연구자들은 GPU 사용 시간을 예측 가능하게 배정받고, 온콜 담당자들은 장시간 실행되는 작업을 수동으로 종료하는 데 훨씬 적은 시간을 쓰게 된다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.