# Allen Institute, 예산 기반 GPU 스케줄러 도입

> AI 인프라팀은 우선순위 시스템을 예산 기반 공정 할당 스케줄러로 바꿨다. 연구자들은 GPU 사용 시간을 배정받고, 온콜 수리 업무는 74% 줄었다.

Oossa · 2026-10-09 · https://oossa.com/ko/allen-institute-rolls-out-budget-driven-gpu-scheduler

Allen Institute for AI(Ai2)가 예산 할당과 계층형 공정 할당을 바탕으로 연구 작업의 실행 순서를 정하는 새로운 GPU 클러스터 스케줄러를 도입했다. 시스템은 각 프로젝트에 GPU 사용 시간의 고정 비율을 배정한다. 예를 들어 Project A1은 전체 용량의 35%를 할당받는다. 예산이 뒷받침되는 작업만 선점으로부터 보호된다. 또한 스케줄러는 최소 실행 시간 계약을 요구하며, 이 시간이 지나면 다른 작업에 자원을 다시 배정할 수 있다. 엔지니어들은 이번 변화로 실제 활용 가능한 컴퓨팅 자원이 30% 늘어난 듯한 효과가 있었고, 수동으로 복구 작업을 하는 일은 74% 줄었다고 말했다.

## 팩트

- 블로그 게시물은 2026-10-09에 게시됐다.
- Ai2는 GPU 88~1024개 규모의 클러스터를 운영하며, 내부 연구자 약 150명에게 서비스를 제공한다.

## 왜 중요한가

연구자들은 GPU 사용 시간을 예측 가능하게 배정받고, 온콜 담당자들은 장시간 실행되는 작업을 수동으로 종료하는 데 훨씬 적은 시간을 쓰게 된다.

## 출처 및 참고 자료

1. [Impactful scheduling for GPU clusters](https://huggingface.co/blog/allenai/impactful-scheduling) – Hugging Face, 2026-10-09
2. [Impactful scheduling for GPU clusters](https://allenai.org/blog/impactful-scheduling) – Ai2

최종 업데이트: 2026-10-09
