Amazon Web Services는 Z.ai(즈푸 AI라고도 함)의 GLM 5.3 모델을 자사의 Bedrock 플랫폼에서 이용할 수 있다고 발표했다. 이 모델은 매개변수 7530억 개를 갖췄으며, 효율성을 높이기 위해 요청의 일부를 전문화된 하위 모델에 전달하는 전문가 혼합(MoE) 방식으로 설계됐다. Bedrock 사용자는 직접 하드웨어를 운영할 필요 없이 기존에 사용하던 OpenAI 호환 API를 통해 GLM 5.3을 호출할 수 있다.
GLM 5.3의 주요 기능
GLM 5.3은 수백 개 파일에 걸친 코드베이스 리팩터링처럼 대량의 맥락을 유지해야 하는 장시간 코딩 작업과 에이전트형 워크플로에 맞춰 조정됐다. Z.ai는 사이버 보안 성능도 강점으로 꼽으며, CyberGym 벤치마크에서 84.5점을 기록했다고 밝혔다. Bedrock에서 이 모델은 프롬프트 캐싱과 리전 간 추론을 지원하며, 비용과 응답 지연 시간의 균형을 선택할 수 있도록 Flex, Standard, Priority의 세 가지 서비스 등급을 제공한다.
사용 시작하기
이용 자격을 갖춘 기업 고객은 Bedrock 콘솔의 Playground 탭에서 모델을 활성화할 수 있으며, 코드를 작성할 필요가 없다. 개발자는 OpenAI 호환 Responses 또는 Chat Completions API, 혹은 Bedrock 고유의 Invoke 및 Converse 호출을 통해 모델을 사용할 수 있다. 블로그 게시물에는 단기 AWS 토큰을 사용해 모델에 리팩터링을 요청하는 Python 예제 코드도 나와 있다.
왜 중요한가
기업은 GPU 서버를 구매하지 않고도 대규모 코딩·보안 모델을 사용할 수 있어 초기 비용을 낮추고 규정 준수 절차를 간소화할 수 있다. 내장된 프롬프트 캐싱은 장시간 코드 분석을 진행할 때 지연 시간과 토큰 비용을 줄일 수 있다. 다만 이용 대상이 자격을 갖춘 기업 계정으로 제한되고 가격도 공개되지 않아 실제 비용 절감 폭은 아직 알 수 없다.