Amazon Web Services объявила, что модель GLM 5.3 от Z.ai (также известной как Zhipu AI) теперь доступна на платформе Bedrock. В ней 753 миллиарда параметров, и она построена по архитектуре «смесь экспертов»: система может направлять части запроса специализированным подмоделям, повышая эффективность. Пользователи Bedrock могут обращаться к GLM 5.3 через те же API, совместимые с OpenAI, что и раньше, — запускать собственное оборудование не нужно.
Что умеет GLM 5.3?
GLM 5.3 оптимизирована для длительных задач программирования и агентных рабочих процессов, которым требуется сохранять большой объём контекста. Например, модель может рефакторить кодовую базу из сотен файлов. Z.ai также отмечает высокие результаты в области кибербезопасности: модель набрала 84.5 балла в тесте CyberGym. На Bedrock доступны кэширование промптов, межрегиональный инференс и три уровня обслуживания (Flex, Standard, Priority), позволяющие выбирать между стоимостью и задержкой.
Как начать работу
Подходящие корпоративные клиенты могут включить модель на вкладке Playground в консоли Bedrock — программировать для этого не нужно. Разработчики могут вызывать модель через API Responses или Chat Completions, совместимые с OpenAI, либо использовать встроенные вызовы Bedrock Invoke и Converse. В публикации в блоге также приведён пример скрипта на Python, который отправляет модели запрос на рефакторинг с помощью временных токенов AWS.
Почему это важно
Теперь предприятия могут использовать крупную модель для программирования и задач безопасности, не покупая GPU-серверы, — это сокращает первоначальные расходы и упрощает соблюдение требований. Встроенное кэширование промптов может снизить задержки и расходы на токены при длительном анализе кода. Однако доступ ограничен подходящими корпоративными аккаунтами, а цены не раскрыты, поэтому точную экономию оценить пока нельзя.