Amazon Web Services 宣布,Z.ai(又称 Zhipu AI)的 GLM 5.3 模型现已登陆其 Bedrock 平台。该模型拥有 7530 亿参数,采用混合专家架构,可将请求的不同部分分配给专门的子模型处理,以提高效率。Bedrock 用户可以通过现有的 OpenAI 兼容 API 调用 GLM 5.3,无需自行运行任何硬件。
GLM 5.3 有哪些特点?
GLM 5.3 针对长时间运行的编程任务和智能体工作流进行了优化,能够处理大量上下文,例如重构包含数百个文件的代码库。Z.ai 还强调了该模型在网络安全方面的出色表现,并称其在 CyberGym 基准测试中取得了 84.5 的高分。在 Bedrock 上,该模型支持提示缓存、跨区域推理,以及 Flex、Standard 和 Priority 三种服务等级,用户可据此权衡成本与延迟。
如何开始使用
符合条件的企业客户可在 Bedrock 控制台的 Playground 选项卡中启用该模型,无需编写代码。开发者可以通过 OpenAI 兼容的 Responses 或 Chat Completions API 调用模型,也可以使用 Bedrock 原生的 Invoke 和 Converse 接口。博客文章还展示了一段 Python 示例脚本,演示如何使用短期 AWS 令牌向模型发送代码重构请求。
为什么重要
企业现在无需购买 GPU 服务器,就能运行规模庞大的编程和安全模型,从而降低前期成本并简化合规工作。内置的提示缓存可减少长时间代码分析会话的延迟和 token 费用。不过,该模型仅对符合条件的企业账户开放,且未公布定价,因此具体能节省多少成本仍不确定。