Oossa

AWS 将 Z.ai 的 GLM 5.3 模型加入 Amazon Bedrock

拥有 7530 亿参数的 GLM 5.3 现可通过 Bedrock 托管 API 用于编程和安全任务。

作者: Oossa 发布日期: 最后更新: 1 分钟阅读

Emile Perron · Unsplash

Amazon Web Services 宣布,Z.ai(又称 Zhipu AI)的 GLM 5.3 模型现已登陆其 Bedrock 平台。该模型拥有 7530 亿参数,采用混合专家架构,可将请求的不同部分分配给专门的子模型处理,以提高效率。Bedrock 用户可以通过现有的 OpenAI 兼容 API 调用 GLM 5.3,无需自行运行任何硬件。

GLM 5.3 有哪些特点?

GLM 5.3 针对长时间运行的编程任务和智能体工作流进行了优化,能够处理大量上下文,例如重构包含数百个文件的代码库。Z.ai 还强调了该模型在网络安全方面的出色表现,并称其在 CyberGym 基准测试中取得了 84.5 的高分。在 Bedrock 上,该模型支持提示缓存、跨区域推理,以及 Flex、Standard 和 Priority 三种服务等级,用户可据此权衡成本与延迟。

如何开始使用

符合条件的企业客户可在 Bedrock 控制台的 Playground 选项卡中启用该模型,无需编写代码。开发者可以通过 OpenAI 兼容的 Responses 或 Chat Completions API 调用模型,也可以使用 Bedrock 原生的 Invoke 和 Converse 接口。博客文章还展示了一段 Python 示例脚本,演示如何使用短期 AWS 令牌向模型发送代码重构请求。

为什么重要

企业现在无需购买 GPU 服务器,就能运行规模庞大的编程和安全模型,从而降低前期成本并简化合规工作。内置的提示缓存可减少长时间代码分析会话的延迟和 token 费用。不过,该模型仅对符合条件的企业账户开放,且未公布定价,因此具体能节省多少成本仍不确定。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。