Amazon Web Servicesは、Z.ai(Zhipu AIとしても知られる)のモデル「GLM 5.3」がBedrockで利用可能になったと発表した。753 billionのパラメーターを持つこのモデルは、Mixture of Experts(MoE)方式を採用している。リクエストの一部を専門のサブモデルに振り分け、効率を高める仕組みだ。Bedrockのユーザーは自分でハードウェアを稼働させることなく、すでに利用しているものと同じOpenAI互換APIからGLM 5.3を呼び出せる。
GLM 5.3でできること
GLM 5.3は、長時間にわたるコーディング作業や、大量のコンテキストを保持する必要があるエージェント型のワークフロー向けに調整されている。たとえば、数百のファイルにまたがるコードベースのリファクタリングが可能だ。Z.aiはサイバーセキュリティ性能の高さもアピールしており、CyberGymベンチマークで84.5という最高スコアを挙げた。Bedrockでは、プロンプトキャッシュ、クロスリージョン推論のほか、コストとレイテンシーのバランスを選べる3つのサービス階層(Flex、Standard、Priority)が利用できる。
利用を始めるには
対象となる法人顧客は、Bedrockコンソールの「Playground」タブからモデルを有効化でき、コードを書く必要はない。開発者はOpenAI互換のResponses APIまたはChat Completions API、あるいはBedrockネイティブのInvokeやConverseを使ってモデルを呼び出せる。ブログ記事では、短期間有効なAWSトークンを使ってモデルにリファクタリングを依頼するPythonスクリプトの例も紹介している。
なぜ重要か
企業はGPUサーバーを購入せずに、大規模なコーディング・セキュリティモデルを利用できるようになり、初期費用を抑え、コンプライアンス対応も簡素化できる。組み込みのプロンプトキャッシュにより、長時間のコード分析でレイテンシーやトークン料金を削減できる可能性もある。ただし、対象は条件を満たす法人アカウントに限られ、料金の詳細も公表されていないため、実際にどれほどコストを削減できるかは不明だ。