Amazon Web Services heeft bekendgemaakt dat het GLM 5.3-model van Z.ai (ook bekend als Zhipu AI) nu beschikbaar is op het Bedrock-platform. Het model heeft 753 miljard parameters en is opgebouwd als een mixture-of-experts-systeem. Dat betekent dat het delen van een opdracht efficiënt kan doorsturen naar gespecialiseerde submodellen. Gebruikers van Bedrock kunnen GLM 5.3 aanroepen via dezelfde OpenAI-compatibele API’s die ze al gebruiken, zonder zelf hardware te hoeven beheren.
Wat biedt GLM 5.3?
GLM 5.3 is afgestemd op langdurige programmeeropdrachten en agentische workflows die veel context moeten vasthouden, zoals het herstructureren van een codebase met honderden bestanden. Z.ai wijst ook op sterke prestaties op het gebied van cyberbeveiliging en noemt een topscore van 84.5 op de CyberGym-benchmark. Op Bedrock profiteert het model van promptcaching, inferentie tussen regio’s en drie serviceniveaus (Flex, Standard, Priority), waarmee gebruikers een afweging kunnen maken tussen kosten en latentie.
Zo ga je ermee aan de slag
In aanmerking komende zakelijke klanten kunnen het model inschakelen via het tabblad Playground in de Bedrock-console; daarvoor is geen code nodig. Ontwikkelaars kunnen het model aanroepen met de OpenAI-compatibele Responses- of Chat Completions-API’s, of met de eigen Invoke- en Converse-aanroepen van Bedrock. De blogpost bevat ook een voorbeeldscript in Python dat met tijdelijke AWS-tokens een verzoek tot herstructurering naar het model stuurt.
Waarom het ertoe doet
Bedrijven kunnen nu een zeer groot model voor programmeren en beveiliging gebruiken zonder GPU-servers aan te schaffen. Dat verlaagt de initiële kosten en maakt compliance eenvoudiger. De ingebouwde promptcaching kan de latentie en tokenkosten verlagen bij langdurige code-analysesessies. Het model is echter alleen beschikbaar voor zakelijke accounts die ervoor in aanmerking komen, en de prijs is niet bekendgemaakt. Daardoor is onduidelijk hoeveel kosten er precies kunnen worden bespaard.