Oossa

AWS voegt Z.ai’s GLM 5.3 toe aan Amazon Bedrock

Het GLM 5.3-model met 753 miljard parameters is nu via de beheerde API’s van Bedrock te gebruiken voor programmeer- en beveiligingstaken.

Door Gepubliceerd door Oossa: Laatst bijgewerkt: 1 min lezen

Emile Perron · Unsplash

Amazon Web Services heeft bekendgemaakt dat het GLM 5.3-model van Z.ai (ook bekend als Zhipu AI) nu beschikbaar is op het Bedrock-platform. Het model heeft 753 miljard parameters en is opgebouwd als een mixture-of-experts-systeem. Dat betekent dat het delen van een opdracht efficiënt kan doorsturen naar gespecialiseerde submodellen. Gebruikers van Bedrock kunnen GLM 5.3 aanroepen via dezelfde OpenAI-compatibele API’s die ze al gebruiken, zonder zelf hardware te hoeven beheren.

Wat biedt GLM 5.3?

GLM 5.3 is afgestemd op langdurige programmeeropdrachten en agentische workflows die veel context moeten vasthouden, zoals het herstructureren van een codebase met honderden bestanden. Z.ai wijst ook op sterke prestaties op het gebied van cyberbeveiliging en noemt een topscore van 84.5 op de CyberGym-benchmark. Op Bedrock profiteert het model van promptcaching, inferentie tussen regio’s en drie serviceniveaus (Flex, Standard, Priority), waarmee gebruikers een afweging kunnen maken tussen kosten en latentie.

Zo ga je ermee aan de slag

In aanmerking komende zakelijke klanten kunnen het model inschakelen via het tabblad Playground in de Bedrock-console; daarvoor is geen code nodig. Ontwikkelaars kunnen het model aanroepen met de OpenAI-compatibele Responses- of Chat Completions-API’s, of met de eigen Invoke- en Converse-aanroepen van Bedrock. De blogpost bevat ook een voorbeeldscript in Python dat met tijdelijke AWS-tokens een verzoek tot herstructurering naar het model stuurt.

Waarom het ertoe doet

Bedrijven kunnen nu een zeer groot model voor programmeren en beveiliging gebruiken zonder GPU-servers aan te schaffen. Dat verlaagt de initiële kosten en maakt compliance eenvoudiger. De ingebouwde promptcaching kan de latentie en tokenkosten verlagen bij langdurige code-analysesessies. Het model is echter alleen beschikbaar voor zakelijke accounts die ervoor in aanmerking komen, en de prijs is niet bekendgemaakt. Daardoor is onduidelijk hoeveel kosten er precies kunnen worden bespaard.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.