Amazon Web Services meddelar att modellen GLM 5.3 från Z.ai (även känt som Zhipu AI) nu finns på företagets Bedrock-plattform. Modellen har 753 miljarder parametrar och bygger på en mixture-of-experts-arkitektur. Det innebär att den kan skicka olika delar av en begäran till specialiserade undermodeller för att arbeta effektivare. Bedrock-användare kan anropa GLM 5.3 via samma OpenAI-kompatibla API:er som de redan använder, utan att själva behöva köra någon hårdvara.
Vad erbjuder GLM 5.3?
GLM 5.3 är optimerad för långvariga kodningsuppgifter och agentbaserade arbetsflöden där stora mängder kontext behöver bevaras, till exempel när en kodbas med hundratals filer ska omstruktureras. Z.ai lyfter också fram modellens starka resultat inom cybersäkerhet och hänvisar till toppresultatet 84,5 i benchmarktestet CyberGym. På Bedrock får modellen tillgång till promptcachning, inferens över flera regioner och tre servicenivåer (Flex, Standard, Priority), så att användare kan väga kostnad mot svarstid.
Så kommer du igång
Kunder i företag som uppfyller kraven kan aktivera modellen under fliken Playground i Bedrock-konsolen – ingen kodning krävs. Utvecklare kan anropa modellen via de OpenAI-kompatibla API:erna Responses eller Chat Completions, eller med Bedrocks egna anrop Invoke och Converse. Blogginlägget innehåller också ett exempel på ett Python-skript som skickar en begäran om att omstrukturera kod till modellen med hjälp av kortlivade AWS-token.
Varför det spelar roll
Företag kan nu köra en mycket stor modell för kodning och säkerhet utan att köpa GPU-servrar, vilket minskar de initiala kostnaderna och förenklar efterlevnaden av regelverk. Den inbyggda promptcachningen kan sänka svarstider och tokenkostnader vid långvariga kodanalyser. Modellen är dock begränsad till företagskonton som uppfyller kraven, och prisuppgifter saknas. Därför är det svårt att veta exakt hur mycket kostnaderna kan minska.