أعلنت Amazon Web Services إتاحة نموذج GLM 5.3 من Z.ai (المعروفة أيضًا باسم Zhipu AI) على منصة Bedrock. يضم النموذج 753 مليار مُعامل، ويعتمد بنية مزيج الخبراء، ما يتيح له توجيه أجزاء من الطلب إلى نماذج فرعية متخصصة لزيادة الكفاءة. ويمكن لمستخدمي Bedrock استدعاء GLM 5.3 عبر واجهات API المتوافقة مع OpenAI التي يستخدمونها بالفعل، من دون الحاجة إلى تشغيل أي أجهزة بأنفسهم.
ما الذي يقدمه GLM 5.3؟
ضُبط GLM 5.3 لتنفيذ مهام البرمجة الطويلة وسير العمل القائم على الوكلاء، والتي تتطلب الاحتفاظ بسياق واسع، مثل إعادة هيكلة قاعدة برمجية تضم مئات الملفات. كما تشير Z.ai إلى أداء قوي في الأمن السيبراني، مستشهدةً بحصول النموذج على درجة 84.5 في معيار CyberGym. وعلى Bedrock، يستفيد النموذج من تخزين المطالبات مؤقتًا، والاستدلال عبر المناطق، وثلاث فئات للخدمة (Flex وStandard وPriority) تتيح للمستخدمين الموازنة بين التكلفة وزمن الاستجابة.
كيفية البدء باستخدامه
يمكن لعملاء المؤسسات المؤهلين تفعيل النموذج من علامة تبويب Playground في وحدة تحكم Bedrock، من دون الحاجة إلى كتابة أي شيفرة. ويمكن للمطورين استدعاء النموذج باستخدام واجهات Responses أو Chat Completions المتوافقة مع OpenAI، أو عبر استدعاءات Bedrock الأصلية Invoke وConverse. كما تتضمن تدوينة المدونة مثالًا على برنامج نصي بلغة Python يرسل طلبًا لإعادة هيكلة الشيفرة إلى النموذج باستخدام رموز AWS قصيرة الأجل.
لماذا يهم
بات بإمكان المؤسسات تشغيل نموذج ضخم للبرمجة والأمن من دون شراء خوادم مزودة بوحدات GPU، ما يخفض التكاليف الأولية ويسهّل الامتثال. ويمكن لتخزين المطالبات مؤقتًا أن يقلل زمن الاستجابة ورسوم الرموز في جلسات تحليل الشيفرة الطويلة. لكن استخدام النموذج مقتصر على حسابات المؤسسات المؤهلة، ولم تُكشف تفاصيل الأسعار، لذا لا تزال الوفورات الفعلية غير مؤكدة.