قدّم باحثون APEX، وهو متحكّم متعلّم يحدّد عدد الرموز التخمينية التي ينبغي توليدها وطريقة التخمين الواجب استخدامها. ويعمل المتحكّم مع محرّك الاستدلال vLLM، وقد اختُبر على نموذج اللغة Qwen3-8B. وفي ستة اختبارات معيارية، حقق APEX تسريعًا يصل إلى 5.24× مقارنةً بفك الترميز التوليدي الذاتي التقليدي. وحافظ إصدار APEX‑Depth على تسريع قدره 3.27×، مع خفض الرموز المهدرة بنسبة 41% مقارنةً بمسودة ثابتة من n‑gram بحجم 16.
لماذا يهم
يمكن للمطوّرين تشغيل نماذج اللغة الكبيرة بسرعة أكبر وبتكلفة أقل، ما يجعل ميزات الذكاء الاصطناعي الفورية في متناول الجميع بتكلفة معقولة أكثر.