# Google: انتباه الفيديو المتناثر أسرع 2.4× على TPU

> تقول Google إن نواة انتباه متوافقة مع تقسيم البيانات إلى كتل خفّضت زمن الاستجابة على شريحة TPU v6e واحدة. ويشمل تسارع الأداء المُعلن نواة الانتباه، لا خط إنتاج توليد الفيديو بأكمله.

Oossa · 2026-09-30 · https://oossa.com/ar/google-reports-2-4-faster-sparse-video-attention-on-tpus

تاريخ الحدث: 2026-09-30

أُعدّ وتُرجم بمساعدة الذكاء الاصطناعي. راجع المصادر الأصلية أدناه.

نشرت Google دراسة حالة عن تسريع الانتباه في نماذج انتشار الفيديو، وهي خطوة مكلفة عند توليد مقاطع طويلة وعالية الدقة. تستخدم نواة JAX وPallas انتباهًا متناثرًا، وتضبط قناع الانتباه ليتوافق مع الكتل التي تعالجها TPU.

في الاختبارات على شريحة TPU v6e واحدة، استغرقت النسخة النهائية 32.76 مللي ثانية، مقابل 78.70 مللي ثانية لانتباه Splash الكثيف، أي تسارع مُعلن قدره 2.40×. واستخدمت القياسات مدخلات اصطناعية، ولم تشمل التوجيه أو إعادة ترتيب الرموز أو الاتصال بين الأجهزة؛ لذا فهي لا تثبت تسارعًا شاملًا لعملية توليد الفيديو من البداية إلى النهاية.

## الحقائق

- استخدمت الاختبارات 75,600 رمزًا و10 رؤوس وبُعدًا للرأس قدره 128 على شريحة TPU v6e واحدة.
- أعلنت Google أن زمن نواة الانتباه المتناثر النهائية بلغ 32.76 ms، مقابل 78.70 ms لانتباه Splash الكثيف.

## لماذا يهم

بالنسبة إلى الفرق التي تحسّن توليد الفيديو على وحدات TPU، تُظهر النتيجة أن قناعًا متناثرًا قد يكون أبطأ من الانتباه الكثيف ما لم تُصمَّم النواة لتجاوز الكتل المناسبة ومعالجتها بكفاءة. ولا يوضح المصدر أثر ذلك في الزمن الإجمالي لتوليد الفيديو.

## المصادر والمراجع

1. [Accelerating Spatio-Temporal Attention for Video Diffusion on TPUs](https://developers.googleblog.com/en/accelerating-spatio-temporal-attention-for-video-diffusion-on-tpus/) – Google for Developers

آخر تحديث: 2026-09-30
