# گوگل: توجه ویدیویی تنک روی TPUها 2.4× سریع‌تر است

> گوگل می‌گوید یک کرنل توجهِ هم‌تراز با کاشی‌ها، تأخیر را روی یک تراشه TPU v6e کاهش داده است. این افزایش سرعتِ گزارش‌شده فقط به کرنل توجه مربوط می‌شود، نه کل فرایند تولید ویدیو.

Oossa · 2026-09-30 · https://oossa.com/fa/google-reports-2-4-faster-sparse-video-attention-on-tpus

تاریخ رویداد: 2026-09-30

با کمک هوش مصنوعی تهیه و ترجمه شده است. منابع اصلی زیر را بررسی کنید.

گوگل مطالعه‌ای موردی درباره افزایش سرعت توجه در انتشار ویدیو منتشر کرده است؛ مرحله‌ای پرهزینه در تولید کلیپ‌های طولانی و با وضوح بالا. کرنل این شرکت که با JAX و Pallas ساخته شده، از توجه تنک استفاده می‌کند و ماسک توجه را با کاشی‌هایی هم‌تراز می‌کند که TPU محاسبه می‌کند.

در آزمایش‌ها روی یک تراشه TPU v6e، نسخه نهایی 32.76 میلی‌ثانیه زمان برد؛ درحالی‌که این زمان برای توجه متراکم Splash برابر با 78.70 میلی‌ثانیه بود؛ یعنی افزایش سرعتِ گزارش‌شده 2.40×. اندازه‌گیری‌ها با ورودی‌های مصنوعی انجام شده‌اند و مسیریابی، جابه‌جایی توکن‌ها و ارتباط میان دستگاه‌ها را شامل نمی‌شوند؛ بنابراین افزایش سرعت در کل فرایند تولید ویدیو را ثابت نمی‌کنند.

## حقایق

- آزمایش‌ها با 75,600 توکن، 10 سر و بُعد سر 128 روی یک تراشه TPU v6e انجام شدند.
- گوگل برای کرنل تنک نهایی خود 32.76 ms و برای توجه متراکم Splash، 78.70 ms گزارش کرد.

## چرا مهم است

برای تیم‌هایی که در حال بهینه‌سازی تولید ویدیو روی TPUها هستند، این نتیجه نشان می‌دهد که ماسک تنک می‌تواند از توجه متراکم کندتر باشد، مگر اینکه کرنل طوری طراحی شده باشد که کاشی‌های مناسب را نادیده بگیرد و بقیه را به‌طور کارآمد پردازش کند؛ منبع، تأثیر این روش بر زمان کل تولید ویدیو را نشان نمی‌دهد.

## منابع و ارجاع‌ها

1. [Accelerating Spatio-Temporal Attention for Video Diffusion on TPUs](https://developers.googleblog.com/en/accelerating-spatio-temporal-attention-for-video-diffusion-on-tpus/) – Google for Developers

آخرین به‌روزرسانی: 2026-09-30
