# Google, TPU’larda seyrek video dikkatini 2,4× hızlandırdı

> Google, döşemelerle hizalanan bir dikkat çekirdeğinin tek bir TPU v6e yongasında gecikmeyi azalttığını söylüyor. Açıklanan hızlanma, video üretiminin tüm iş akışını değil, yalnızca dikkat çekirdeğini kapsıyor.

Oossa · 2026-09-30 · https://oossa.com/tr/google-reports-2-4-faster-sparse-video-attention-on-tpus

Olay tarihi: 2026-09-30

Yapay zekâ desteğiyle hazırlanıp çevrildi. Aşağıdaki asıl kaynakları kontrol edin.

Google, uzun ve yüksek çözünürlüklü kliplerin üretiminde maliyetli bir aşama olan video difüzyonundaki dikkat işlemlerini hızlandırmaya yönelik bir vaka çalışması yayımladı. JAX ve Pallas ile geliştirilen çekirdek, seyrek dikkat kullanıyor ve dikkat maskesini TPU’nun hesapladığı döşemelerle hizalıyor.

Tek bir TPU v6e yongasında yapılan testlerde son sürüm 32.76 milisaniyede tamamlandı; yoğun Splash dikkati ise 78.70 milisaniye sürdü. Google, bunun 2.40× hızlanma olduğunu bildirdi. Ölçümlerde sentetik girdiler kullanıldı; yönlendirme, belirteçlerin yeniden düzenlenmesi ve aygıtlar arası iletişim hesaba katılmadı. Bu nedenle sonuçlar, uçtan uca video üretiminde hızlanma olduğunu göstermiyor.

## Gerçekler

- Testlerde tek bir TPU v6e yongasında 75,600 belirteç, 10 başlık ve 128 başlık boyutu kullanıldı.
- Google, son seyrek çekirdeği için 32.76 ms, yoğun Splash dikkati için 78.70 ms bildirdi.

## Neden önemli

TPU’larda video üretimini optimize eden ekipler açısından sonuç, çekirdek doğru döşemeleri atlayıp verimli biçimde işleyecek şekilde tasarlanmadıkça seyrek bir maskenin yoğun dikkatten daha yavaş olabileceğini gösteriyor. Kaynak, bunun video üretiminin toplam süresine etkisini ortaya koymuyor.

## Kaynaklar ve referanslar

1. [Accelerating Spatio-Temporal Attention for Video Diffusion on TPUs](https://developers.googleblog.com/en/accelerating-spatio-temporal-attention-for-video-diffusion-on-tpus/) – Google for Developers

Son güncelleme: 2026-09-30
