Moait
홈인기 피드모든 블로그모든 태그
홈인기 피드모든 블로그모든 태그
Accelerating Spatio-Temporal Attention for Video Diffusion on TPUs 섬네일

Accelerating Spatio-Temporal Attention for Video Diffusion on TPUs

구글 favicon구글·AI/ML·
Video DiffusionSpatio Temporal AttentionSparse VideoGenSplash AttentionTPUs
2026년 09월 30일0

AI 요약

이 글은 AI가 요약했어요. 정확한 내용은 꼭 원문을 확인해 주세요!

핵심 요약

구글이 TPUs에서 비디오 디퓨전에 대한 스파스 주의로 연산 부담을 줄이고, SVG와 하드웨어 친화적 최적화를 통해 1440p 비디오 생성의 엔드투엔드 추론 속도를 최대 1.69배 향상시켰다.

구현 방법

  • Sparse VideoGen(SVG)를 도입해 주의 헤드를 공간/시간 희소 마스크로 동적으로 라우팅
  • Splash Attention 커널에서 빈 메모리 타일을 우회해 불필요한 연산 감소
  • 경계 타일에 한정된 좌표 마스킹과 Temporal-major 레이아웃으로 연속 접근 최적화
  • 희소 마스크를 실제 하드웨어 타일 실행에 맞춰 정렬해 낭비를 최소화

주요 결과

  • 1440p 비디오 생성에서 엔드투엔드 추론 속도 최대 1.69배 향상

연관 피드

%가 높을수록 이 글과 비슷할 가능성이 높아요!
HeyGen x Google Cloud: Bringing Avatar IV to TPUs 섬네일
76%

HeyGen x Google Cloud: Bringing Avatar IV to TPUs

구글 favicon구글·2026년 08월 13일
Supercharging LLM inference on Google TPUs: Achieving 3X speedups with diffusion-style speculative decoding 섬네일
74%

Supercharging LLM inference on Google TPUs: Achieving 3X speedups with diffusion-style speculative decoding

구글 favicon구글·2026년 05월 04일
Enterprise-Grade Precision for Long-Context Multimodal Embedding Inference on Cloud TPU 섬네일
73%

Enterprise-Grade Precision for Long-Context Multimodal Embedding Inference on Cloud TPU

구글 favicon구글·2026년 08월 26일