RADiT: Redundancy-Aware Diffusion Transformer Acceleration Leveraging Timestep Similarity

  • Park, Youngjun
  • Kim, Sang yeon
  • Kim, Yeong geon
  • Ji, Gisan
  • Ryu, Sung ju
Citations

WEB OF SCIENCE

0
Citations

SCOPUS

0

초록

Diffusion Transformers (DiTs) have demonstrated unprecedented performance across various generative tasks including image and video generation. However, a large amount of computations on the inference process and iterative sampling steps in the DiT models result in high computational costs, leading to substantial latency and energy consumption challenges. To address these issues, we propose a redundancy-aware DiT (RADiT), a novel software-hardware co-optimization accelerator for DiTs that minimizes redundant operations in the iterative sampling stages. We identify data redundancy by evaluating blockwise input features and skip redundant computations by reusing results from consecutive timesteps. Furthermore, to minimize accuracy degradation and maximize computational efficiency, the Dynamic Threshold Scaling Module (DTSM) and Compress and Compare Unit (CCU) are employed in the redundancy detection process. This approach enables DiTs to achieve up to 1.8 × and 1.7 × faster speeds for image and video generation, respectively, without compromising quality, along with 41% and 45.5% reductions in energy consumption. Our RADiT scheme improves throughput by 1.67 × and 1.76 × for image and video generation tasks, respectively, while maintaining output quality and significantly reducing energy consumption.

키워드

Diffusion modelhardware acceleratorneural networktimestep similaritytransformer
제목
RADiT: Redundancy-Aware Diffusion Transformer Acceleration Leveraging Timestep Similarity
저자
Park, YoungjunKim, Sang yeonKim, Yeong geonJi, GisanRyu, Sung ju
DOI
10.1109/DAC63849.2025.11133190
발행일
2025
유형
Proceedings Paper
저널명
Proceedings - Design Automation Conference