动态

新SparseD方法加速扩散语言模型1.3-1.5倍

Xingyi Yang
感谢@_akhaliq分享我们的新论文!

SparseD:一种用于扩散语言模型(DLM)的新型稀疏注意力方法
1.3–1.5倍加速 — 近乎无损,质量无下降!

arXiv: https://arxiv.org/abs/2509.24014
代码: http://github.com/INV-WZQ/SparseD

#LLM #AI #Diffusion
AK
SparseD:扩散语言模型的稀疏注意力 https://t.co/0Hm86ARrI2
动态Xingyi Yang2025-09-30原文

相关内容