Towards Efficient and Scalable Sharpness-Aware Minimization Paper • 2203.02714 • Published Mar 5, 2022
SpecFold: Folding Multi-Branch Redundancy for Faster Speculative Decoding in Diffusion Language Models Paper • 2610.04875 • Published 6 days ago • 7