EmoRES-TTS: Residual-Enhanced Vector Steering for Emotional Speech Generation Paper • 2609.38157 • Published 5 days ago • 20
FdAudio: MeanFlow-Anchored Fréchet-Distance Post-Training for One-Step Text-to-Audio Generation Paper • 2607.10421 • Published Jul 11 • 2
IMPACT: Iterative Mask-based Parallel Decoding for Text-to-Audio Generation with Diffusion Modeling Paper • 2506.00736 • Published May 31, 2025 • 11