Volo: Diffusion language models achieve 1000+ tokens/sec, enabling real-time voice AI
Diffusion models generate tokens in parallel rather than sequentially, achieving 1000+ tokens/sec on GPUs versus specialized chips, enabling real-time voice applications with bett…