Performance Improved by Over Two Times: NVIDIA Releases Nemotron-Labs-TwoTower Diffusion Language Model
Nvidia open-sourced Nemotron-Labs-TwinTower diffusion language model, which uses a "twin tower" architecture to overcome the serial decoding bottleneck of autoregressive models. It splits generation into two subnetworks, one kept frozen, enabling parallel text generation and higher throughput, providing an efficient solution for large-scale synthesis tasks.....