developer.nvidia.com
2026-06-11
NVIDIA's technical blog highlights the deployment of DiffusionGemma, a text generation model developed by Google DeepMind, optimized for NVIDIA platforms. This model introduces a novel approach using diffusion-based denoising to generate 256 tokens in parallel per step, achieving up to 1,000 tokens/
blogs.nvidia.com
2026-06-11
NVIDIA has optimized Google DeepMind's experimental open model, DiffusionGemma, to accelerate local AI text generation. Unlike traditional autoregressive models that process tokens sequentially, DiffusionGemma generates multiple tokens in parallel using a diffusion approach, significantly reducing l