Unlocking Lossless Speedups in LLMs via Discrete DiffusionPaper Uno: AR and Diffusion in One Model — Lossless Parallel Generation for LLM AccelerationTL;DR — LLMs are slow because next-token … September 8, 2026 22 min2609.04010v1