TiDAR: Think in Diffusion, Talk in Autoregression (Paper Analysis)
TiDAR runs a diffusion model to draft tokens in parallel (Think), then lets an autoregressive decoder finalize output (Talk) — all in a single forward pass. Result: 5.91x faster than AR at comparable quality.