Lightweight block-diffusion draft model for speculative decoding acceleration, providing weights across multiple model families along with inference and evaluation support for faster generation.