DSpark Explained: Semi-Autoregressive Speculative Decoding for Faster LLM Inference 4 July 2026·1355 words·7 mins Large Language Models Speculative Decoding DeepSeek AI Inference Machine Learning Generative AI Transformer Models Inference Optimization