Up to 3× faster LLM decoding on Apple Silicon, lossless. Native MLX port of DeepSeek's DSpark & z-lab's DFlash speculative decoding - Gemma-4, Qwen3, Ornith-1.0, ternary Bonsai-27B.