Agent skill · aradotso
dflash-mlx-speculative-decoding
Lossless DFlash speculative decoding for MLX on Apple Silicon — 1.7–4x faster LLM inference using block diffusion drafting with target model verification.
Reference it in any coding agent with:
@skills aradotso/dflash-mlx-speculative-decoding