Agent skill · aradotso

dflash-mlx-speculative-decoding

Lossless DFlash speculative decoding for MLX on Apple Silicon — 1.7–4x faster LLM inference using block diffusion drafting with target model verification.

Reference it in any coding agent with:

@skills aradotso/dflash-mlx-speculative-decoding

Browse the @skills marketplace