Rapid-MLX v0.15.4: Qwen3.8-27B TensorFold and DFlash2 Speculative Decoding on Apple Silicon
Apple Silicon local LLM engine Rapid-MLX v0.15.4 adds an experimental TensorFold profile with DFlash2 speculative decoding for Qwen3.8-27B alongside MTP acceler