Native K-quant support for MLX, with a quantization and fine-tuning toolchain for Apple Silicon
macos metal lora quantization mlx mixture-of-experts apple-silicon metal-shaders local-llm llm-inference flash-attention gguf mlx-lm k-quant
-
Updated
Aug 1, 2026 - C++