Ollama released v0.34.1-rc0, a release candidate that includes an MLX version bump adding support for ModelOpt global scales in mixture-of-experts models1. The update, published on the project's GitHub releases page, addresses compatibility for quantized MoE architectures using ModelOpt scaling parameters.
Ollama v0.34.1-rc0 Adds MLX Support for ModelOpt Global Scales in MoE Models
Ollama's v0.34.1-rc0 release candidate bumps MLX to support ModelOpt global scales in mixture-of-experts models.