WinterMix发布:将Qwen3.5-122B-A10B压缩至82GiB
社区发布WinterMix量化方法,将Qwen3.5-122B-A10B在原生MLX压缩至82GiB,表现优于更大体积的6-bit构建,另有68GiB版本面向Agent集群。链接:https://www.reddit.com/r/LocalLLaMA/comments/1vdcs8e/release_wintermix_qwen35122ba10b_in_native_mlx_an/[2]