Qwen3-Next 模型架构获 llama.cpp 支持,可本地高效运行。
事件:llama.cpp 通过 PR #16095 新增对 Qwen3-Next 混合架构的支持。 意义:用户现在可以在本地 CPU/GPU 上高效推理运行 Qwen 的新模型。[1]
Qwen新架构获主流推理框架支持,加速开源模型生态落地。通义实验室密集更新其图像生成工具的周边生态,提供实用工具与教程。快手代码模型上线第三方平台,扩大服务范围。