Qwen3.8-Next在32GB M5 Air上实现150 tokens/s预填充
社区将流式推理方案适配Qwen3.8-Next,在32GB M5 Air上测得约150 tokens/s预填充、3.6 tokens/s解码。https://www.reddit.com/r/LocalLLaMA/comments/1w1inuk/qwen38next_streaming_150tps_prefill_36_tps_decode/[9]
本期重点是Midjourney风格代码实用分享,以及社区对DGX Spark、Qwen3.8-Next本地推理性能的新实测;同时Gemini CLI和Codex发布了版本更新。