Qwen3.6扩散化模型在RTX 5090达到3000+ tok/s
开源项目Open-dLLM将Qwen3.6转为扩散语言模型,在单卡5090上以10步扩散实现3238 tok/s,4步可达约6500 tok/s。项目已开源代码和训练指标,为本地高性能推理提供新思路。Github:https://github.com/scrya-com/Open-dLLM[3]
本期最重磅事件是Anthropic Mythos AI在5天内攻破苹果M5安全系统;同时开发者分享了用Codex agent实现全自动化开发流程的实战经验;Qwen3.6扩散模型在单卡上实现3000+ tok/s的推理速度引发关注。