本周社区迎来多个重要模型动态与技术教程,LongCat-2.01.6T参数MoE模型正式发布,DeepSeek DSpark推测解码技术详解引发热议,同时Ornith 35B配合DFlash实现30-40%速度提升,AI趣味应用案例也获关注。

模型动态

LongCat-2.0大规模MoE模型正式发布

总参数1.6T,每token激活约48B参数,此前以代号‘owl-alpha’在Openrouter测试后正式发布,定位为高性能开源MoE模型。[1]

产品工具

Uber司机用AI以乘客名字即时生成音乐恶搞

网友分享Uber车主利用AI工具,将乘客名字转化为即时生成音乐进行恶搞互动,展示AI在娱乐场景中的创意应用。视频链接:https://t.co/3Kz1BrwRYF[4]

技巧教程

Ornith 35B配合Qwen3.6 DFlash推测模型实现速度跃升

用户分享配置方案,Ornith 35B与Qwen3.6 35B DFlash搭配后【token生成速度提升30-40%】,并附具体命令行,对本地推理玩家极具参考价值。[2]

DeepSeek DSpark推测解码技术原理全解析

通过MTP微型Transformer在Final RMSNorm处截胡,先并行预测再串行修正,速度提升60%-85%且不降智。SGLang已有相关PR(29538),DeepSeek发布多款DSpark魔改版模型。[3]