本期聚焦【开源音频模型】与本地智能体工具链:FireRed发布两款音频模型,DeepSeek Harness和llama.cpp扩展多模态支持。社区还在探索【推测解码提速】与低显存部署。

模型动态

FireRedTeam发布两款开源音频模型

FireRedTeam发布FireRedAudioFireRedTTS3,覆盖【音频理解与生成】,并开放模型及演示资源。[2]

LMArena预告Qwen3.8-27B跨规模对比测试

LMArena用相同一次生成和Agent任务测试Qwen3.8-27B与最大百倍规模模型,正式分数待公布[6][6]

产品工具

fx.sh新增Grok与Codex订阅支持

fx.sh v0.0.5接入【Grok、Codex订阅】,新增项目级技能与安全修复。地址:https://t.co/G0UyDr4xgg[1]

DeepSeek Harness升级多模态智能体工作流

DeepSeek Harness v0.1.1 RC加入V4视觉适配,/goal、/plan等命令现可接收图文输入[3]

llama.cpp推进dots3-note全模态模型适配

llama.cpp PR新增dots3-note预览支持,模型为MoE架构,支持512K上下文及文本、图像、音视频。[4]

llama.cpp分支引入DSpark PC Tree推测解码

开发者实现DSpark PC Tree推测解码,报告【提速3%-29.5%】;目前仍属早期版本,尚待广泛验证。[5]

Browser Use代理功能新增国家选择器

Browser Use为代理配置加入【国家选择器】,方便浏览器自动化任务快速切换出口地区。[7]

技巧教程

社区汇总16GB显存本地模型部署方案

社区讨论16GB显存可用模型与量化配置,并分享通过CPU卸载换取更长上下文的实践方案。[8]