本期焦点:DeepSeek V4 Flash 本地生态持续扩展(llama.cpp新增支持、LM Studio 上线),行业侧关注GLM 5.5八月发布预测与 AI 发展公开信讨论。

产品工具

llama.cpp 新增 DeepSeek V4 Flash MTP/DSpark 支持,Mac 实测性能亮眼

llama.cpp 已加入MTP/DSpark支持,加速DeepSeek V4 Flash本地推理;另有用户在 M2 Ultra Mac 上实测 V4 Flash 0731 的预填充与解码性能,显示本地部署可用。[1][2]

LM Studio 上线 DeepSeek V4 Flash 0731,本地与云端均可运行

LM Studio 官方称赞DeepSeek V4 Flash 0731是“该尺寸级别的能力跃升”,已可在Bionic本地运行,同时也支持LM Studio Cloud。https://t.co/6oxyTH0L2d[3]

Monet:把散落终端里的 Claude Code 会话变成桌面工作台

新工具MonetClaude Code会话集中为可浏览、可搜索、可并行指挥的桌面工作台,支持并行会话、权限审批、赛马模式切换模型且不丢上下文。https://t.co/KhZCzMKo5T[4]

行业资讯

摩根大通/路透社预测 GLM 5.5 将于八月发布

据 Geek 转述,【摩根大通/路透社】预测GLM 5.5将于【八月发布】;社区观点认为 GLM5.5 可能在等 DeepSeek V4 Pro 发布。[5][6]

Simon Willison 总结近期 AI 发展公开信

Simon Willison 撰文梳理近几周关于 AI 发展的多封【公开信】,为从业者理解行业舆论提供了系统参考。[7]

Hugging Face 出现“Vacuum 16T”讽刺模型尺寸竞赛

Reddit 社区发现名为Vacuum 16T的模型,宣称16.5万亿参数但“实际什么都不是”,以讽刺各家比拼最大模型的风气,引发热议。[8]