DeepSeek / Meta llama.cpp 新增 DeepSeek V4 Flash MTP/DSpark 支持,Mac 实测性能亮眼 llama.cpp 已加入MTP/DSpark支持,加速DeepSeek V4 Flash本地推理;另有用户在 M2 Ultra Mac 上实测 V4 Flash 0731 的预填充与解码性能,显示本地部署可用。[1][2]
DeepSeek / Lmstudio LM Studio 上线 DeepSeek V4 Flash 0731,本地与云端均可运行 LM Studio 官方称赞DeepSeek V4 Flash 0731是“该尺寸级别的能力跃升”,已可在Bionic本地运行,同时也支持LM Studio Cloud。https://t.co/6oxyTH0L2d[3]
Claude Monet:把散落终端里的 Claude Code 会话变成桌面工作台 新工具Monet将Claude Code会话集中为可浏览、可搜索、可并行指挥的桌面工作台,支持并行会话、权限审批、赛马模式切换模型且不丢上下文。https://t.co/KhZCzMKo5T[4]
Zhipu 摩根大通/路透社预测 GLM 5.5 将于八月发布 据 Geek 转述,【摩根大通/路透社】预测GLM 5.5将于【八月发布】;社区观点认为 GLM5.5 可能在等 DeepSeek V4 Pro 发布。[5][6]
HuggingFace Hugging Face 出现“Vacuum 16T”讽刺模型尺寸竞赛 Reddit 社区发现名为Vacuum 16T的模型,宣称16.5万亿参数但“实际什么都不是”,以讽刺各家比拼最大模型的风气,引发热议。[8]