本期重点关注低成本训练7B模型本地推理优化与Agent基础设施更新。与此同时,AI记忆管理、Obsidian插件开发和企业AI战略也出现了值得关注的新实践。

模型动态

7名博士生3个月从零训练7B模型并公开完整资料

团队仅用3个月训练出7B模型,并公开代码、数据和训练日志,还引入数百个Agent辅助研发。项目地址:https://www.qbitai.com/2026/09/489227.html[1]

产品工具

Browser Use为沙箱加入隐蔽浏览器能力

Browser Use宣布为现有沙箱提供隐蔽浏览器,支持通用Agent场景与本地部署,有望提升浏览器自动化的可用性。[2]

fx 0.0.10支持自动升级与会话恢复

终端工具fx更新至0.0.10,改进长会话性能,并支持自动升级及快捷键重启、恢复会话,适合持续使用终端AI工具。[3]

纯C99推理引擎同时支持BitNet与GGUF模型

开发者用纯C99实现统一推理引擎,无需Python和CUDA即可运行BitNet三值模型与常规GGUF模型。项目地址:https://www.reddit.com/r/LocalLLaMA/comments/1wg9iu5/i_built_a_single_c99_inference_engine_that_runs/[6]

Hermes v2026.9.14修复远程会话刷新失效问题

新版本修复高频刷新导致的会话过期,并发刷新请求现在复用令牌,身份提供商响应变慢时也不再阻塞状态接口。发布页:https://github.com/NousResearch/hermes-agent/releases/tag/v2026.9.14[8]

技巧教程

Weaviate建议将AI记忆从聊天记录堆积改为结构化管理

持续累积聊天记录会增加【Token开销】、拖慢响应并产生过时信息。长期运行的Agent应筛选、更新并结构化管理记忆。[4]

Obsidian开发Skill可自动完成插件开发与上架

该Skill会先查官方API和开源项目,再协助完成开发、测试和上架。安装:`npx skills add joeseesun/qiaomu-obsidian-dev`[5]

硬件动态

开发者尝试将NVIDIA CMP 170HX显存扩展至64GB

社区展示把CMP 170HX从8GB改至64GB并限制功耗用于本地推理的方案,但改造风险较高,稳定性仍待验证。[7]