本期社区围绕本地大模型和【AI智能体开发】展开热烈讨论,Qwen3.5-397B在MacBook上实现惊人推理速度,同时开发者分享了大量Claude Code实用工具与开发心得。

模型动态

开发者成功在MacBook上运行397B大模型,推理速度达29 tokens/s

用户使用M5 Max 128GBMacBook成功运行Qwen3.5-397B的2位量化版本,平均生成速度达到29 tokens/s。这得益于Unsloth的【自适应层量化】技术,将807GB的原模型压缩至106GB,证明了在消费级硬件上运行超大规模模型的可行性。[1]

18岁开发者成功训练10亿参数脉冲神经网络,发现跨语言能力

一位18岁独立开发者成功将【纯脉冲神经网络】扩展到10.88亿参数,并实现了从随机初始化的收敛。模型展现出【93%的稀疏度】和【跨语言涌现】能力,在未专门训练的情况下生成了结构正确的俄语文本。项目地址:https://github.com/gtausa197-svg/-Project-Nord-Spiking-Neural-Network-Language-Model.git[2]

产品工具

新Agent聚合软件Superconductor发布,支持多编码Agent

一款名为Superconductor的新Agent聚合软件发布,支持在一个软件内启动如Claude Code、Codex、Gemini CLI等多种编码Agent工具。该软件完全用Rust编写,目前仅有MacOS版本。[3]

开源工具goccc新增功能,可详细追踪Claude Code工具调用

开源成本追踪工具goccc新增 `-tools` 功能,可解析Claude Code的会话日志,详细统计每个工具调用、技能调用和Agent启动的耗时与错误率。开发者借此发现其Explore Agent平均耗时超过4分钟,且大量已安装技能从未被使用。项目地址:https://github.com/backstabslash/goccc[6]

开发者发布统一MCP服务器,集成Gemini所有媒体生成模型

开发者发布了一个统一的MCP服务器,集成了Gemini的所有媒体生成模型,包括图像生成与编辑、视频生成、文本转语音和音乐生成。该工具旨在简化在Claude Code等环境中调用Gemini媒体功能的过程。项目地址:https://github.com/mordor-forge/gemini-media-mcp[7]

技巧教程

开发者分享“规范优先”智能体开发方法,解决上下文漂移

一位开发者分享了名为【规范优先智能体开发】的工作流,通过将开发过程分解为阶段并严格记录架构决策,有效解决了AI辅助编码中的上下文漂移问题。该方法已在GitHub开源,项目地址:https://github.com/holgerleichsenring/specification-first-agentic-development[4]

用户分享纯本地推理六个月心得:成本非最大收益,掌控感才是

一位用户分享将全部推理迁移到96GB Mac Studio六个月后的体验。虽然实现了成本节约,但最大的收获是对模型的深度理解和【全栈迭代速度】的提升。他同时指出了初期因路由策略不当导致的计算资源浪费问题。[5]

行业资讯

MiniMax澄清模型许可协议,从“开源”改为“开放权重”

MiniMax官方发布更新,由于其许可协议变更,其模型不应再被称为【开源】,而应称为【开放权重】。此举引发了社区对其许可条款的进一步讨论和审视。[8][9]