本期重点是Marin 535B-A23B启动全开放训练,以及Qwen3.8-27B在复杂代码迁移与代理任务中获得社区积极反馈。低成本分布式推理和本地工具复建也值得关注。

模型动态

斯坦福启动Marin 535B-A23B全开放训练

Marin 535B-A23B将用11台GB200 NVL72训练约3个月,处理18.75万亿Token,全程开放。[1]

Qwen3.8-27B获复杂代码迁移与代理任务好评

用户用Qwen3.8-27B迁移3.9万行C项目,并称xhigh thinking工具调用表现突出;均属个例。[4][5]

产品工具

Vercel以开放协议扩展fx代理工具生态

fx计划通过MCPAgent Skills和插件扩展,并采用Unix式小工具组合思路。[3]

社区在本地重建Mozilla Orbit摘要工具

Mozilla停运Orbit后,开发者研究原扩展与后端接口,尝试实现本地化部署的【浏览器摘要工具】。[7]

ShardFlow展示跨公网区域分布式LLM推理

ShardFlow结合投机解码与CUDA Graphs,在跨区域T4节点运行Qwen2.5-7B达到28 TPS[8]

技巧教程

两阶段RAG兼顾大规模文档召回与分析成本

先用低成本工具扫描文档,再对候选内容深度分析,适用于Codex、Cowork等代理工作流。[2]

社区实现SynthID-Text风格语言模型水印

项目以【简化实现】演示文本水印机制,可用于学习生成内容溯源;尚非生产级方案。[9]

硬件动态

社区重测macOS运行Qwen3.8-27B的推理引擎

测试比较Lightning MTPApple Neural Engine等方案;初始数据疑似有误,结论待复核。[6]