本周社区焦点集中在【模型开源】与实用工具上,Orthrus扩散头即将训练Qwen3.5/3.6和Gemma4模型,SpectralQuant量化方法显著提升小模型性能,同时96GB 5090显卡传闻、【GPU构建选择器】和【Codex用量监控】等工具为开发者提供了新的硬件与效率方案。

模型动态

Orthrus扩散头模型即将开源,覆盖Qwen3.5/3.6和Gemma4

Reddit用户预告即将开源基于扩散头训练的Qwen3.5/3.6和Gemma4模型,并附带完整训练与评估代码,对本地模型开发者是重要更新。[1]

产品工具

SpectralQuant校准感知量化方法发布,Q4_K_M恢复96.5% BF16性能

社区发布SpectralQuant量化方法,针对Qwen3.5 0.8B模型,使Q4_K_M量化版本恢复96.5%的BF16性能,显著提升小模型效率。[2]

离线GPU构建选择器发布,可估算模型运行速度

开发者制作了一款离线单文件GPU构建选择器,输入硬件配置即可估算本地模型运行的tok/s速度,辅助硬件采购与模型选型。[4]

Knowledge Mem本地AI记忆工具发布,支持MCP配置

开发者wey_gu推出Knowledge Mem工具,为AI对话添加长期记忆和个人知识库功能,支持MCP配置。下载地址:https://t.co/rLyJ8Y3XYv[6][7]

Seedance 2.0视频生成工具亮相,用于制作宣传片

用户@op7418用Seedance 2.0重新制作了Codepilot的宣传片,展示其视频生成能力,该工具可能成为新的AI视频创作选择。[8]

Codex用量监控工具发布,可视化Token和额度消耗

开发者gerik读取Codex本地JSONL日志,将聚合用量索引到SQLite,并通过仪表盘、CLI和MCP工具可视化展示,帮助用户清晰了解Token和额度使用情况。[9]

硬件动态

传闻华强北出现96GB显存5090显卡,售价约36000元

Reddit帖子称深圳华强北市场出现96GB显存的RTX 5090显卡,价格约36000元,若属实将极大推动本地大模型部署,但目前仅为传闻[3]

行业资讯

DeepSeek应用新增视觉模式,或预示新视觉模型即将到来

DeepSeek App界面出现视觉模式选项,社区猜测可能是在为新视觉模型铺路,但尚未得到官方确认,值得关注[5]