本期Kimi K3生态持续扩展并获权威评测,Google发布本地微调工具gemma-trainer,智谱ARR达10亿美元,谷歌推迟Gemini 3.5 Pro发布,硬件端侧推理和AMD新加速器也有重要进展。

产品工具

Kimi K3生态扩展:ClinePass上线、评测显示擅长前端视觉

Kimi K3已上线ClinePass订阅服务,月费$9.99可折扣使用。乔帮主详评称K3在【交互、视觉、空间】场景可作首选,但在后端场景仍落后于最强闭源模型。另有用户用K3在浏览器中一次性重建macOS27界面。[1][2][3]

Google发布gemma-trainer,可本地微调Gemma模型

Google发布gemma-trainer技能,允许用户在本地电脑上微调Gemma模型。详细教程:https://t.co/ZsafGk6MMD[4]

技巧教程

Simon Willison分享高效提示技巧:让AI克隆GitHub仓库作参考

Simon Willison分享常用提示模式:让AI克隆GitHub仓库到/tmp目录作为参考,有助于提升AI理解代码库的能力。[7]

单台Mac Studio部署多个Qwen3.5 122b会话经验

用户分享在单台Mac Studio(96GB)上运行多个Qwen3.5 122b会话的经验,实现高吞吐量,对本地模型部署优化有实用指导意义。[10]

硬件动态

AMD Instinct MI350P PCIe AI加速器曝光

AMD InstinctMI350PAI加速器曝光,采用HBM内存,为PCIe形态,对本地推理部署有重要意义。[8]

三星S26 Ultra成功运行Qwen 35B MoE,达90 tok/s

用户在三星S26 Ultra上成功运行Qwen 35B MoE模型,输入处理速度达约90 tokens/s,展示了端侧推理新进展。[9]

行业资讯

智谱AI年化收入ARR达10亿美元

据创业邦报道,智谱AI的ARR(年化经常性收入)已达10亿美元,是国产AI公司重要的商业里程碑。[5]

谷歌推迟发布Gemini 3.5 Pro,因需提升编程能力

因需提升编程能力,谷歌推迟发布旗舰模型Gemini 3.5 Pro,可能影响AI竞争格局。[6]