本期速报聚焦于【模型发布】与【开源动态】。通义实验室重磅发布Z-Image视觉基础模型、Qwen3-Max-Thinking旗舰推理模型及Qwen3-ASR开源语音识别套件。同时,商汤科技开源了首个支持动态视觉推理的Agentic VLMSenseNova-MARS,旨在突破多模态搜索推理天花板。

模型动态

通义实验室发布Z-Image视觉模型及Qwen3-Max-Thinking推理模型

通义实验室本周迎来里程碑式发布,推出了Z-Image视觉基础模型,为视觉创作带来完整、未经蒸馏的强大能力。同时,全新的旗舰推理模型Qwen3-Max-Thinking也已上线,展现出强劲的性能。此外,还发布了开源语音识别套件Qwen3-ASR,旨在嘈杂、多语言的实际环境中重新定义识别准确率。原文链接:https://t.co/an8TG3Q1qE[1]

商汤科技开源多模态大模型SenseNova-MARS

商汤科技开源了多模态大模型SenseNova-MARS。该模型是首个支持【动态视觉推理】并与图文搜索深度融合的Agentic VLM,旨在突破多模态搜索推理的性能上限。文章链接:https://www.qbitai.com/2026/01/374540.html[2]

产品工具

OpenClaw项目更新,支持更多模型与功能

开源AI助手框架OpenClaw近期进行了更新。在模型支持方面,新增了对Kimi K2.5和小米MiMo-V2-Flash的支持。功能上,增加了Twitch和Google Chat插件,并实现了在聊天中发送图像的功能。项目还通过34次安全相关提交强化了代码库。原文地址:https://t.co/2tB0qzTeBg[3]

技巧教程

腾讯提出RoT框架,加速大模型思维链推理

腾讯研究人员提出名为RoT的新框架,通过将思维链“画”进隐空间来压缩推理过程,旨在【显著提升】大模型思维链推理的速度并【降低显存消耗】。文章链接:https://mp.weixin.qq.com/s?__biz=MjM5ODYwMjI2MA==&mid=2649798677&idx=2&sn=772a84999b3ed984298fb2cf17e7518c[4]

行业资讯

千问团队四篇论文入选ICLR 2026,LeCun加入初创公司董事会

千问C端应用团队有四篇论文被ICLR 2026接收,在多个前沿研究领域取得创新突破。另一方面,Yann LeCun在离职后加入一家硅谷初创公司董事会,押注与大模型不同的技术路线,开始研究名为【“能量-推理模型”】的新方向。文章链接1:https://www.qbitai.com/2026/01/374507.html, 文章链接2:https://www.qbitai.com/2026/01/374471.html[5][6]