本期焦点是谷歌Gemma 4的全面发布,其【Apache 2.0开源】、【原生多模态】及覆盖从手机到工作站的全硬件场景特性引发热议。同时,【通义千问Qwen3.6 Plus】在代码榜单取得新突破,百度健康也发布了国内首个任务型医疗AI助理。

模型动态

谷歌发布Gemma 4开源模型家族,主打本地部署与多模态

谷歌发布Gemma 4系列模型,包含四个参数版本,覆盖从手机到工作站的全硬件场景。模型原生支持【多模态】(图像/视频/语音)、Function Call和Agency Workflows,并采用Apache 2.0许可证,允许商用和私有部署。[1][2]

通义千问Qwen3.6 Plus在Code Arena榜单排名升至第八

通义实验室宣布,Qwen3.6 Plus Preview在Code Arena总榜排名升至第8,并在React榜单位列第2。这验证了其在Agentic Coding方面的能力,包括多步推理、复杂工具使用和多文件应用开发。[4]

产品工具

谷歌推出安卓应用Google AI Edge Gallery,可体验Gemma 4

谷歌同步发布安卓应用Google AI Edge Gallery,用户可直接在手机上体验Gemma 4模型。应用内置Skills体验区,支持调用工具编写和试用,实测推理速度很快。下载地址:https://play.google.com/store/apps/details?id=com.google.edgegallery[3]

百度健康发布国内首个任务型医疗AI助理“有医助理”

百度健康发布国内首个任务型医疗AI助理“有医助理”。该产品深度融合权威医学检索与基于Claw框架的任务执行能力,标志着医疗AI从信息检索向任务完成的跨越。[5]

小米推出MiMo大模型及Token Plan订阅模式

小米推出MiMo大模型,并首次引入Token Plan订阅模式。该模式旨在通过单次订阅满足用户对全模态Agent任务的需求,同时推出首购优惠。文章链接:https://www.qbitai.com/2026/04/395210.html[8]

行业资讯

Arena平台公开近三年模型排行榜历史数据集

Arena平台宣布公开其近3年的模型排行榜历史数据,涵盖10个竞技场、数十个类别和数百个模型。该数据集旨在赋能社区分析,解锁跨模态和跨时间的新见解。[6]

美团探索原生多模态技术,将图像语音统一视为Token

美团正探索原生多模态AI技术,采用将图像、语音等数据统一视为Token进行预测的新范式。有观点认为这种“离散视觉”方法潜力巨大,是多模态建模的“野路子”。文章链接:https://www.qbitai.com/2026/04/395216.html[7]