开源模型与框架持续迭代,Qwen推出全模态更新,智谱发布GUI自动化Agent。闭源模型方面,ChatGPT即将迎来重大更新“Garlic”并深度集成Adobe生产力套件。AI硬件(豆包手机)与实用工具(Paper2Slides)也在快速推进,生态呈现软硬件协同发展的态势。

模型动态

阿里发布新开源模型 Qwen3-Omni-Flash-20251201

事件:阿里发布Qwen3-Omni-Flash的更新版本。 特性:全模态模型,支持文本、语音、图片、视频输入,输出文本和语音,适合端侧设备。 性能:官方评测显示各方向基准测试有2%-10%提升。[1]

智谱AI开源Agent框架Open-AutoGLM

事件:智谱AI推出开源“Agent”框架Open-AutoGLM。 功能:赋予大模型直接操作图形用户界面(GUI)的能力,通过ADB接管安卓手机实现自动化。 价值:可用于自动化完成微信点赞、美团抢券等任务。

ChatGPT新款模型Garlic即将发布

事件:新款ChatGPT模型“Garlic”预计将于今晚发布。 内容:可能包含最新的图像视觉模型、语音模型以及全新的GPTs商店。

AI工具Paper2Slides发布

事件:推出AI工具Paper2Slides。 功能:一键将研究论文、报告等文档(支持PDF、Word等多种格式)转化为专业的幻灯片或海报。

产品工具

豆包AI手机体验分享

事件:用户分享豆包AI手机的早期体验。 功能:可通过语音指令让手机自动安装App,左侧设有物理按键随时唤起豆包AI助手。

行业资讯

Adobe套件登陆ChatGPT

事件:用户现可在ChatGPT中通过聊天使用Photoshop、Adobe Express和Acrobat。 功能:例如,输入指令即可让ChatGPT自动启动Photoshop并执行虚化背景等任务。 状态:功能已陆续登陆Android客户端。