今日动态集中在模型能力升级与产品功能深化。谷歌在视频生成与个性化助手两端发力;阿里千问通过生态整合,将AI Agent推向实用;Claude Code的更新提升了开发体验。同时,开源社区与模型评测平台保持活跃。

模型动态

Google DeepMind发布高分辨率Veo 3.1视频生成模型

更新内容:veo-3.1-audio-4k、veo-3.1-audio-1080p等模型已在Video Arena上线。 核心价值:支持1080p和4K分辨率输出,供用户实测评估。[1][2][3]

阿里千问APP上线400多项新功能,集成阿里生态

更新内容:接入淘宝、支付宝、飞猪、高德等,支持旅行规划、点外卖等复杂任务。 实测反馈:有用户实测点外卖功能,发现价格比直接使用外卖平台贵,存在优化空间。

Claude Code发布两项重要更新

更新1:加入MCP工具搜索功能,可动态加载工具,节省上下文。 更新2:接受或拒绝提示时,支持用Tab键补充信息,提升交互效率。[4]

GLM-Image模型上线LMArena评测平台

事件:智谱AI的GLM-Image模型已加入LMArena的Text-to-Image竞技场。 价值:用户可将其与前沿AI模型进行对比测试。

产品工具

Google推出Gemini“个人智能”功能

产品形态:Gemini应用新功能,允许一键连接Gmail、Google Photos等应用。 核心价值:基于个人数据提供跨应用的个性化帮助,目前以Beta形式在美国推出。

两个GitHub开源项目热度飙升

项目1:藏师傅提示词库,Star数近700。 项目2:PPT生成Skills,Star数近500,其文档编写质量受到称赞。