今日动态集中于AI视频生成与模型能力升级。商汤和Medeo的视频Agent将长视频/剧集生成推向可控、可编辑的新阶段。通义千问的模型升级强化了多模态交互与个性化能力。百度的算法开发Agent则瞄准了研发效率的提升。

模型动态

Qwen3-Omni-Flash模型发布重大升级。

核心更新:增强多轮视频/音频理解能力,支持通过系统提示词自定义AI人格。 语言支持:覆盖119种文本语言和19种语音。 上线渠道:已在Qwen Chat网页端开放语音/视频聊天功能,并提供实时与离线API。

商汤发布Seko 2.0多剧集AI视频Agent。

产品功能:支持基于一句话灵感或完整剧本,自动规划并生成最多100集连贯短视频。 核心特点:全流程可控可编辑,包括剧情、分镜、角色设计等环节。 用户测试:反馈良好,已提供详细教程和体验链接。

Medeo新版视频Agent发布,支持复杂提示词编辑。

核心能力:用户可通过自然语言对生成的视频进行复杂修改,如增删内容、改写脚本。 实测反馈:与Nano Banana Pro等提示词风格兼容性好,生成内容一致性强。 上线时间:预计下周正式上线。

百度发布Famou (FM Agent)算法开发Agent。

产品定位:旨在自动化算法开发流程,减少试错时间。 核心功能:可自主探索解决方案空间、进化更强版本并持续学习改进。