音频编辑领域迎来突破性进展,StepFun的模型实现了语音的"文本式编辑"。通义持续丰富Qwen生态,推出实用的图像处理工具。xAI即将进军音乐生成领域,值得期待。

模型动态

StepFun AI发布音频编辑模型Step-Audio-EditX

30亿参数,支持零样本语音克隆与多轮可迭代编辑 通过自然语言指令编辑音频情绪、语气、风格等特征 在自然度、情感表达等指标上超越Minimax与Doubao等闭源模型[1][2]

通义实验室发布基于Qwen-Image的LoRA工具

阴影去除与曝光修复LoRA:基于Qwen-Image构建的实用工具 图像超分LoRA:基于Qwen-Image-Edit-2509,有效修复模糊、噪点等图像问题

xAI预告将发布音乐模型

预告日期为2025年11月10日,具体细节尚未公布