Meta将“分割一切”的能力从图像扩展到音频,有望大幅简化音频处理工作流。Google和飞书均在强化AI与办公场景的深度集成,前者侧重个人邮件与日程管理,后者主打企业级知识挖掘与内容生成。KAT-Coder-Pro的发布则体现了代码模型领域的快速迭代。

模型动态

Meta发布开源音频分割模型SAM Audio

功能:可像图像抠图一样,从复杂音频中分割提取特定声音元素(如人声、乐器、噪音)。 应用:一键提取歌曲人声、过滤视频噪音、去除播客杂音,无需专业知识。 特点:支持文本、视觉、时间三种提示方式,模型已开源。[1]

KAT-Coder-Pro V1模型在ZenMuxAI平台上线

定位:作为现有代码模型的“即插即用”式升级替代,宣称零代码更改即可获得显著性能提升。[4]

产品工具

飞书AI工作助手Aily重大升级

功能:可定时从企业全部文档中总结提炼信息,并整合外部搜索生成网页、播客、海报等多模态内容。 核心:将企业沉淀在飞书中的上下文价值最大化,支持自定义MCP工具接入企业内部数据。 限制:企业知识检索仅限企业账号,个人版暂不支持。

行业资讯

Google Labs推出实验性AI邮件助理CC

功能:集成于Gmail、日历和云端硬盘的智能助手,通过邮件主动管理日程与任务。 使用:用户会收到CC的每日晨报邮件,也可直接发邮件给CC下达指令(如总结邮件、提醒会议)。 现状:目前仅限美国、加拿大18岁以上用户,Google AI Ultra及付费用户优先。[2][3]